Pruning All-Rounder: Rethinking and Improving Inference Efficiency for Large Vision Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Suo, Wei, Ma, Ji, Sun, Mengyang, Wu, Lin Yuanbo, Wang, Peng, Zhang, Yanning |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mitigating Information Loss under High Pruning Rates for Efficient Large Vision Language Models
di: Fu, Mingyu, et al.
Pubblicazione: (2025)
di: Fu, Mingyu, et al.
Pubblicazione: (2025)
Short-LVLM: Compressing and Accelerating Large Vision-Language Models by Pruning Redundant Layers
di: Ma, Ji, et al.
Pubblicazione: (2025)
di: Ma, Ji, et al.
Pubblicazione: (2025)
Octopus: Alleviating Hallucination via Dynamic Contrastive Decoding
di: Suo, Wei, et al.
Pubblicazione: (2025)
di: Suo, Wei, et al.
Pubblicazione: (2025)
C3L: Content Correlated Vision-Language Instruction Tuning Data Generation via Contrastive Learning
di: Ma, Ji, et al.
Pubblicazione: (2024)
di: Ma, Ji, et al.
Pubblicazione: (2024)
Understanding and Mitigating Hallucinations in Multimodal Chain-of-Thought Models
di: Ma, Ji, et al.
Pubblicazione: (2026)
di: Ma, Ji, et al.
Pubblicazione: (2026)
Visual Prompt Selection for In-Context Learning Segmentation
di: Suo, Wei, et al.
Pubblicazione: (2024)
di: Suo, Wei, et al.
Pubblicazione: (2024)
Rethinking Model Efficiency: Multi-Agent Inference with Large Models
di: Dong, Sixun, et al.
Pubblicazione: (2026)
di: Dong, Sixun, et al.
Pubblicazione: (2026)
A Plug-and-Play Method for Rare Human-Object Interactions Detection by Bridging Domain Gap
di: Zhang, Lijun, et al.
Pubblicazione: (2024)
di: Zhang, Lijun, et al.
Pubblicazione: (2024)
Is Nano Banana Pro a Low-Level Vision All-Rounder? A Comprehensive Evaluation on 14 Tasks and 40 Datasets
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
Hallucination-aware intermediate representation edit in large vision-language models
di: Suo, Wei, et al.
Pubblicazione: (2026)
di: Suo, Wei, et al.
Pubblicazione: (2026)
LearnPruner: Rethinking Attention-based Token Pruning in Vision Language Models
di: Takezoe, Rinyoichi, et al.
Pubblicazione: (2026)
di: Takezoe, Rinyoichi, et al.
Pubblicazione: (2026)
Topology-Aware Layer Pruning for Large Vision-Language Models
di: Zheng, Pengcheng, et al.
Pubblicazione: (2026)
di: Zheng, Pengcheng, et al.
Pubblicazione: (2026)
A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models
di: Zeng, Quan-Sheng, et al.
Pubblicazione: (2025)
di: Zeng, Quan-Sheng, et al.
Pubblicazione: (2025)
Vision and Intention Boost Large Language Model in Long-Term Action Anticipation
di: Cao, Congqi, et al.
Pubblicazione: (2025)
di: Cao, Congqi, et al.
Pubblicazione: (2025)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
di: Li, Ao, et al.
Pubblicazione: (2025)
di: Li, Ao, et al.
Pubblicazione: (2025)
Evading Visual Aphasia: Contrastive Adaptive Semantic Token Pruning for Vision-Language Models
di: Ma, Jie, et al.
Pubblicazione: (2026)
di: Ma, Jie, et al.
Pubblicazione: (2026)
LanP: Rethinking the Impact of Language Priors in Large Vision-Language Models
di: Wu, Zongyu, et al.
Pubblicazione: (2025)
di: Wu, Zongyu, et al.
Pubblicazione: (2025)
Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models
di: Ma, Kexin, et al.
Pubblicazione: (2026)
di: Ma, Kexin, et al.
Pubblicazione: (2026)
Evaluating and Analyzing Relationship Hallucinations in Large Vision-Language Models
di: Wu, Mingrui, et al.
Pubblicazione: (2024)
di: Wu, Mingrui, et al.
Pubblicazione: (2024)
Rethinking Causal Mask Attention for Vision-Language Inference
di: Pei, Xiaohuan, et al.
Pubblicazione: (2025)
di: Pei, Xiaohuan, et al.
Pubblicazione: (2025)
OmniPT: Unleashing the Potential of Large Vision Language Models for Pedestrian Tracking and Understanding
di: Fu, Teng, et al.
Pubblicazione: (2025)
di: Fu, Teng, et al.
Pubblicazione: (2025)
GreedyPrune: Retenting Critical Visual Token Set for Large Vision Language Models
di: Pei, Ruiguang, et al.
Pubblicazione: (2025)
di: Pei, Ruiguang, et al.
Pubblicazione: (2025)
Rethinking Pruning for Vision-Language Models: Strategies for Effective Sparsity and Performance Restoration
di: He, Shwai, et al.
Pubblicazione: (2024)
di: He, Shwai, et al.
Pubblicazione: (2024)
Rethinking Practical and Efficient Quantization Calibration for Vision-Language Models
di: Shang, Zhenhao, et al.
Pubblicazione: (2026)
di: Shang, Zhenhao, et al.
Pubblicazione: (2026)
Collaborative Multi-Mode Pruning for Vision-Language Models
di: Wu, Zimeng, et al.
Pubblicazione: (2026)
di: Wu, Zimeng, et al.
Pubblicazione: (2026)
Rethinking Token Reduction for Large Vision-Language Models
di: Wang, Yi, et al.
Pubblicazione: (2026)
di: Wang, Yi, et al.
Pubblicazione: (2026)
SlowFastVAD: Video Anomaly Detection via Integrating Simple Detector and RAG-Enhanced Vision-Language Model
di: Ding, Zongcan, et al.
Pubblicazione: (2025)
di: Ding, Zongcan, et al.
Pubblicazione: (2025)
Automatic Pruning Discovery for Large Language Models
di: Kang, Haidong, et al.
Pubblicazione: (2025)
di: Kang, Haidong, et al.
Pubblicazione: (2025)
DiffV2IR: Visible-to-Infrared Diffusion Model via Vision-Language Understanding
di: Ran, Lingyan, et al.
Pubblicazione: (2025)
di: Ran, Lingyan, et al.
Pubblicazione: (2025)
Attention Debiasing for Token Pruning in Vision Language Models
di: Zhao, Kai, et al.
Pubblicazione: (2025)
di: Zhao, Kai, et al.
Pubblicazione: (2025)
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026)
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026)
MoPE-CLIP: Structured Pruning for Efficient Vision-Language Models with Module-wise Pruning Error Metric
di: Lin, Haokun, et al.
Pubblicazione: (2024)
di: Lin, Haokun, et al.
Pubblicazione: (2024)
SCLIP: Rethinking Self-Attention for Dense Vision-Language Inference
di: Wang, Feng, et al.
Pubblicazione: (2023)
di: Wang, Feng, et al.
Pubblicazione: (2023)
ViTCoP: Accelerating Large Vision-Language Models via Visual and Textual Semantic Collaborative Pruning
di: Luo, Wen, et al.
Pubblicazione: (2026)
di: Luo, Wen, et al.
Pubblicazione: (2026)
AdaptInfer: Adaptive Token Pruning for Vision-Language Model Inference with Dynamical Text Guidance
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
SAISA: Towards Multimodal Large Language Models with Both Training and Inference Efficiency
di: Yuan, Qianhao, et al.
Pubblicazione: (2025)
di: Yuan, Qianhao, et al.
Pubblicazione: (2025)
ATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models
di: Ye, Xubing, et al.
Pubblicazione: (2024)
di: Ye, Xubing, et al.
Pubblicazione: (2024)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
di: Luan, Bozhi, et al.
Pubblicazione: (2025)
di: Luan, Bozhi, et al.
Pubblicazione: (2025)
INTERLACE: Interleaved Layer Pruning and Efficient Adaptation in Large Vision-Language Models
di: Madinei, Parsa, et al.
Pubblicazione: (2025)
di: Madinei, Parsa, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Mitigating Information Loss under High Pruning Rates for Efficient Large Vision Language Models
di: Fu, Mingyu, et al.
Pubblicazione: (2025) -
Short-LVLM: Compressing and Accelerating Large Vision-Language Models by Pruning Redundant Layers
di: Ma, Ji, et al.
Pubblicazione: (2025) -
Octopus: Alleviating Hallucination via Dynamic Contrastive Decoding
di: Suo, Wei, et al.
Pubblicazione: (2025) -
C3L: Content Correlated Vision-Language Instruction Tuning Data Generation via Contrastive Learning
di: Ma, Ji, et al.
Pubblicazione: (2024) -
Understanding and Mitigating Hallucinations in Multimodal Chain-of-Thought Models
di: Ma, Ji, et al.
Pubblicazione: (2026)