Mitigating Information Loss under High Pruning Rates for Efficient Large Vision Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Fu, Mingyu, Suo, Wei, Ma, Ji, Wu, Lin Yuanbo, Wang, Peng, Zhang, Yanning |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pruning All-Rounder: Rethinking and Improving Inference Efficiency for Large Vision Language Models
di: Suo, Wei, et al.
Pubblicazione: (2024)
di: Suo, Wei, et al.
Pubblicazione: (2024)
Short-LVLM: Compressing and Accelerating Large Vision-Language Models by Pruning Redundant Layers
di: Ma, Ji, et al.
Pubblicazione: (2025)
di: Ma, Ji, et al.
Pubblicazione: (2025)
Understanding and Mitigating Hallucinations in Multimodal Chain-of-Thought Models
di: Ma, Ji, et al.
Pubblicazione: (2026)
di: Ma, Ji, et al.
Pubblicazione: (2026)
C3L: Content Correlated Vision-Language Instruction Tuning Data Generation via Contrastive Learning
di: Ma, Ji, et al.
Pubblicazione: (2024)
di: Ma, Ji, et al.
Pubblicazione: (2024)
Octopus: Alleviating Hallucination via Dynamic Contrastive Decoding
di: Suo, Wei, et al.
Pubblicazione: (2025)
di: Suo, Wei, et al.
Pubblicazione: (2025)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
di: Li, Ao, et al.
Pubblicazione: (2025)
di: Li, Ao, et al.
Pubblicazione: (2025)
A Plug-and-Play Method for Rare Human-Object Interactions Detection by Bridging Domain Gap
di: Zhang, Lijun, et al.
Pubblicazione: (2024)
di: Zhang, Lijun, et al.
Pubblicazione: (2024)
Hallucination-aware intermediate representation edit in large vision-language models
di: Suo, Wei, et al.
Pubblicazione: (2026)
di: Suo, Wei, et al.
Pubblicazione: (2026)
INTERLACE: Interleaved Layer Pruning and Efficient Adaptation in Large Vision-Language Models
di: Madinei, Parsa, et al.
Pubblicazione: (2025)
di: Madinei, Parsa, et al.
Pubblicazione: (2025)
GreedyPrune: Retenting Critical Visual Token Set for Large Vision Language Models
di: Pei, Ruiguang, et al.
Pubblicazione: (2025)
di: Pei, Ruiguang, et al.
Pubblicazione: (2025)
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
di: Liu, Jizhihui, et al.
Pubblicazione: (2025)
di: Liu, Jizhihui, et al.
Pubblicazione: (2025)
FoPru: Focal Pruning for Efficient Large Vision-Language Models
di: Jiang, Lei, et al.
Pubblicazione: (2024)
di: Jiang, Lei, et al.
Pubblicazione: (2024)
A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models
di: Zeng, Quan-Sheng, et al.
Pubblicazione: (2025)
di: Zeng, Quan-Sheng, et al.
Pubblicazione: (2025)
Vision and Intention Boost Large Language Model in Long-Term Action Anticipation
di: Cao, Congqi, et al.
Pubblicazione: (2025)
di: Cao, Congqi, et al.
Pubblicazione: (2025)
IKOD: Mitigating Visual Attention Degradation in Large Vision-Language Models
di: Yang, Jiabing, et al.
Pubblicazione: (2025)
di: Yang, Jiabing, et al.
Pubblicazione: (2025)
Self-Correction Inside the Model: Leveraging Layer Attention to Mitigate Hallucinations in Large Vision Language Models
di: Fu, April
Pubblicazione: (2026)
di: Fu, April
Pubblicazione: (2026)
Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models
di: Ma, Kexin, et al.
Pubblicazione: (2026)
di: Ma, Kexin, et al.
Pubblicazione: (2026)
V-CAST: Video Curvature-Aware Spatio-Temporal Pruning for Efficient Video Large Language Models
di: Lin, Xinying, et al.
Pubblicazione: (2026)
di: Lin, Xinying, et al.
Pubblicazione: (2026)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)
MoPE-CLIP: Structured Pruning for Efficient Vision-Language Models with Module-wise Pruning Error Metric
di: Lin, Haokun, et al.
Pubblicazione: (2024)
di: Lin, Haokun, et al.
Pubblicazione: (2024)
Topology-Aware Layer Pruning for Large Vision-Language Models
di: Zheng, Pengcheng, et al.
Pubblicazione: (2026)
di: Zheng, Pengcheng, et al.
Pubblicazione: (2026)
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026)
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026)
PLPHP: Per-Layer Per-Head Vision Token Pruning for Efficient Large Vision-Language Models
di: Meng, Yu, et al.
Pubblicazione: (2025)
di: Meng, Yu, et al.
Pubblicazione: (2025)
Collaborative Multi-Mode Pruning for Vision-Language Models
di: Wu, Zimeng, et al.
Pubblicazione: (2026)
di: Wu, Zimeng, et al.
Pubblicazione: (2026)
CAPA: Contribution-Aware Pruning and FFN Approximation for Efficient Large Vision-Language Models
di: Jha, Samyak, et al.
Pubblicazione: (2026)
di: Jha, Samyak, et al.
Pubblicazione: (2026)
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
Mitigating Multilingual Hallucination in Large Vision-Language Models
di: Qu, Xiaoye, et al.
Pubblicazione: (2024)
di: Qu, Xiaoye, et al.
Pubblicazione: (2024)
SlowFastVAD: Video Anomaly Detection via Integrating Simple Detector and RAG-Enhanced Vision-Language Model
di: Ding, Zongcan, et al.
Pubblicazione: (2025)
di: Ding, Zongcan, et al.
Pubblicazione: (2025)
Automatic Pruning Discovery for Large Language Models
di: Kang, Haidong, et al.
Pubblicazione: (2025)
di: Kang, Haidong, et al.
Pubblicazione: (2025)
DiffV2IR: Visible-to-Infrared Diffusion Model via Vision-Language Understanding
di: Ran, Lingyan, et al.
Pubblicazione: (2025)
di: Ran, Lingyan, et al.
Pubblicazione: (2025)
Evading Visual Aphasia: Contrastive Adaptive Semantic Token Pruning for Vision-Language Models
di: Ma, Jie, et al.
Pubblicazione: (2026)
di: Ma, Jie, et al.
Pubblicazione: (2026)
Attention Debiasing for Token Pruning in Vision Language Models
di: Zhao, Kai, et al.
Pubblicazione: (2025)
di: Zhao, Kai, et al.
Pubblicazione: (2025)
EfficientLLaVA:Generalizable Auto-Pruning for Large Vision-language Models
di: Liang, Yinan, et al.
Pubblicazione: (2025)
di: Liang, Yinan, et al.
Pubblicazione: (2025)
ViTCoP: Accelerating Large Vision-Language Models via Visual and Textual Semantic Collaborative Pruning
di: Luo, Wen, et al.
Pubblicazione: (2026)
di: Luo, Wen, et al.
Pubblicazione: (2026)
METEOR: Multi-Encoder Collaborative Token Pruning for Efficient Vision Language Models
di: Liu, Yuchen, et al.
Pubblicazione: (2025)
di: Liu, Yuchen, et al.
Pubblicazione: (2025)
Evaluating and Analyzing Relationship Hallucinations in Large Vision-Language Models
di: Wu, Mingrui, et al.
Pubblicazione: (2024)
di: Wu, Mingrui, et al.
Pubblicazione: (2024)
RS-Prune: Training-Free Data Pruning at High Ratios for Efficient Remote Sensing Diffusion Foundation Models
di: Wei, Fan, et al.
Pubblicazione: (2025)
di: Wei, Fan, et al.
Pubblicazione: (2025)
Blended Latent Diffusion under Attention Control for Real-World Video Editing
di: Liu, Deyin, et al.
Pubblicazione: (2024)
di: Liu, Deyin, et al.
Pubblicazione: (2024)
ATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models
di: Ye, Xubing, et al.
Pubblicazione: (2024)
di: Ye, Xubing, et al.
Pubblicazione: (2024)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
di: Luan, Bozhi, et al.
Pubblicazione: (2025)
di: Luan, Bozhi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Pruning All-Rounder: Rethinking and Improving Inference Efficiency for Large Vision Language Models
di: Suo, Wei, et al.
Pubblicazione: (2024) -
Short-LVLM: Compressing and Accelerating Large Vision-Language Models by Pruning Redundant Layers
di: Ma, Ji, et al.
Pubblicazione: (2025) -
Understanding and Mitigating Hallucinations in Multimodal Chain-of-Thought Models
di: Ma, Ji, et al.
Pubblicazione: (2026) -
C3L: Content Correlated Vision-Language Instruction Tuning Data Generation via Contrastive Learning
di: Ma, Ji, et al.
Pubblicazione: (2024) -
Octopus: Alleviating Hallucination via Dynamic Contrastive Decoding
di: Suo, Wei, et al.
Pubblicazione: (2025)