DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Alvar, Saeed Ranjbar, Singh, Gursimran, Akbari, Mohammad, Zhang, Yong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
di: Li, Ao, et al.
Pubblicazione: (2025)
di: Li, Ao, et al.
Pubblicazione: (2025)
IDPruner: Harmonizing Importance and Diversity in Visual Token Pruning for MLLMs
di: Tan, Yifan, et al.
Pubblicazione: (2026)
di: Tan, Yifan, et al.
Pubblicazione: (2026)
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026)
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026)
How Many Visual Tokens Do Multimodal Language Models Need? Scaling Visual Token Pruning with F^3A
di: Huang, YiJie, et al.
Pubblicazione: (2026)
di: Huang, YiJie, et al.
Pubblicazione: (2026)
Exploring Token Pruning in Vision State Space Models
di: Zhan, Zheng, et al.
Pubblicazione: (2024)
di: Zhan, Zheng, et al.
Pubblicazione: (2024)
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent
di: Li, Jiaao, et al.
Pubblicazione: (2025)
di: Li, Jiaao, et al.
Pubblicazione: (2025)
Beyond Attention or Similarity: Maximizing Conditional Diversity for Token Pruning in MLLMs
di: Zhang, Qizhe, et al.
Pubblicazione: (2025)
di: Zhang, Qizhe, et al.
Pubblicazione: (2025)
ForestPrune: High-ratio Visual Token Compression for Video Multimodal Large Language Models via Spatial-Temporal Forest Modeling
di: Ju, Shaobo, et al.
Pubblicazione: (2026)
di: Ju, Shaobo, et al.
Pubblicazione: (2026)
Pruning By Explaining Revisited: Optimizing Attribution Methods to Prune CNNs and Transformers
di: Hatefi, Sayed Mohammad Vakilzadeh, et al.
Pubblicazione: (2024)
di: Hatefi, Sayed Mohammad Vakilzadeh, et al.
Pubblicazione: (2024)
Grounding-Aware Token Pruning: Recovering from Drastic Performance Drops in Visual Grounding Caused by Pruning
di: Chien, Tzu-Chun, et al.
Pubblicazione: (2025)
di: Chien, Tzu-Chun, et al.
Pubblicazione: (2025)
Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs
di: Zhang, Qizhe, et al.
Pubblicazione: (2024)
di: Zhang, Qizhe, et al.
Pubblicazione: (2024)
PLPHP: Per-Layer Per-Head Vision Token Pruning for Efficient Large Vision-Language Models
di: Meng, Yu, et al.
Pubblicazione: (2025)
di: Meng, Yu, et al.
Pubblicazione: (2025)
ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving
di: Sha, Lin, et al.
Pubblicazione: (2026)
di: Sha, Lin, et al.
Pubblicazione: (2026)
Energy-Driven Adaptive Visual Token Pruning for Efficient Vision-Language Models
di: He, Jialuo, et al.
Pubblicazione: (2026)
di: He, Jialuo, et al.
Pubblicazione: (2026)
ConceptPrune: Concept Editing in Diffusion Models via Skilled Neuron Pruning
di: Chavhan, Ruchika, et al.
Pubblicazione: (2024)
di: Chavhan, Ruchika, et al.
Pubblicazione: (2024)
Isomorphic Pruning for Vision Models
di: Fang, Gongfan, et al.
Pubblicazione: (2024)
di: Fang, Gongfan, et al.
Pubblicazione: (2024)
Balanced Token Pruning: Accelerating Vision Language Models Beyond Local Optimization
di: Li, Kaiyuan, et al.
Pubblicazione: (2025)
di: Li, Kaiyuan, et al.
Pubblicazione: (2025)
AdaTP: Attention-Debiased Token Pruning for Video Large Language Models
di: Sun, Fengyuan, et al.
Pubblicazione: (2025)
di: Sun, Fengyuan, et al.
Pubblicazione: (2025)
QuarterMap: Efficient Post-Training Token Pruning for Visual State Space Models
di: Chi, Tien-Yu, et al.
Pubblicazione: (2025)
di: Chi, Tien-Yu, et al.
Pubblicazione: (2025)
Evading Visual Aphasia: Contrastive Adaptive Semantic Token Pruning for Vision-Language Models
di: Ma, Jie, et al.
Pubblicazione: (2026)
di: Ma, Jie, et al.
Pubblicazione: (2026)
What Kind of Visual Tokens Do We Need? Training-free Visual Token Pruning for Multi-modal Large Language Models from the Perspective of Graph
di: Jiang, Yutao, et al.
Pubblicazione: (2025)
di: Jiang, Yutao, et al.
Pubblicazione: (2025)
Meta Pruning via Graph Metanetworks : A Universal Meta Learning Framework for Network Pruning
di: Liu, Yewei, et al.
Pubblicazione: (2025)
di: Liu, Yewei, et al.
Pubblicazione: (2025)
LaWa: Using Latent Space for In-Generation Image Watermarking
di: Rezaei, Ahmad, et al.
Pubblicazione: (2024)
di: Rezaei, Ahmad, et al.
Pubblicazione: (2024)
StreamingAssistant: Efficient Visual Token Pruning for Accelerating Online Video Understanding
di: Jin, Xinqi, et al.
Pubblicazione: (2025)
di: Jin, Xinqi, et al.
Pubblicazione: (2025)
Bridging the Semantic-Action Gap in Visual Token Pruning for Efficient VLA Inference
di: Liu, Ziyan, et al.
Pubblicazione: (2025)
di: Liu, Ziyan, et al.
Pubblicazione: (2025)
CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
di: Tang, Zicong, et al.
Pubblicazione: (2025)
di: Tang, Zicong, et al.
Pubblicazione: (2025)
Multi-Dimensional Pruning: Joint Channel, Layer and Block Pruning with Latency Constraint
di: Sun, Xinglong, et al.
Pubblicazione: (2024)
di: Sun, Xinglong, et al.
Pubblicazione: (2024)
Object-Centric Vision Token Pruning for Vision Language Models
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
EVTP-IVS: Effective Visual Token Pruning For Unifying Instruction Visual Segmentation In Multi-Modal Large Language Models
di: Zhu, Wenhui, et al.
Pubblicazione: (2025)
di: Zhu, Wenhui, et al.
Pubblicazione: (2025)
ZSPAPrune: Zero-Shot Prompt-Aware Token Pruning for Vision-Language Models
di: Zhang, Pu, et al.
Pubblicazione: (2025)
di: Zhang, Pu, et al.
Pubblicazione: (2025)
Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning
di: Zhang, Dingkun, et al.
Pubblicazione: (2026)
di: Zhang, Dingkun, et al.
Pubblicazione: (2026)
Soft Label Pruning and Quantization for Large-Scale Dataset Distillation
di: Lingao, Xiao, et al.
Pubblicazione: (2026)
di: Lingao, Xiao, et al.
Pubblicazione: (2026)
EPSD: Early Pruning with Self-Distillation for Efficient Model Compression
di: Chen, Dong, et al.
Pubblicazione: (2024)
di: Chen, Dong, et al.
Pubblicazione: (2024)
Efficient Pruning of Text-to-Image Models: Insights from Pruning Stable Diffusion
di: Ramesh, Samarth N, et al.
Pubblicazione: (2024)
di: Ramesh, Samarth N, et al.
Pubblicazione: (2024)
EvoPrune: Early-Stage Visual Token Pruning for Efficient MLLMs
di: Chen, Yuhao, et al.
Pubblicazione: (2026)
di: Chen, Yuhao, et al.
Pubblicazione: (2026)
Efficient CNNs via Passive Filter Pruning
di: Singh, Arshdeep, et al.
Pubblicazione: (2023)
di: Singh, Arshdeep, et al.
Pubblicazione: (2023)
DivDiff: A Conditional Diffusion Model for Diverse Human Motion Prediction
di: Yu, Hua, et al.
Pubblicazione: (2024)
di: Yu, Hua, et al.
Pubblicazione: (2024)
MDP: Multidimensional Vision Model Pruning with Latency Constraint
di: Sun, Xinglong, et al.
Pubblicazione: (2025)
di: Sun, Xinglong, et al.
Pubblicazione: (2025)
When Large Vision-Language Model Meets Large Remote Sensing Imagery: Coarse-to-Fine Text-Guided Token Pruning
di: Luo, Junwei, et al.
Pubblicazione: (2025)
di: Luo, Junwei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
di: Li, Ao, et al.
Pubblicazione: (2025) -
IDPruner: Harmonizing Importance and Diversity in Visual Token Pruning for MLLMs
di: Tan, Yifan, et al.
Pubblicazione: (2026) -
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026) -
How Many Visual Tokens Do Multimodal Language Models Need? Scaling Visual Token Pruning with F^3A
di: Huang, YiJie, et al.
Pubblicazione: (2026) -
Exploring Token Pruning in Vision State Space Models
di: Zhan, Zheng, et al.
Pubblicazione: (2024)