DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Alvar, Saeed Ranjbar, Singh, Gursimran, Akbari, Mohammad, Zhang, Yong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
par: Li, Ao, et autres
Publié: (2025)
par: Li, Ao, et autres
Publié: (2025)
IDPruner: Harmonizing Importance and Diversity in Visual Token Pruning for MLLMs
par: Tan, Yifan, et autres
Publié: (2026)
par: Tan, Yifan, et autres
Publié: (2026)
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
par: Lee, Dong-Jae, et autres
Publié: (2026)
par: Lee, Dong-Jae, et autres
Publié: (2026)
How Many Visual Tokens Do Multimodal Language Models Need? Scaling Visual Token Pruning with F^3A
par: Huang, YiJie, et autres
Publié: (2026)
par: Huang, YiJie, et autres
Publié: (2026)
Exploring Token Pruning in Vision State Space Models
par: Zhan, Zheng, et autres
Publié: (2024)
par: Zhan, Zheng, et autres
Publié: (2024)
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
par: Wang, Xinhao, et autres
Publié: (2026)
par: Wang, Xinhao, et autres
Publié: (2026)
EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent
par: Li, Jiaao, et autres
Publié: (2025)
par: Li, Jiaao, et autres
Publié: (2025)
Beyond Attention or Similarity: Maximizing Conditional Diversity for Token Pruning in MLLMs
par: Zhang, Qizhe, et autres
Publié: (2025)
par: Zhang, Qizhe, et autres
Publié: (2025)
ForestPrune: High-ratio Visual Token Compression for Video Multimodal Large Language Models via Spatial-Temporal Forest Modeling
par: Ju, Shaobo, et autres
Publié: (2026)
par: Ju, Shaobo, et autres
Publié: (2026)
Pruning By Explaining Revisited: Optimizing Attribution Methods to Prune CNNs and Transformers
par: Hatefi, Sayed Mohammad Vakilzadeh, et autres
Publié: (2024)
par: Hatefi, Sayed Mohammad Vakilzadeh, et autres
Publié: (2024)
Grounding-Aware Token Pruning: Recovering from Drastic Performance Drops in Visual Grounding Caused by Pruning
par: Chien, Tzu-Chun, et autres
Publié: (2025)
par: Chien, Tzu-Chun, et autres
Publié: (2025)
Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs
par: Zhang, Qizhe, et autres
Publié: (2024)
par: Zhang, Qizhe, et autres
Publié: (2024)
PLPHP: Per-Layer Per-Head Vision Token Pruning for Efficient Large Vision-Language Models
par: Meng, Yu, et autres
Publié: (2025)
par: Meng, Yu, et autres
Publié: (2025)
ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving
par: Sha, Lin, et autres
Publié: (2026)
par: Sha, Lin, et autres
Publié: (2026)
Energy-Driven Adaptive Visual Token Pruning for Efficient Vision-Language Models
par: He, Jialuo, et autres
Publié: (2026)
par: He, Jialuo, et autres
Publié: (2026)
ConceptPrune: Concept Editing in Diffusion Models via Skilled Neuron Pruning
par: Chavhan, Ruchika, et autres
Publié: (2024)
par: Chavhan, Ruchika, et autres
Publié: (2024)
Isomorphic Pruning for Vision Models
par: Fang, Gongfan, et autres
Publié: (2024)
par: Fang, Gongfan, et autres
Publié: (2024)
Balanced Token Pruning: Accelerating Vision Language Models Beyond Local Optimization
par: Li, Kaiyuan, et autres
Publié: (2025)
par: Li, Kaiyuan, et autres
Publié: (2025)
AdaTP: Attention-Debiased Token Pruning for Video Large Language Models
par: Sun, Fengyuan, et autres
Publié: (2025)
par: Sun, Fengyuan, et autres
Publié: (2025)
QuarterMap: Efficient Post-Training Token Pruning for Visual State Space Models
par: Chi, Tien-Yu, et autres
Publié: (2025)
par: Chi, Tien-Yu, et autres
Publié: (2025)
Evading Visual Aphasia: Contrastive Adaptive Semantic Token Pruning for Vision-Language Models
par: Ma, Jie, et autres
Publié: (2026)
par: Ma, Jie, et autres
Publié: (2026)
What Kind of Visual Tokens Do We Need? Training-free Visual Token Pruning for Multi-modal Large Language Models from the Perspective of Graph
par: Jiang, Yutao, et autres
Publié: (2025)
par: Jiang, Yutao, et autres
Publié: (2025)
Meta Pruning via Graph Metanetworks : A Universal Meta Learning Framework for Network Pruning
par: Liu, Yewei, et autres
Publié: (2025)
par: Liu, Yewei, et autres
Publié: (2025)
LaWa: Using Latent Space for In-Generation Image Watermarking
par: Rezaei, Ahmad, et autres
Publié: (2024)
par: Rezaei, Ahmad, et autres
Publié: (2024)
StreamingAssistant: Efficient Visual Token Pruning for Accelerating Online Video Understanding
par: Jin, Xinqi, et autres
Publié: (2025)
par: Jin, Xinqi, et autres
Publié: (2025)
Bridging the Semantic-Action Gap in Visual Token Pruning for Efficient VLA Inference
par: Liu, Ziyan, et autres
Publié: (2025)
par: Liu, Ziyan, et autres
Publié: (2025)
CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
par: Tang, Zicong, et autres
Publié: (2025)
par: Tang, Zicong, et autres
Publié: (2025)
Multi-Dimensional Pruning: Joint Channel, Layer and Block Pruning with Latency Constraint
par: Sun, Xinglong, et autres
Publié: (2024)
par: Sun, Xinglong, et autres
Publié: (2024)
Object-Centric Vision Token Pruning for Vision Language Models
par: Li, Guangyuan, et autres
Publié: (2025)
par: Li, Guangyuan, et autres
Publié: (2025)
EVTP-IVS: Effective Visual Token Pruning For Unifying Instruction Visual Segmentation In Multi-Modal Large Language Models
par: Zhu, Wenhui, et autres
Publié: (2025)
par: Zhu, Wenhui, et autres
Publié: (2025)
ZSPAPrune: Zero-Shot Prompt-Aware Token Pruning for Vision-Language Models
par: Zhang, Pu, et autres
Publié: (2025)
par: Zhang, Pu, et autres
Publié: (2025)
Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning
par: Zhang, Dingkun, et autres
Publié: (2026)
par: Zhang, Dingkun, et autres
Publié: (2026)
Soft Label Pruning and Quantization for Large-Scale Dataset Distillation
par: Lingao, Xiao, et autres
Publié: (2026)
par: Lingao, Xiao, et autres
Publié: (2026)
EPSD: Early Pruning with Self-Distillation for Efficient Model Compression
par: Chen, Dong, et autres
Publié: (2024)
par: Chen, Dong, et autres
Publié: (2024)
Efficient Pruning of Text-to-Image Models: Insights from Pruning Stable Diffusion
par: Ramesh, Samarth N, et autres
Publié: (2024)
par: Ramesh, Samarth N, et autres
Publié: (2024)
EvoPrune: Early-Stage Visual Token Pruning for Efficient MLLMs
par: Chen, Yuhao, et autres
Publié: (2026)
par: Chen, Yuhao, et autres
Publié: (2026)
Efficient CNNs via Passive Filter Pruning
par: Singh, Arshdeep, et autres
Publié: (2023)
par: Singh, Arshdeep, et autres
Publié: (2023)
DivDiff: A Conditional Diffusion Model for Diverse Human Motion Prediction
par: Yu, Hua, et autres
Publié: (2024)
par: Yu, Hua, et autres
Publié: (2024)
MDP: Multidimensional Vision Model Pruning with Latency Constraint
par: Sun, Xinglong, et autres
Publié: (2025)
par: Sun, Xinglong, et autres
Publié: (2025)
When Large Vision-Language Model Meets Large Remote Sensing Imagery: Coarse-to-Fine Text-Guided Token Pruning
par: Luo, Junwei, et autres
Publié: (2025)
par: Luo, Junwei, et autres
Publié: (2025)
Documents similaires
-
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
par: Li, Ao, et autres
Publié: (2025) -
IDPruner: Harmonizing Importance and Diversity in Visual Token Pruning for MLLMs
par: Tan, Yifan, et autres
Publié: (2026) -
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
par: Lee, Dong-Jae, et autres
Publié: (2026) -
How Many Visual Tokens Do Multimodal Language Models Need? Scaling Visual Token Pruning with F^3A
par: Huang, YiJie, et autres
Publié: (2026) -
Exploring Token Pruning in Vision State Space Models
par: Zhan, Zheng, et autres
Publié: (2024)