AgilePruner: An Empirical Study of Attention and Diversity for Adaptive Visual Token Pruning in Large Vision-Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Baek, Changwoo, Song, Jouwon, Kim, Sohyeon, Kong, Kyeongbo |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Focus Matters: Phase-Aware Suppression for Hallucination in Vision-Language Models
von: Kim, Sohyeon, et al.
Veröffentlicht: (2026)
von: Kim, Sohyeon, et al.
Veröffentlicht: (2026)
LearnPruner: Rethinking Attention-based Token Pruning in Vision Language Models
von: Takezoe, Rinyoichi, et al.
Veröffentlicht: (2026)
von: Takezoe, Rinyoichi, et al.
Veröffentlicht: (2026)
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
von: Lee, Dong-Jae, et al.
Veröffentlicht: (2026)
von: Lee, Dong-Jae, et al.
Veröffentlicht: (2026)
SAFE-Pruner: Semantic Attention-Guided Future-Aware Token Pruning for Efficient Vision-Language-Action Manipulation
von: Ma, Shilin, et al.
Veröffentlicht: (2026)
von: Ma, Shilin, et al.
Veröffentlicht: (2026)
D2Pruner: Debiased Importance and Structural Diversity for MLLM Token Pruning
von: Zhang, Evelyn, et al.
Veröffentlicht: (2025)
von: Zhang, Evelyn, et al.
Veröffentlicht: (2025)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
von: Luan, Bozhi, et al.
Veröffentlicht: (2025)
von: Luan, Bozhi, et al.
Veröffentlicht: (2025)
Attention Debiasing for Token Pruning in Vision Language Models
von: Zhao, Kai, et al.
Veröffentlicht: (2025)
von: Zhao, Kai, et al.
Veröffentlicht: (2025)
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
von: Liu, Jizhihui, et al.
Veröffentlicht: (2025)
von: Liu, Jizhihui, et al.
Veröffentlicht: (2025)
ATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models
von: Ye, Xubing, et al.
Veröffentlicht: (2024)
von: Ye, Xubing, et al.
Veröffentlicht: (2024)
MedPruner: Training-Free Hierarchical Token Pruning for Efficient 3D Medical Image Understanding in Vision-Language Models
von: Liu, Shengyuan, et al.
Veröffentlicht: (2026)
von: Liu, Shengyuan, et al.
Veröffentlicht: (2026)
Energy-Driven Adaptive Visual Token Pruning for Efficient Vision-Language Models
von: He, Jialuo, et al.
Veröffentlicht: (2026)
von: He, Jialuo, et al.
Veröffentlicht: (2026)
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models
von: Zeng, Quan-Sheng, et al.
Veröffentlicht: (2025)
von: Zeng, Quan-Sheng, et al.
Veröffentlicht: (2025)
GreedyPrune: Retenting Critical Visual Token Set for Large Vision Language Models
von: Pei, Ruiguang, et al.
Veröffentlicht: (2025)
von: Pei, Ruiguang, et al.
Veröffentlicht: (2025)
Evading Visual Aphasia: Contrastive Adaptive Semantic Token Pruning for Vision-Language Models
von: Ma, Jie, et al.
Veröffentlicht: (2026)
von: Ma, Jie, et al.
Veröffentlicht: (2026)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
von: Huang, Xiaohu, et al.
Veröffentlicht: (2024)
von: Huang, Xiaohu, et al.
Veröffentlicht: (2024)
DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models
von: Alvar, Saeed Ranjbar, et al.
Veröffentlicht: (2025)
von: Alvar, Saeed Ranjbar, et al.
Veröffentlicht: (2025)
Programmable-Room: Interactive Textured 3D Room Meshes Generation Empowered by Large Language Models
von: Kim, Jihyun, et al.
Veröffentlicht: (2025)
von: Kim, Jihyun, et al.
Veröffentlicht: (2025)
Efficient Vision-Language Reasoning via Adaptive Token Pruning
von: Li, Xue, et al.
Veröffentlicht: (2025)
von: Li, Xue, et al.
Veröffentlicht: (2025)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
von: Li, Ao, et al.
Veröffentlicht: (2025)
von: Li, Ao, et al.
Veröffentlicht: (2025)
MI-Pruner: Crossmodal Mutual Information-guided Token Pruner for Efficient MLLMs
von: Li, Jiameng, et al.
Veröffentlicht: (2026)
von: Li, Jiameng, et al.
Veröffentlicht: (2026)
Feather the Throttle: Revisiting Visual Token Pruning for Vision-Language Model Acceleration
von: Endo, Mark, et al.
Veröffentlicht: (2024)
von: Endo, Mark, et al.
Veröffentlicht: (2024)
TAMP: Token-Adaptive Layerwise Pruning in Multimodal Large Language Models
von: Lee, Jaewoo, et al.
Veröffentlicht: (2025)
von: Lee, Jaewoo, et al.
Veröffentlicht: (2025)
VLM-Pruner: Buffering for Spatial Sparsity in an Efficient VLM Centrifugal Token Pruning Paradigm
von: Wu, Zhenkai, et al.
Veröffentlicht: (2025)
von: Wu, Zhenkai, et al.
Veröffentlicht: (2025)
ERASE: Eliminating Redundant Visual Tokens via Adaptive Two-Stage Token Pruning
von: Lee, Yuna, et al.
Veröffentlicht: (2026)
von: Lee, Yuna, et al.
Veröffentlicht: (2026)
LD-Pruner: Efficient Pruning of Latent Diffusion Models using Task-Agnostic Insights
von: Castells, Thibault, et al.
Veröffentlicht: (2024)
von: Castells, Thibault, et al.
Veröffentlicht: (2024)
Does Visual Token Pruning Improve Calibration? An Empirical Study on Confidence in MLLMs
von: Tan, Kaizhen
Veröffentlicht: (2026)
von: Tan, Kaizhen
Veröffentlicht: (2026)
RCP: Representation Consistency Pruner for Mitigating Distribution Shift in Large Vision-Language Models
von: Zhang, Jianwei, et al.
Veröffentlicht: (2026)
von: Zhang, Jianwei, et al.
Veröffentlicht: (2026)
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
von: Wang, Yahong, et al.
Veröffentlicht: (2026)
von: Wang, Yahong, et al.
Veröffentlicht: (2026)
TrimTokenator-LC: Towards Adaptive Visual Token Pruning for Large Multimodal Models with Long Contexts
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
Beyond Attention Scores: SVD-Based Vision Token Pruning for Efficient Vision-Language Models
von: Apedo, Yvon, et al.
Veröffentlicht: (2026)
von: Apedo, Yvon, et al.
Veröffentlicht: (2026)
Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models
von: Ma, Kexin, et al.
Veröffentlicht: (2026)
von: Ma, Kexin, et al.
Veröffentlicht: (2026)
AttentionHand: Text-driven Controllable Hand Image Generation for 3D Hand Reconstruction in the Wild
von: Park, Junho, et al.
Veröffentlicht: (2024)
von: Park, Junho, et al.
Veröffentlicht: (2024)
VIPA: Visual Informative Part Attention for Referring Image Segmentation
von: Cho, Yubin, et al.
Veröffentlicht: (2026)
von: Cho, Yubin, et al.
Veröffentlicht: (2026)
AdaTP: Attention-Debiased Token Pruning for Video Large Language Models
von: Sun, Fengyuan, et al.
Veröffentlicht: (2025)
von: Sun, Fengyuan, et al.
Veröffentlicht: (2025)
AdaptInfer: Adaptive Token Pruning for Vision-Language Model Inference with Dynamical Text Guidance
von: Zhang, Weichen, et al.
Veröffentlicht: (2025)
von: Zhang, Weichen, et al.
Veröffentlicht: (2025)
IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning
von: Sun, Zhichao, et al.
Veröffentlicht: (2026)
von: Sun, Zhichao, et al.
Veröffentlicht: (2026)
SeGPruner: Semantic-Geometric Visual Token Pruner for 3D Question Answering
von: Li, Wenli, et al.
Veröffentlicht: (2026)
von: Li, Wenli, et al.
Veröffentlicht: (2026)
ZOO-Prune: Training-Free Token Pruning via Zeroth-Order Gradient Estimation in Vision-Language Models
von: Kim, Youngeun, et al.
Veröffentlicht: (2025)
von: Kim, Youngeun, et al.
Veröffentlicht: (2025)
Unveiling the Response of Large Vision-Language Models to Visually Absent Tokens
von: Kim, Sohee, et al.
Veröffentlicht: (2025)
von: Kim, Sohee, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Focus Matters: Phase-Aware Suppression for Hallucination in Vision-Language Models
von: Kim, Sohyeon, et al.
Veröffentlicht: (2026) -
LearnPruner: Rethinking Attention-based Token Pruning in Vision Language Models
von: Takezoe, Rinyoichi, et al.
Veröffentlicht: (2026) -
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
von: Lee, Dong-Jae, et al.
Veröffentlicht: (2026) -
SAFE-Pruner: Semantic Attention-Guided Future-Aware Token Pruning for Efficient Vision-Language-Action Manipulation
von: Ma, Shilin, et al.
Veröffentlicht: (2026) -
D2Pruner: Debiased Importance and Structural Diversity for MLLM Token Pruning
von: Zhang, Evelyn, et al.
Veröffentlicht: (2025)