IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lee, Dong-Jae, Baek, Sunghyun, Kim, Junmo |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
von: Li, Ao, et al.
Veröffentlicht: (2025)
von: Li, Ao, et al.
Veröffentlicht: (2025)
DAM: Domain-Aware Module for Multi-Domain Dataset Condensation
von: Choi, Jaehyun, et al.
Veröffentlicht: (2025)
von: Choi, Jaehyun, et al.
Veröffentlicht: (2025)
Frequency-Aware Token Reduction for Efficient Vision Transformer
von: Lee, Dong-Jae, et al.
Veröffentlicht: (2025)
von: Lee, Dong-Jae, et al.
Veröffentlicht: (2025)
Object-Centric Vision Token Pruning for Vision Language Models
von: Li, Guangyuan, et al.
Veröffentlicht: (2025)
von: Li, Guangyuan, et al.
Veröffentlicht: (2025)
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
von: Wang, Xinhao, et al.
Veröffentlicht: (2026)
von: Wang, Xinhao, et al.
Veröffentlicht: (2026)
ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving
von: Sha, Lin, et al.
Veröffentlicht: (2026)
von: Sha, Lin, et al.
Veröffentlicht: (2026)
PLPHP: Per-Layer Per-Head Vision Token Pruning for Efficient Large Vision-Language Models
von: Meng, Yu, et al.
Veröffentlicht: (2025)
von: Meng, Yu, et al.
Veröffentlicht: (2025)
Rotation-Aligned Key Channel Pruning for Efficient Vision-Language Model Inference
von: Kang, Beomseok, et al.
Veröffentlicht: (2026)
von: Kang, Beomseok, et al.
Veröffentlicht: (2026)
Energy-Driven Adaptive Visual Token Pruning for Efficient Vision-Language Models
von: He, Jialuo, et al.
Veröffentlicht: (2026)
von: He, Jialuo, et al.
Veröffentlicht: (2026)
Balanced Token Pruning: Accelerating Vision Language Models Beyond Local Optimization
von: Li, Kaiyuan, et al.
Veröffentlicht: (2025)
von: Li, Kaiyuan, et al.
Veröffentlicht: (2025)
ZSPAPrune: Zero-Shot Prompt-Aware Token Pruning for Vision-Language Models
von: Zhang, Pu, et al.
Veröffentlicht: (2025)
von: Zhang, Pu, et al.
Veröffentlicht: (2025)
Beyond Attention Scores: SVD-Based Vision Token Pruning for Efficient Vision-Language Models
von: Apedo, Yvon, et al.
Veröffentlicht: (2026)
von: Apedo, Yvon, et al.
Veröffentlicht: (2026)
IMSE: Intrinsic Mixture of Spectral Experts Fine-tuning for Test-Time Adaptation
von: Baek, Sunghyun, et al.
Veröffentlicht: (2026)
von: Baek, Sunghyun, et al.
Veröffentlicht: (2026)
Evading Visual Aphasia: Contrastive Adaptive Semantic Token Pruning for Vision-Language Models
von: Ma, Jie, et al.
Veröffentlicht: (2026)
von: Ma, Jie, et al.
Veröffentlicht: (2026)
AdaTP: Attention-Debiased Token Pruning for Video Large Language Models
von: Sun, Fengyuan, et al.
Veröffentlicht: (2025)
von: Sun, Fengyuan, et al.
Veröffentlicht: (2025)
CLIP Tricks You: Training-free Token Pruning for Efficient Pixel Grounding in Large VIsion-Language Models
von: Lee, Sangin, et al.
Veröffentlicht: (2026)
von: Lee, Sangin, et al.
Veröffentlicht: (2026)
HiPP-Prune: Hierarchical Preference-Conditioned Structured Pruning for Vision-Language Models
von: Bai, Lincen, et al.
Veröffentlicht: (2026)
von: Bai, Lincen, et al.
Veröffentlicht: (2026)
When Large Vision-Language Model Meets Large Remote Sensing Imagery: Coarse-to-Fine Text-Guided Token Pruning
von: Luo, Junwei, et al.
Veröffentlicht: (2025)
von: Luo, Junwei, et al.
Veröffentlicht: (2025)
DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models
von: Alvar, Saeed Ranjbar, et al.
Veröffentlicht: (2025)
von: Alvar, Saeed Ranjbar, et al.
Veröffentlicht: (2025)
FoPru: Focal Pruning for Efficient Large Vision-Language Models
von: Jiang, Lei, et al.
Veröffentlicht: (2024)
von: Jiang, Lei, et al.
Veröffentlicht: (2024)
CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
von: Tang, Zicong, et al.
Veröffentlicht: (2025)
von: Tang, Zicong, et al.
Veröffentlicht: (2025)
Exploring Token Pruning in Vision State Space Models
von: Zhan, Zheng, et al.
Veröffentlicht: (2024)
von: Zhan, Zheng, et al.
Veröffentlicht: (2024)
Index-Preserving Lightweight Token Pruning for Efficient Document Understanding in Vision-Language Models
von: Son, Jaemin, et al.
Veröffentlicht: (2025)
von: Son, Jaemin, et al.
Veröffentlicht: (2025)
AH-OCDA: Amplitude-based Curriculum Learning and Hopfield Segmentation Model for Open Compound Domain Adaptation
von: Choi, Jaehyun, et al.
Veröffentlicht: (2024)
von: Choi, Jaehyun, et al.
Veröffentlicht: (2024)
Token Pruning using a Lightweight Background Aware Vision Transformer
von: Sah, Sudhakar, et al.
Veröffentlicht: (2024)
von: Sah, Sudhakar, et al.
Veröffentlicht: (2024)
EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent
von: Li, Jiaao, et al.
Veröffentlicht: (2025)
von: Li, Jiaao, et al.
Veröffentlicht: (2025)
TopV: Compatible Token Pruning with Inference Time Optimization for Fast and Low-Memory Multimodal Vision Language Model
von: Yang, Cheng, et al.
Veröffentlicht: (2025)
von: Yang, Cheng, et al.
Veröffentlicht: (2025)
Singular Value Scaling: Efficient Generative Model Compression via Pruned Weights Refinement
von: Kim, Hyeonjin, et al.
Veröffentlicht: (2024)
von: Kim, Hyeonjin, et al.
Veröffentlicht: (2024)
PruneHal: Reducing Hallucinations in Multi-modal Large Language Models through Adaptive KV Cache Pruning
von: Sun, Fengyuan, et al.
Veröffentlicht: (2025)
von: Sun, Fengyuan, et al.
Veröffentlicht: (2025)
MedPruner: Training-Free Hierarchical Token Pruning for Efficient 3D Medical Image Understanding in Vision-Language Models
von: Liu, Shengyuan, et al.
Veröffentlicht: (2026)
von: Liu, Shengyuan, et al.
Veröffentlicht: (2026)
VisPCO: Visual Token Pruning Configuration Optimization via Budget-Aware Pareto-Frontier Learning for Vision-Language Models
von: Ji, Huawei, et al.
Veröffentlicht: (2026)
von: Ji, Huawei, et al.
Veröffentlicht: (2026)
Walk and Read Less: Improving the Efficiency of Vision-and-Language Navigation via Tuning-Free Multimodal Token Pruning
von: Qin, Wenda, et al.
Veröffentlicht: (2025)
von: Qin, Wenda, et al.
Veröffentlicht: (2025)
SpecPrune-VLA: Accelerating Vision-Language-Action Models via Action-Aware Self-Speculative Pruning
von: Wang, Hanzhen, et al.
Veröffentlicht: (2025)
von: Wang, Hanzhen, et al.
Veröffentlicht: (2025)
MoPE-CLIP: Structured Pruning for Efficient Vision-Language Models with Module-wise Pruning Error Metric
von: Lin, Haokun, et al.
Veröffentlicht: (2024)
von: Lin, Haokun, et al.
Veröffentlicht: (2024)
Grounding-Aware Token Pruning: Recovering from Drastic Performance Drops in Visual Grounding Caused by Pruning
von: Chien, Tzu-Chun, et al.
Veröffentlicht: (2025)
von: Chien, Tzu-Chun, et al.
Veröffentlicht: (2025)
Isomorphic Pruning for Vision Models
von: Fang, Gongfan, et al.
Veröffentlicht: (2024)
von: Fang, Gongfan, et al.
Veröffentlicht: (2024)
GRIP-VLM: Group-Relative Importance Pruning for Efficient Vision-Language Models
von: Huang, Mingzhe, et al.
Veröffentlicht: (2026)
von: Huang, Mingzhe, et al.
Veröffentlicht: (2026)
ForestPrune: High-ratio Visual Token Compression for Video Multimodal Large Language Models via Spatial-Temporal Forest Modeling
von: Ju, Shaobo, et al.
Veröffentlicht: (2026)
von: Ju, Shaobo, et al.
Veröffentlicht: (2026)
Training-Free Restoration of Pruned Neural Networks
von: Lee, Keonho, et al.
Veröffentlicht: (2025)
von: Lee, Keonho, et al.
Veröffentlicht: (2025)
TokenTrim: Inference-Time Token Pruning for Autoregressive Long Video Generation
von: Shaulov, Ariel, et al.
Veröffentlicht: (2026)
von: Shaulov, Ariel, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
von: Li, Ao, et al.
Veröffentlicht: (2025) -
DAM: Domain-Aware Module for Multi-Domain Dataset Condensation
von: Choi, Jaehyun, et al.
Veröffentlicht: (2025) -
Frequency-Aware Token Reduction for Efficient Vision Transformer
von: Lee, Dong-Jae, et al.
Veröffentlicht: (2025) -
Object-Centric Vision Token Pruning for Vision Language Models
von: Li, Guangyuan, et al.
Veröffentlicht: (2025) -
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
von: Wang, Xinhao, et al.
Veröffentlicht: (2026)