Reinforcement Learning-based Token Pruning in Vision Transformers: A Markov Game Approach
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Chenglong, Liang, Shen, Wang, Xuewei, Wang, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PPT: Token Pruning and Pooling for Efficient Vision Transformers
par: Wu, Xinjian, et autres
Publié: (2023)
par: Wu, Xinjian, et autres
Publié: (2023)
Rényi Entropy: A New Token Pruning Metric for Vision Transformers
par: Su, Wei-Yuan, et autres
Publié: (2026)
par: Su, Wei-Yuan, et autres
Publié: (2026)
Adaptive MLP Pruning for Large Vision Transformers
par: Shen, Chengchao
Publié: (2026)
par: Shen, Chengchao
Publié: (2026)
MADTP: Multimodal Alignment-Guided Dynamic Token Pruning for Accelerating Vision-Language Transformer
par: Cao, Jianjian, et autres
Publié: (2024)
par: Cao, Jianjian, et autres
Publié: (2024)
GTPT: Group-based Token Pruning Transformer for Efficient Human Pose Estimation
par: Wang, Haonan, et autres
Publié: (2024)
par: Wang, Haonan, et autres
Publié: (2024)
LearnPruner: Rethinking Attention-based Token Pruning in Vision Language Models
par: Takezoe, Rinyoichi, et autres
Publié: (2026)
par: Takezoe, Rinyoichi, et autres
Publié: (2026)
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
par: Liu, Jizhihui, et autres
Publié: (2025)
par: Liu, Jizhihui, et autres
Publié: (2025)
Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models
par: Ma, Kexin, et autres
Publié: (2026)
par: Ma, Kexin, et autres
Publié: (2026)
TP-Spikformer: Token Pruned Spiking Transformer
par: Wei, Wenjie, et autres
Publié: (2026)
par: Wei, Wenjie, et autres
Publié: (2026)
Attention Debiasing for Token Pruning in Vision Language Models
par: Zhao, Kai, et autres
Publié: (2025)
par: Zhao, Kai, et autres
Publié: (2025)
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
par: Sun, Dengdi, et autres
Publié: (2024)
par: Sun, Dengdi, et autres
Publié: (2024)
Block-based Symmetric Pruning and Fusion for Efficient Vision Transformers
par: Hsieh, Yi-Kuan, et autres
Publié: (2025)
par: Hsieh, Yi-Kuan, et autres
Publié: (2025)
HEART-VIT: Hessian-Guided Efficient Dynamic Attention and Token Pruning in Vision Transformer
par: Uddin, Mohammad Helal, et autres
Publié: (2025)
par: Uddin, Mohammad Helal, et autres
Publié: (2025)
Object-Centric Vision Token Pruning for Vision Language Models
par: Li, Guangyuan, et autres
Publié: (2025)
par: Li, Guangyuan, et autres
Publié: (2025)
Token Pruning for In-Context Generation in Diffusion Transformers
par: Lin, Junqing, et autres
Publié: (2026)
par: Lin, Junqing, et autres
Publié: (2026)
Feather the Throttle: Revisiting Visual Token Pruning for Vision-Language Model Acceleration
par: Endo, Mark, et autres
Publié: (2024)
par: Endo, Mark, et autres
Publié: (2024)
IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning
par: Sun, Zhichao, et autres
Publié: (2026)
par: Sun, Zhichao, et autres
Publié: (2026)
PaceVGGT: Pre-Alternating-Attention Token Pruning for Visual Geometry Transformers
par: Li, Haotang, et autres
Publié: (2026)
par: Li, Haotang, et autres
Publié: (2026)
Exploring Token Pruning in Vision State Space Models
par: Zhan, Zheng, et autres
Publié: (2024)
par: Zhan, Zheng, et autres
Publié: (2024)
Token Pruning using a Lightweight Background Aware Vision Transformer
par: Sah, Sudhakar, et autres
Publié: (2024)
par: Sah, Sudhakar, et autres
Publié: (2024)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
par: Luan, Bozhi, et autres
Publié: (2025)
par: Luan, Bozhi, et autres
Publié: (2025)
Fast SAM2 with Text-Driven Token Pruning
par: Mandal, Avilasha, et autres
Publié: (2025)
par: Mandal, Avilasha, et autres
Publié: (2025)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
par: Li, Ao, et autres
Publié: (2025)
par: Li, Ao, et autres
Publié: (2025)
Language-Guided Token Compression with Reinforcement Learning in Large Vision-Language Models
par: Cao, Sihan, et autres
Publié: (2026)
par: Cao, Sihan, et autres
Publié: (2026)
GreedyPrune: Retenting Critical Visual Token Set for Large Vision Language Models
par: Pei, Ruiguang, et autres
Publié: (2025)
par: Pei, Ruiguang, et autres
Publié: (2025)
A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models
par: Zeng, Quan-Sheng, et autres
Publié: (2025)
par: Zeng, Quan-Sheng, et autres
Publié: (2025)
METEOR: Multi-Encoder Collaborative Token Pruning for Efficient Vision Language Models
par: Liu, Yuchen, et autres
Publié: (2025)
par: Liu, Yuchen, et autres
Publié: (2025)
Pyramid Token Pruning for High-Resolution Large Vision-Language Models via Region, Token, and Instruction-Guided Importance
par: Liang, Yuxuan, et autres
Publié: (2025)
par: Liang, Yuxuan, et autres
Publié: (2025)
VLA-IAP: Training-Free Visual Token Pruning via Interaction Alignment for Vision-Language-Action Models
par: Cheng, Jintao, et autres
Publié: (2026)
par: Cheng, Jintao, et autres
Publié: (2026)
DORA: Dynamic Online Reinforcement Agent for Token Merging in Vision Transformers
par: He, Kaixuan, et autres
Publié: (2026)
par: He, Kaixuan, et autres
Publié: (2026)
Towards Joint Quantization and Token Pruning of Vision-Language Models
par: Li, Xinqing, et autres
Publié: (2026)
par: Li, Xinqing, et autres
Publié: (2026)
EfficientLLaVA:Generalizable Auto-Pruning for Large Vision-language Models
par: Liang, Yinan, et autres
Publié: (2025)
par: Liang, Yinan, et autres
Publié: (2025)
ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving
par: Sha, Lin, et autres
Publié: (2026)
par: Sha, Lin, et autres
Publié: (2026)
Pruning One More Token is Enough: Leveraging Latency-Workload Non-Linearities for Vision Transformers on the Edge
par: Eliopoulos, Nick John, et autres
Publié: (2024)
par: Eliopoulos, Nick John, et autres
Publié: (2024)
Prune Redundancy, Preserve Essence: Vision Token Compression in VLMs via Synergistic Importance-Diversity
par: Fang, Zhengyao, et autres
Publié: (2026)
par: Fang, Zhengyao, et autres
Publié: (2026)
SAFE-Pruner: Semantic Attention-Guided Future-Aware Token Pruning for Efficient Vision-Language-Action Manipulation
par: Ma, Shilin, et autres
Publié: (2026)
par: Ma, Shilin, et autres
Publié: (2026)
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
par: Wang, Xinhao, et autres
Publié: (2026)
par: Wang, Xinhao, et autres
Publié: (2026)
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
par: Chen, Hanning, et autres
Publié: (2024)
par: Chen, Hanning, et autres
Publié: (2024)
CATP: Contextually Adaptive Token Pruning for Efficient and Enhanced Multimodal In-Context Learning
par: Li, Yanshu, et autres
Publié: (2025)
par: Li, Yanshu, et autres
Publié: (2025)
RedVTP: Training-Free Acceleration of Diffusion Vision-Language Models Inference via Masked Token-Guided Visual Token Pruning
par: Xu, Jingqi, et autres
Publié: (2025)
par: Xu, Jingqi, et autres
Publié: (2025)
Documents similaires
-
PPT: Token Pruning and Pooling for Efficient Vision Transformers
par: Wu, Xinjian, et autres
Publié: (2023) -
Rényi Entropy: A New Token Pruning Metric for Vision Transformers
par: Su, Wei-Yuan, et autres
Publié: (2026) -
Adaptive MLP Pruning for Large Vision Transformers
par: Shen, Chengchao
Publié: (2026) -
MADTP: Multimodal Alignment-Guided Dynamic Token Pruning for Accelerating Vision-Language Transformer
par: Cao, Jianjian, et autres
Publié: (2024) -
GTPT: Group-based Token Pruning Transformer for Efficient Human Pose Estimation
par: Wang, Haonan, et autres
Publié: (2024)