CROP: Contextual Region-Oriented Visual Token Pruning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guo, Jiawei, Zhai, Feifei, Jian, Pu, Wei, Qianrun, Zhou, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SCOPE: Saliency-Coverage Oriented Token Pruning for Efficient Multimodel LLMs
par: Deng, Jinhong, et autres
Publié: (2025)
par: Deng, Jinhong, et autres
Publié: (2025)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
par: Huang, Xiaohu, et autres
Publié: (2024)
par: Huang, Xiaohu, et autres
Publié: (2024)
HAWK: Head Importance-Aware Visual Token Pruning in Multimodal Models
par: Zhu, Qihui, et autres
Publié: (2026)
par: Zhu, Qihui, et autres
Publié: (2026)
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
par: Chen, Hanning, et autres
Publié: (2024)
par: Chen, Hanning, et autres
Publié: (2024)
CATP: Contextually Adaptive Token Pruning for Efficient and Enhanced Multimodal In-Context Learning
par: Li, Yanshu, et autres
Publié: (2025)
par: Li, Yanshu, et autres
Publié: (2025)
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
par: Wang, Yahong, et autres
Publié: (2026)
par: Wang, Yahong, et autres
Publié: (2026)
When Token Pruning is Worse than Random: Understanding Visual Token Information in VLLMs
par: Wang, Yahong, et autres
Publié: (2025)
par: Wang, Yahong, et autres
Publié: (2025)
IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning
par: Sun, Zhichao, et autres
Publié: (2026)
par: Sun, Zhichao, et autres
Publié: (2026)
Composable Visual Tokenizers with Generator-Free Diagnostics of Learnability
par: Zhao, Bingchen, et autres
Publié: (2026)
par: Zhao, Bingchen, et autres
Publié: (2026)
What Kind of Visual Tokens Do We Need? Training-free Visual Token Pruning for Multi-modal Large Language Models from the Perspective of Graph
par: Jiang, Yutao, et autres
Publié: (2025)
par: Jiang, Yutao, et autres
Publié: (2025)
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
par: Zhang, Hao, et autres
Publié: (2025)
par: Zhang, Hao, et autres
Publié: (2025)
GridPrune: From "Where to Look" to "What to Select" in Visual Token Pruning for MLLMs
par: Duan, Yuxiang, et autres
Publié: (2025)
par: Duan, Yuxiang, et autres
Publié: (2025)
FastVAR: Linear Visual Autoregressive Modeling via Cached Token Pruning
par: Guo, Hang, et autres
Publié: (2025)
par: Guo, Hang, et autres
Publié: (2025)
Back to Fundamentals: Low-Level Visual Features Guided Progressive Token Pruning
par: Ouyang, Yuanbing, et autres
Publié: (2025)
par: Ouyang, Yuanbing, et autres
Publié: (2025)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
par: Luan, Bozhi, et autres
Publié: (2025)
par: Luan, Bozhi, et autres
Publié: (2025)
PaceVGGT: Pre-Alternating-Attention Token Pruning for Visual Geometry Transformers
par: Li, Haotang, et autres
Publié: (2026)
par: Li, Haotang, et autres
Publié: (2026)
TP-Spikformer: Token Pruned Spiking Transformer
par: Wei, Wenjie, et autres
Publié: (2026)
par: Wei, Wenjie, et autres
Publié: (2026)
ToDRE: Effective Visual Token Pruning via Token Diversity and Task Relevance
par: Li, Duo, et autres
Publié: (2025)
par: Li, Duo, et autres
Publié: (2025)
ERASE: Eliminating Redundant Visual Tokens via Adaptive Two-Stage Token Pruning
par: Lee, Yuna, et autres
Publié: (2026)
par: Lee, Yuna, et autres
Publié: (2026)
StreamingAssistant: Efficient Visual Token Pruning for Accelerating Online Video Understanding
par: Jin, Xinqi, et autres
Publié: (2025)
par: Jin, Xinqi, et autres
Publié: (2025)
CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
par: Tang, Zicong, et autres
Publié: (2025)
par: Tang, Zicong, et autres
Publié: (2025)
Fit and Prune: Fast and Training-free Visual Token Pruning for Multi-modal Large Language Models
par: Ye, Weihao, et autres
Publié: (2024)
par: Ye, Weihao, et autres
Publié: (2024)
TAMP: Token-Adaptive Layerwise Pruning in Multimodal Large Language Models
par: Lee, Jaewoo, et autres
Publié: (2025)
par: Lee, Jaewoo, et autres
Publié: (2025)
Focus-Scan-Refine: From Human Visual Perception to Efficient Visual Token Pruning
par: Tong, Enwei, et autres
Publié: (2026)
par: Tong, Enwei, et autres
Publié: (2026)
OTPrune: Distribution-Aligned Visual Token Pruning via Optimal Transport
par: Chen, Xiwen, et autres
Publié: (2026)
par: Chen, Xiwen, et autres
Publié: (2026)
IDPruner: Harmonizing Importance and Diversity in Visual Token Pruning for MLLMs
par: Tan, Yifan, et autres
Publié: (2026)
par: Tan, Yifan, et autres
Publié: (2026)
TrimTokenator-LC: Towards Adaptive Visual Token Pruning for Large Multimodal Models with Long Contexts
par: Zhang, Hao, et autres
Publié: (2025)
par: Zhang, Hao, et autres
Publié: (2025)
Improving Autoregressive Visual Generation with Cluster-Oriented Token Prediction
par: Hu, Teng, et autres
Publié: (2025)
par: Hu, Teng, et autres
Publié: (2025)
UTPTrack: Towards Simple and Unified Token Pruning for Visual Tracking
par: Wu, Hao, et autres
Publié: (2026)
par: Wu, Hao, et autres
Publié: (2026)
Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs
par: Zhang, Qizhe, et autres
Publié: (2024)
par: Zhang, Qizhe, et autres
Publié: (2024)
PACT: Pruning and Clustering-Based Token Reduction for Faster Visual Language Models
par: Dhouib, Mohamed, et autres
Publié: (2025)
par: Dhouib, Mohamed, et autres
Publié: (2025)
Does Visual Token Pruning Improve Calibration? An Empirical Study on Confidence in MLLMs
par: Tan, Kaizhen
Publié: (2026)
par: Tan, Kaizhen
Publié: (2026)
Feather the Throttle: Revisiting Visual Token Pruning for Vision-Language Model Acceleration
par: Endo, Mark, et autres
Publié: (2024)
par: Endo, Mark, et autres
Publié: (2024)
Geometry-Guided 3D Visual Token Pruning for Video-Language Models
par: Li, Han, et autres
Publié: (2026)
par: Li, Han, et autres
Publié: (2026)
Training Noise Token Pruning
par: Rao, Mingxing, et autres
Publié: (2024)
par: Rao, Mingxing, et autres
Publié: (2024)
ReDiPrune: Relevance-Diversity Pre-Projection Token Pruning for Efficient Multimodal LLMs
par: Yu, An, et autres
Publié: (2026)
par: Yu, An, et autres
Publié: (2026)
Pyramid Token Pruning for High-Resolution Large Vision-Language Models via Region, Token, and Instruction-Guided Importance
par: Liang, Yuxuan, et autres
Publié: (2025)
par: Liang, Yuxuan, et autres
Publié: (2025)
ZSPAPrune: Zero-Shot Prompt-Aware Token Pruning for Vision-Language Models
par: Zhang, Pu, et autres
Publié: (2025)
par: Zhang, Pu, et autres
Publié: (2025)
A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models
par: Zeng, Quan-Sheng, et autres
Publié: (2025)
par: Zeng, Quan-Sheng, et autres
Publié: (2025)
GreedyPrune: Retenting Critical Visual Token Set for Large Vision Language Models
par: Pei, Ruiguang, et autres
Publié: (2025)
par: Pei, Ruiguang, et autres
Publié: (2025)
Documents similaires
-
SCOPE: Saliency-Coverage Oriented Token Pruning for Efficient Multimodel LLMs
par: Deng, Jinhong, et autres
Publié: (2025) -
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
par: Huang, Xiaohu, et autres
Publié: (2024) -
HAWK: Head Importance-Aware Visual Token Pruning in Multimodal Models
par: Zhu, Qihui, et autres
Publié: (2026) -
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
par: Chen, Hanning, et autres
Publié: (2024) -
CATP: Contextually Adaptive Token Pruning for Efficient and Enhanced Multimodal In-Context Learning
par: Li, Yanshu, et autres
Publié: (2025)