PACT: Pruning and Clustering-Based Token Reduction for Faster Visual Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Dhouib, Mohamed, Buscaldi, Davide, Vanier, Sonia, Shabou, Aymen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Leveraging Contrastive Learning for a Similarity-Guided Tampered Document Data Generation Pipeline
di: Dhouib, Mohamed, et al.
Pubblicazione: (2026)
di: Dhouib, Mohamed, et al.
Pubblicazione: (2026)
Predicting memorization within Large Language Models fine-tuned for classification
di: Dentan, Jérémie, et al.
Pubblicazione: (2024)
di: Dentan, Jérémie, et al.
Pubblicazione: (2024)
MUCH: A Multilingual Claim Hallucination Benchmark
di: Dentan, Jérémie, et al.
Pubblicazione: (2025)
di: Dentan, Jérémie, et al.
Pubblicazione: (2025)
Similarity-Aware Token Pruning: Your VLM but Faster
di: Jeddi, Ahmadreza, et al.
Pubblicazione: (2025)
di: Jeddi, Ahmadreza, et al.
Pubblicazione: (2025)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
di: Wang, Yahong, et al.
Pubblicazione: (2026)
di: Wang, Yahong, et al.
Pubblicazione: (2026)
CAT Pruning: Cluster-Aware Token Pruning For Text-to-Image Diffusion Models
di: Cheng, Xinle, et al.
Pubblicazione: (2025)
di: Cheng, Xinle, et al.
Pubblicazione: (2025)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
di: Luan, Bozhi, et al.
Pubblicazione: (2025)
di: Luan, Bozhi, et al.
Pubblicazione: (2025)
Feather the Throttle: Revisiting Visual Token Pruning for Vision-Language Model Acceleration
di: Endo, Mark, et al.
Pubblicazione: (2024)
di: Endo, Mark, et al.
Pubblicazione: (2024)
Geometry-Guided 3D Visual Token Pruning for Video-Language Models
di: Li, Han, et al.
Pubblicazione: (2026)
di: Li, Han, et al.
Pubblicazione: (2026)
Efficient Video Sampling: Pruning Temporally Redundant Tokens for Faster VLM Inference
di: Bagrov, Natan, et al.
Pubblicazione: (2025)
di: Bagrov, Natan, et al.
Pubblicazione: (2025)
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
di: Zhang, Hao, et al.
Pubblicazione: (2025)
di: Zhang, Hao, et al.
Pubblicazione: (2025)
A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models
di: Zeng, Quan-Sheng, et al.
Pubblicazione: (2025)
di: Zeng, Quan-Sheng, et al.
Pubblicazione: (2025)
GreedyPrune: Retenting Critical Visual Token Set for Large Vision Language Models
di: Pei, Ruiguang, et al.
Pubblicazione: (2025)
di: Pei, Ruiguang, et al.
Pubblicazione: (2025)
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
di: Liu, Jizhihui, et al.
Pubblicazione: (2025)
di: Liu, Jizhihui, et al.
Pubblicazione: (2025)
Faster or Stronger: Towards Flexible Visual Place Recognition via Weighted Aggregation and Token Pruning
di: Zeng, Zichao, et al.
Pubblicazione: (2026)
di: Zeng, Zichao, et al.
Pubblicazione: (2026)
ORCA: Orchestrated Reasoning with Collaborative Agents for Document Visual Question Answering
di: Lassoued, Aymen, et al.
Pubblicazione: (2026)
di: Lassoued, Aymen, et al.
Pubblicazione: (2026)
Attention Debiasing for Token Pruning in Vision Language Models
di: Zhao, Kai, et al.
Pubblicazione: (2025)
di: Zhao, Kai, et al.
Pubblicazione: (2025)
Fit and Prune: Fast and Training-free Visual Token Pruning for Multi-modal Large Language Models
di: Ye, Weihao, et al.
Pubblicazione: (2024)
di: Ye, Weihao, et al.
Pubblicazione: (2024)
IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning
di: Sun, Zhichao, et al.
Pubblicazione: (2026)
di: Sun, Zhichao, et al.
Pubblicazione: (2026)
HAWK: Head Importance-Aware Visual Token Pruning in Multimodal Models
di: Zhu, Qihui, et al.
Pubblicazione: (2026)
di: Zhu, Qihui, et al.
Pubblicazione: (2026)
Faster Parameter-Efficient Tuning with Token Redundancy Reduction
di: Kim, Kwonyoung, et al.
Pubblicazione: (2025)
di: Kim, Kwonyoung, et al.
Pubblicazione: (2025)
CROP: Contextual Region-Oriented Visual Token Pruning
di: Guo, Jiawei, et al.
Pubblicazione: (2025)
di: Guo, Jiawei, et al.
Pubblicazione: (2025)
RedVTP: Training-Free Acceleration of Diffusion Vision-Language Models Inference via Masked Token-Guided Visual Token Pruning
di: Xu, Jingqi, et al.
Pubblicazione: (2025)
di: Xu, Jingqi, et al.
Pubblicazione: (2025)
Energy-Driven Adaptive Visual Token Pruning for Efficient Vision-Language Models
di: He, Jialuo, et al.
Pubblicazione: (2026)
di: He, Jialuo, et al.
Pubblicazione: (2026)
TrimTokenator-LC: Towards Adaptive Visual Token Pruning for Large Multimodal Models with Long Contexts
di: Zhang, Hao, et al.
Pubblicazione: (2025)
di: Zhang, Hao, et al.
Pubblicazione: (2025)
Towards Joint Quantization and Token Pruning of Vision-Language Models
di: Li, Xinqing, et al.
Pubblicazione: (2026)
di: Li, Xinqing, et al.
Pubblicazione: (2026)
GridPrune: From "Where to Look" to "What to Select" in Visual Token Pruning for MLLMs
di: Duan, Yuxiang, et al.
Pubblicazione: (2025)
di: Duan, Yuxiang, et al.
Pubblicazione: (2025)
FastVAR: Linear Visual Autoregressive Modeling via Cached Token Pruning
di: Guo, Hang, et al.
Pubblicazione: (2025)
di: Guo, Hang, et al.
Pubblicazione: (2025)
VLA-IAP: Training-Free Visual Token Pruning via Interaction Alignment for Vision-Language-Action Models
di: Cheng, Jintao, et al.
Pubblicazione: (2026)
di: Cheng, Jintao, et al.
Pubblicazione: (2026)
How Many Visual Tokens Do Multimodal Language Models Need? Scaling Visual Token Pruning with F^3A
di: Huang, YiJie, et al.
Pubblicazione: (2026)
di: Huang, YiJie, et al.
Pubblicazione: (2026)
Variation-aware Vision Token Dropping for Faster Large Vision-Language Models
di: Chen, Junjie, et al.
Pubblicazione: (2025)
di: Chen, Junjie, et al.
Pubblicazione: (2025)
When Token Pruning is Worse than Random: Understanding Visual Token Information in VLLMs
di: Wang, Yahong, et al.
Pubblicazione: (2025)
di: Wang, Yahong, et al.
Pubblicazione: (2025)
ToDRE: Effective Visual Token Pruning via Token Diversity and Task Relevance
di: Li, Duo, et al.
Pubblicazione: (2025)
di: Li, Duo, et al.
Pubblicazione: (2025)
ERASE: Eliminating Redundant Visual Tokens via Adaptive Two-Stage Token Pruning
di: Lee, Yuna, et al.
Pubblicazione: (2026)
di: Lee, Yuna, et al.
Pubblicazione: (2026)
VScan: Rethinking Visual Token Reduction for Efficient Large Vision-Language Models
di: Zhang, Ce, et al.
Pubblicazione: (2025)
di: Zhang, Ce, et al.
Pubblicazione: (2025)
Evading Visual Aphasia: Contrastive Adaptive Semantic Token Pruning for Vision-Language Models
di: Ma, Jie, et al.
Pubblicazione: (2026)
di: Ma, Jie, et al.
Pubblicazione: (2026)
PixelPrune: Pixel-Level Adaptive Visual Token Reduction via Predictive Coding
di: Wang, Nan, et al.
Pubblicazione: (2026)
di: Wang, Nan, et al.
Pubblicazione: (2026)
TAMP: Token-Adaptive Layerwise Pruning in Multimodal Large Language Models
di: Lee, Jaewoo, et al.
Pubblicazione: (2025)
di: Lee, Jaewoo, et al.
Pubblicazione: (2025)
ZOO-Prune: Training-Free Token Pruning via Zeroth-Order Gradient Estimation in Vision-Language Models
di: Kim, Youngeun, et al.
Pubblicazione: (2025)
di: Kim, Youngeun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Leveraging Contrastive Learning for a Similarity-Guided Tampered Document Data Generation Pipeline
di: Dhouib, Mohamed, et al.
Pubblicazione: (2026) -
Predicting memorization within Large Language Models fine-tuned for classification
di: Dentan, Jérémie, et al.
Pubblicazione: (2024) -
MUCH: A Multilingual Claim Hallucination Benchmark
di: Dentan, Jérémie, et al.
Pubblicazione: (2025) -
Similarity-Aware Token Pruning: Your VLM but Faster
di: Jeddi, Ahmadreza, et al.
Pubblicazione: (2025) -
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)