PPT: Token Pruning and Pooling for Efficient Vision Transformers
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Xinjian, Zeng, Fanhu, Wang, Xiudong, Chen, Xinghao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Token Transforming: A Unified and Training-Free Token Compression Framework for Vision Transformer Acceleration
di: Zeng, Fanhu, et al.
Pubblicazione: (2025)
di: Zeng, Fanhu, et al.
Pubblicazione: (2025)
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
di: Liu, Jizhihui, et al.
Pubblicazione: (2025)
di: Liu, Jizhihui, et al.
Pubblicazione: (2025)
VLM-Pruner: Buffering for Spatial Sparsity in an Efficient VLM Centrifugal Token Pruning Paradigm
di: Wu, Zhenkai, et al.
Pubblicazione: (2025)
di: Wu, Zhenkai, et al.
Pubblicazione: (2025)
HEART-VIT: Hessian-Guided Efficient Dynamic Attention and Token Pruning in Vision Transformer
di: Uddin, Mohammad Helal, et al.
Pubblicazione: (2025)
di: Uddin, Mohammad Helal, et al.
Pubblicazione: (2025)
UTPTrack: Towards Simple and Unified Token Pruning for Visual Tracking
di: Wu, Hao, et al.
Pubblicazione: (2026)
di: Wu, Hao, et al.
Pubblicazione: (2026)
GTPT: Group-based Token Pruning Transformer for Efficient Human Pose Estimation
di: Wang, Haonan, et al.
Pubblicazione: (2024)
di: Wang, Haonan, et al.
Pubblicazione: (2024)
Vision SmolMamba: Spike-Guided Token Pruning for Energy-Efficient Spiking State-Space Vision Models
di: Bai, Dewei, et al.
Pubblicazione: (2026)
di: Bai, Dewei, et al.
Pubblicazione: (2026)
Reinforcement Learning-based Token Pruning in Vision Transformers: A Markov Game Approach
di: Lu, Chenglong, et al.
Pubblicazione: (2025)
di: Lu, Chenglong, et al.
Pubblicazione: (2025)
Rényi Entropy: A New Token Pruning Metric for Vision Transformers
di: Su, Wei-Yuan, et al.
Pubblicazione: (2026)
di: Su, Wei-Yuan, et al.
Pubblicazione: (2026)
Attention Debiasing for Token Pruning in Vision Language Models
di: Zhao, Kai, et al.
Pubblicazione: (2025)
di: Zhao, Kai, et al.
Pubblicazione: (2025)
Towards Efficient and General-Purpose Few-Shot Misclassification Detection for Vision-Language Models
di: Zeng, Fanhu, et al.
Pubblicazione: (2025)
di: Zeng, Fanhu, et al.
Pubblicazione: (2025)
GeminiFusion: Efficient Pixel-wise Multimodal Fusion for Vision Transformer
di: Jia, Ding, et al.
Pubblicazione: (2024)
di: Jia, Ding, et al.
Pubblicazione: (2024)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
di: Li, Ao, et al.
Pubblicazione: (2025)
di: Li, Ao, et al.
Pubblicazione: (2025)
MADTP: Multimodal Alignment-Guided Dynamic Token Pruning for Accelerating Vision-Language Transformer
di: Cao, Jianjian, et al.
Pubblicazione: (2024)
di: Cao, Jianjian, et al.
Pubblicazione: (2024)
METEOR: Multi-Encoder Collaborative Token Pruning for Efficient Vision Language Models
di: Liu, Yuchen, et al.
Pubblicazione: (2025)
di: Liu, Yuchen, et al.
Pubblicazione: (2025)
A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models
di: Zeng, Quan-Sheng, et al.
Pubblicazione: (2025)
di: Zeng, Quan-Sheng, et al.
Pubblicazione: (2025)
IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning
di: Sun, Zhichao, et al.
Pubblicazione: (2026)
di: Sun, Zhichao, et al.
Pubblicazione: (2026)
SAFE-Pruner: Semantic Attention-Guided Future-Aware Token Pruning for Efficient Vision-Language-Action Manipulation
di: Ma, Shilin, et al.
Pubblicazione: (2026)
di: Ma, Shilin, et al.
Pubblicazione: (2026)
Efficient Token Pruning for LLaDA-V
di: Wan, Zhewen, et al.
Pubblicazione: (2026)
di: Wan, Zhewen, et al.
Pubblicazione: (2026)
Energy-Driven Adaptive Visual Token Pruning for Efficient Vision-Language Models
di: He, Jialuo, et al.
Pubblicazione: (2026)
di: He, Jialuo, et al.
Pubblicazione: (2026)
TP-Spikformer: Token Pruned Spiking Transformer
di: Wei, Wenjie, et al.
Pubblicazione: (2026)
di: Wei, Wenjie, et al.
Pubblicazione: (2026)
Token Pruning for In-Context Generation in Diffusion Transformers
di: Lin, Junqing, et al.
Pubblicazione: (2026)
di: Lin, Junqing, et al.
Pubblicazione: (2026)
Block-based Symmetric Pruning and Fusion for Efficient Vision Transformers
di: Hsieh, Yi-Kuan, et al.
Pubblicazione: (2025)
di: Hsieh, Yi-Kuan, et al.
Pubblicazione: (2025)
RobustMerge: Parameter-Efficient Model Merging for MLLMs with Direction Robustness
di: Zeng, Fanhu, et al.
Pubblicazione: (2025)
di: Zeng, Fanhu, et al.
Pubblicazione: (2025)
EventPrune: Cascaded Event-Assisted Token Pruning for Efficient First-Person Dynamic Spatial Reasoning
di: Ma, Pengtao, et al.
Pubblicazione: (2026)
di: Ma, Pengtao, et al.
Pubblicazione: (2026)
Token Pruning using a Lightweight Background Aware Vision Transformer
di: Sah, Sudhakar, et al.
Pubblicazione: (2024)
di: Sah, Sudhakar, et al.
Pubblicazione: (2024)
Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models
di: Ma, Kexin, et al.
Pubblicazione: (2026)
di: Ma, Kexin, et al.
Pubblicazione: (2026)
PLPHP: Per-Layer Per-Head Vision Token Pruning for Efficient Large Vision-Language Models
di: Meng, Yu, et al.
Pubblicazione: (2025)
di: Meng, Yu, et al.
Pubblicazione: (2025)
LPViT: Low-Power Semi-structured Pruning for Vision Transformers
di: Xu, Kaixin, et al.
Pubblicazione: (2024)
di: Xu, Kaixin, et al.
Pubblicazione: (2024)
Towards Lossless Ultimate Vision Token Compression for VLMs
di: Zheng, Dehua, et al.
Pubblicazione: (2025)
di: Zheng, Dehua, et al.
Pubblicazione: (2025)
Efficient Vision-Language Reasoning via Adaptive Token Pruning
di: Li, Xue, et al.
Pubblicazione: (2025)
di: Li, Xue, et al.
Pubblicazione: (2025)
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
di: Chen, Hanning, et al.
Pubblicazione: (2024)
di: Chen, Hanning, et al.
Pubblicazione: (2024)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)
Object-Centric Vision Token Pruning for Vision Language Models
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
CoReDiT: Spatial Coherence-Guided Token Pruning and Reconstruction for Efficient Diffusion Transformers
di: Li, Zhuojin, et al.
Pubblicazione: (2026)
di: Li, Zhuojin, et al.
Pubblicazione: (2026)
Towards Joint Quantization and Token Pruning of Vision-Language Models
di: Li, Xinqing, et al.
Pubblicazione: (2026)
di: Li, Xinqing, et al.
Pubblicazione: (2026)
Feather the Throttle: Revisiting Visual Token Pruning for Vision-Language Model Acceleration
di: Endo, Mark, et al.
Pubblicazione: (2024)
di: Endo, Mark, et al.
Pubblicazione: (2024)
Token-Space Mask Prediction for Efficient Vision Transformer Segmentation
di: Galagain, Calvin, et al.
Pubblicazione: (2026)
di: Galagain, Calvin, et al.
Pubblicazione: (2026)
ToSA: Token Selective Attention for Efficient Vision Transformers
di: Singh, Manish Kumar, et al.
Pubblicazione: (2024)
di: Singh, Manish Kumar, et al.
Pubblicazione: (2024)
EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent
di: Li, Jiaao, et al.
Pubblicazione: (2025)
di: Li, Jiaao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Token Transforming: A Unified and Training-Free Token Compression Framework for Vision Transformer Acceleration
di: Zeng, Fanhu, et al.
Pubblicazione: (2025) -
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
di: Liu, Jizhihui, et al.
Pubblicazione: (2025) -
VLM-Pruner: Buffering for Spatial Sparsity in an Efficient VLM Centrifugal Token Pruning Paradigm
di: Wu, Zhenkai, et al.
Pubblicazione: (2025) -
HEART-VIT: Hessian-Guided Efficient Dynamic Attention and Token Pruning in Vision Transformer
di: Uddin, Mohammad Helal, et al.
Pubblicazione: (2025) -
UTPTrack: Towards Simple and Unified Token Pruning for Visual Tracking
di: Wu, Hao, et al.
Pubblicazione: (2026)