QuarterMap: Efficient Post-Training Token Pruning for Visual State Space Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chi, Tien-Yu, Chiang, Hung-Yueh, Marculescu, Diana, Wu, Kai-Chiang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
V"Mean"ba: Visual State Space Models only need 1 hidden dimension
par: Chi, Tien-Yu, et autres
Publié: (2024)
par: Chi, Tien-Yu, et autres
Publié: (2024)
Similarity Trajectories: Linking Sampling Process to Artifacts in Diffusion-Generated Images
par: Menn, Dennis, et autres
Publié: (2024)
par: Menn, Dennis, et autres
Publié: (2024)
Quamba: A Post-Training Quantization Recipe for Selective State Space Models
par: Chiang, Hung-Yueh, et autres
Publié: (2024)
par: Chiang, Hung-Yueh, et autres
Publié: (2024)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
par: Huang, Xiaohu, et autres
Publié: (2024)
par: Huang, Xiaohu, et autres
Publié: (2024)
Quamba2: A Robust and Scalable Post-training Quantization Framework for Selective State Space Models
par: Chiang, Hung-Yueh, et autres
Publié: (2025)
par: Chiang, Hung-Yueh, et autres
Publié: (2025)
ELSA: Exploiting Layer-wise N:M Sparsity for Vision Transformer Acceleration
par: Huang, Ning-Chi, et autres
Publié: (2024)
par: Huang, Ning-Chi, et autres
Publié: (2024)
BadVim: Unveiling Backdoor Threats in Visual State Space Model
par: Lee, Cheng-Yi, et autres
Publié: (2024)
par: Lee, Cheng-Yi, et autres
Publié: (2024)
PaPr: Training-Free One-Step Patch Pruning with Lightweight ConvNets for Faster Inference
par: Mahmud, Tanvir, et autres
Publié: (2024)
par: Mahmud, Tanvir, et autres
Publié: (2024)
LEAML: Label-Efficient Adaptation to Out-of-Distribution Visual Tasks for Multimodal Large Language Models
par: Lin, Ci-Siang, et autres
Publié: (2025)
par: Lin, Ci-Siang, et autres
Publié: (2025)
ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning
par: Huang, Chi-Pin, et autres
Publié: (2025)
par: Huang, Chi-Pin, et autres
Publié: (2025)
Grounding-Aware Token Pruning: Recovering from Drastic Performance Drops in Visual Grounding Caused by Pruning
par: Chien, Tzu-Chun, et autres
Publié: (2025)
par: Chien, Tzu-Chun, et autres
Publié: (2025)
Data-Efficient 3D Visual Grounding via Order-Aware Referring
par: Wu, Tung-Yu, et autres
Publié: (2024)
par: Wu, Tung-Yu, et autres
Publié: (2024)
SCAN-Edge: Finding MobileNet-speed Hybrid Networks for Diverse Edge Devices via Hardware-Aware Evolutionary Search
par: Chiang, Hung-Yueh, et autres
Publié: (2024)
par: Chiang, Hung-Yueh, et autres
Publié: (2024)
Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning
par: Zhang, Dingkun, et autres
Publié: (2026)
par: Zhang, Dingkun, et autres
Publié: (2026)
Ada-VE: Training-Free Consistent Video Editing Using Adaptive Motion Prior
par: Mahmud, Tanvir, et autres
Publié: (2024)
par: Mahmud, Tanvir, et autres
Publié: (2024)
Exploring Token Pruning in Vision State Space Models
par: Zhan, Zheng, et autres
Publié: (2024)
par: Zhan, Zheng, et autres
Publié: (2024)
VideoMage: Multi-Subject and Motion Customization of Text-to-Video Diffusion Models
par: Huang, Chi-Pin, et autres
Publié: (2025)
par: Huang, Chi-Pin, et autres
Publié: (2025)
Fit and Prune: Fast and Training-free Visual Token Pruning for Multi-modal Large Language Models
par: Ye, Weihao, et autres
Publié: (2024)
par: Ye, Weihao, et autres
Publié: (2024)
Vision SmolMamba: Spike-Guided Token Pruning for Energy-Efficient Spiking State-Space Vision Models
par: Bai, Dewei, et autres
Publié: (2026)
par: Bai, Dewei, et autres
Publié: (2026)
Training Noise Token Pruning
par: Rao, Mingxing, et autres
Publié: (2024)
par: Rao, Mingxing, et autres
Publié: (2024)
Video Compression Meets Video Generation: Latent Inter-Frame Pruning with Attention Recovery
par: Menn, Dennis, et autres
Publié: (2026)
par: Menn, Dennis, et autres
Publié: (2026)
Unified Reinforcement and Imitation Learning for Vision-Language Models
par: Lee, Byung-Kwan, et autres
Publié: (2025)
par: Lee, Byung-Kwan, et autres
Publié: (2025)
What Kind of Visual Tokens Do We Need? Training-free Visual Token Pruning for Multi-modal Large Language Models from the Perspective of Graph
par: Jiang, Yutao, et autres
Publié: (2025)
par: Jiang, Yutao, et autres
Publié: (2025)
VLsI: Verbalized Layers-to-Interactions from Large to Small Vision Language Models
par: Lee, Byung-Kwan, et autres
Publié: (2024)
par: Lee, Byung-Kwan, et autres
Publié: (2024)
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
par: Wang, Yahong, et autres
Publié: (2026)
par: Wang, Yahong, et autres
Publié: (2026)
Hyper-Local Deformable Transformers for Text Spotting on Historical Maps
par: Lin, Yijun, et autres
Publié: (2025)
par: Lin, Yijun, et autres
Publié: (2025)
VLA-IAP: Training-Free Visual Token Pruning via Interaction Alignment for Vision-Language-Action Models
par: Cheng, Jintao, et autres
Publié: (2026)
par: Cheng, Jintao, et autres
Publié: (2026)
CROP: Contextual Region-Oriented Visual Token Pruning
par: Guo, Jiawei, et autres
Publié: (2025)
par: Guo, Jiawei, et autres
Publié: (2025)
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
par: Zhang, Hao, et autres
Publié: (2025)
par: Zhang, Hao, et autres
Publié: (2025)
Focus-Scan-Refine: From Human Visual Perception to Efficient Visual Token Pruning
par: Tong, Enwei, et autres
Publié: (2026)
par: Tong, Enwei, et autres
Publié: (2026)
Q-Sched: Pushing the Boundaries of Few-Step Diffusion Models with Quantization-Aware Scheduling
par: Frumkin, Natalia, et autres
Publié: (2025)
par: Frumkin, Natalia, et autres
Publié: (2025)
Privacy-Preserving CNN Training with Transfer Learning: Multiclass Logistic Regression
par: Chiang, John
Publié: (2023)
par: Chiang, John
Publié: (2023)
Image Tokenizer Needs Post-Training
par: Qiu, Kai, et autres
Publié: (2025)
par: Qiu, Kai, et autres
Publié: (2025)
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
par: Liu, Jizhihui, et autres
Publié: (2025)
par: Liu, Jizhihui, et autres
Publié: (2025)
HAWK: Head Importance-Aware Visual Token Pruning in Multimodal Models
par: Zhu, Qihui, et autres
Publié: (2026)
par: Zhu, Qihui, et autres
Publié: (2026)
PPT: Token Pruning and Pooling for Efficient Vision Transformers
par: Wu, Xinjian, et autres
Publié: (2023)
par: Wu, Xinjian, et autres
Publié: (2023)
RedVTP: Training-Free Acceleration of Diffusion Vision-Language Models Inference via Masked Token-Guided Visual Token Pruning
par: Xu, Jingqi, et autres
Publié: (2025)
par: Xu, Jingqi, et autres
Publié: (2025)
On Asymmetric Optimization of Reasoning and Perception in Vision-Language Model Post-Training
par: Wu, Xueqing, et autres
Publié: (2026)
par: Wu, Xueqing, et autres
Publié: (2026)
Energy-Driven Adaptive Visual Token Pruning for Efficient Vision-Language Models
par: He, Jialuo, et autres
Publié: (2026)
par: He, Jialuo, et autres
Publié: (2026)
StreamingAssistant: Efficient Visual Token Pruning for Accelerating Online Video Understanding
par: Jin, Xinqi, et autres
Publié: (2025)
par: Jin, Xinqi, et autres
Publié: (2025)
Documents similaires
-
V"Mean"ba: Visual State Space Models only need 1 hidden dimension
par: Chi, Tien-Yu, et autres
Publié: (2024) -
Similarity Trajectories: Linking Sampling Process to Artifacts in Diffusion-Generated Images
par: Menn, Dennis, et autres
Publié: (2024) -
Quamba: A Post-Training Quantization Recipe for Selective State Space Models
par: Chiang, Hung-Yueh, et autres
Publié: (2024) -
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
par: Huang, Xiaohu, et autres
Publié: (2024) -
Quamba2: A Robust and Scalable Post-training Quantization Framework for Selective State Space Models
par: Chiang, Hung-Yueh, et autres
Publié: (2025)