Adaptive MLP Pruning for Large Vision Transformers
Fuente:
arXiv
Gespeichert in:
| 1. Verfasser: | Shen, Chengchao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Diversity-Guided MLP Reduction for Efficient Large Vision Transformers
von: Shen, Chengchao, et al.
Veröffentlicht: (2025)
von: Shen, Chengchao, et al.
Veröffentlicht: (2025)
Learning Compact Vision Tokens for Efficient Large Multimodal Models
von: Tang, Hao, et al.
Veröffentlicht: (2025)
von: Tang, Hao, et al.
Veröffentlicht: (2025)
SpiralMLP: A Lightweight Vision MLP Architecture
von: Mu, Haojie, et al.
Veröffentlicht: (2024)
von: Mu, Haojie, et al.
Veröffentlicht: (2024)
evMLP: An Efficient Event-Driven MLP Architecture for Vision
von: Zheng, Zhentan
Veröffentlicht: (2025)
von: Zheng, Zhentan
Veröffentlicht: (2025)
ATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models
von: Ye, Xubing, et al.
Veröffentlicht: (2024)
von: Ye, Xubing, et al.
Veröffentlicht: (2024)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
von: Luan, Bozhi, et al.
Veröffentlicht: (2025)
von: Luan, Bozhi, et al.
Veröffentlicht: (2025)
MLP Can Be A Good Transformer Learner
von: Lin, Sihao, et al.
Veröffentlicht: (2024)
von: Lin, Sihao, et al.
Veröffentlicht: (2024)
Reinforcement Learning-based Token Pruning in Vision Transformers: A Markov Game Approach
von: Lu, Chenglong, et al.
Veröffentlicht: (2025)
von: Lu, Chenglong, et al.
Veröffentlicht: (2025)
Exploring Synergistic Ensemble Learning: Uniting CNNs, MLP-Mixers, and Vision Transformers to Enhance Image Classification
von: Bashar, Mk, et al.
Veröffentlicht: (2025)
von: Bashar, Mk, et al.
Veröffentlicht: (2025)
Multi-Grained Contrast for Data-Efficient Unsupervised Representation Learning
von: Shen, Chengchao, et al.
Veröffentlicht: (2024)
von: Shen, Chengchao, et al.
Veröffentlicht: (2024)
PPT: Token Pruning and Pooling for Efficient Vision Transformers
von: Wu, Xinjian, et al.
Veröffentlicht: (2023)
von: Wu, Xinjian, et al.
Veröffentlicht: (2023)
LPViT: Low-Power Semi-structured Pruning for Vision Transformers
von: Xu, Kaixin, et al.
Veröffentlicht: (2024)
von: Xu, Kaixin, et al.
Veröffentlicht: (2024)
Block-based Symmetric Pruning and Fusion for Efficient Vision Transformers
von: Hsieh, Yi-Kuan, et al.
Veröffentlicht: (2025)
von: Hsieh, Yi-Kuan, et al.
Veröffentlicht: (2025)
Cross-DINO: Cross the Deep MLP and Transformer for Small Object Detection
von: Cao, Guiping, et al.
Veröffentlicht: (2025)
von: Cao, Guiping, et al.
Veröffentlicht: (2025)
Rényi Entropy: A New Token Pruning Metric for Vision Transformers
von: Su, Wei-Yuan, et al.
Veröffentlicht: (2026)
von: Su, Wei-Yuan, et al.
Veröffentlicht: (2026)
GraViT: Transfer Learning with Vision Transformers and MLP-Mixer for Strong Gravitational Lens Discovery
von: Parlange, René, et al.
Veröffentlicht: (2025)
von: Parlange, René, et al.
Veröffentlicht: (2025)
Topology-Aware Layer Pruning for Large Vision-Language Models
von: Zheng, Pengcheng, et al.
Veröffentlicht: (2026)
von: Zheng, Pengcheng, et al.
Veröffentlicht: (2026)
FairViT: Fair Vision Transformer via Adaptive Masking
von: Tian, Bowei, et al.
Veröffentlicht: (2024)
von: Tian, Bowei, et al.
Veröffentlicht: (2024)
PointMT: Efficient Point Cloud Analysis with Hybrid MLP-Transformer Architecture
von: Zheng, Qiang, et al.
Veröffentlicht: (2024)
von: Zheng, Qiang, et al.
Veröffentlicht: (2024)
CS-Mixer: A Cross-Scale Vision MLP Model with Spatial-Channel Mixing
von: Cui, Jonathan, et al.
Veröffentlicht: (2023)
von: Cui, Jonathan, et al.
Veröffentlicht: (2023)
Caterpillar: A Pure-MLP Architecture with Shifted-Pillars-Concatenation
von: Sun, Jin, et al.
Veröffentlicht: (2023)
von: Sun, Jin, et al.
Veröffentlicht: (2023)
TAMP: Token-Adaptive Layerwise Pruning in Multimodal Large Language Models
von: Lee, Jaewoo, et al.
Veröffentlicht: (2025)
von: Lee, Jaewoo, et al.
Veröffentlicht: (2025)
TAP-ViTs: Task-Adaptive Pruning for On-Device Deployment of Vision Transformers
von: Wang, Zhibo, et al.
Veröffentlicht: (2026)
von: Wang, Zhibo, et al.
Veröffentlicht: (2026)
HEART-VIT: Hessian-Guided Efficient Dynamic Attention and Token Pruning in Vision Transformer
von: Uddin, Mohammad Helal, et al.
Veröffentlicht: (2025)
von: Uddin, Mohammad Helal, et al.
Veröffentlicht: (2025)
Pruning by Block Benefit: Exploring the Properties of Vision Transformer Blocks during Domain Adaptation
von: Glandorf, Patrick, et al.
Veröffentlicht: (2025)
von: Glandorf, Patrick, et al.
Veröffentlicht: (2025)
MADTP: Multimodal Alignment-Guided Dynamic Token Pruning for Accelerating Vision-Language Transformer
von: Cao, Jianjian, et al.
Veröffentlicht: (2024)
von: Cao, Jianjian, et al.
Veröffentlicht: (2024)
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
von: Lee, Dong-Jae, et al.
Veröffentlicht: (2026)
von: Lee, Dong-Jae, et al.
Veröffentlicht: (2026)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
von: Li, Ao, et al.
Veröffentlicht: (2025)
von: Li, Ao, et al.
Veröffentlicht: (2025)
Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models
von: Ma, Kexin, et al.
Veröffentlicht: (2026)
von: Ma, Kexin, et al.
Veröffentlicht: (2026)
EfficientLLaVA:Generalizable Auto-Pruning for Large Vision-language Models
von: Liang, Yinan, et al.
Veröffentlicht: (2025)
von: Liang, Yinan, et al.
Veröffentlicht: (2025)
INTERLACE: Interleaved Layer Pruning and Efficient Adaptation in Large Vision-Language Models
von: Madinei, Parsa, et al.
Veröffentlicht: (2025)
von: Madinei, Parsa, et al.
Veröffentlicht: (2025)
AdaptInfer: Adaptive Token Pruning for Vision-Language Model Inference with Dynamical Text Guidance
von: Zhang, Weichen, et al.
Veröffentlicht: (2025)
von: Zhang, Weichen, et al.
Veröffentlicht: (2025)
Comb, Prune, Distill: Towards Unified Pruning for Vision Model Compression
von: Schmitt, Jonas, et al.
Veröffentlicht: (2024)
von: Schmitt, Jonas, et al.
Veröffentlicht: (2024)
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
Patch Pruning Strategy Based on Robust Statistical Measures of Attention Weight Diversity in Vision Transformers
von: Igaue, Yuki, et al.
Veröffentlicht: (2025)
von: Igaue, Yuki, et al.
Veröffentlicht: (2025)
SiT-MLP: A Simple MLP with Point-wise Topology Feature Learning for Skeleton-based Action Recognition
von: Zhang, Shaojie, et al.
Veröffentlicht: (2023)
von: Zhang, Shaojie, et al.
Veröffentlicht: (2023)
Data-independent Module-aware Pruning for Hierarchical Vision Transformers
von: He, Yang, et al.
Veröffentlicht: (2024)
von: He, Yang, et al.
Veröffentlicht: (2024)
CATP: Contextually Adaptive Token Pruning for Efficient and Enhanced Multimodal In-Context Learning
von: Li, Yanshu, et al.
Veröffentlicht: (2025)
von: Li, Yanshu, et al.
Veröffentlicht: (2025)
IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning
von: Sun, Zhichao, et al.
Veröffentlicht: (2026)
von: Sun, Zhichao, et al.
Veröffentlicht: (2026)
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
von: Liu, Jizhihui, et al.
Veröffentlicht: (2025)
von: Liu, Jizhihui, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Diversity-Guided MLP Reduction for Efficient Large Vision Transformers
von: Shen, Chengchao, et al.
Veröffentlicht: (2025) -
Learning Compact Vision Tokens for Efficient Large Multimodal Models
von: Tang, Hao, et al.
Veröffentlicht: (2025) -
SpiralMLP: A Lightweight Vision MLP Architecture
von: Mu, Haojie, et al.
Veröffentlicht: (2024) -
evMLP: An Efficient Event-Driven MLP Architecture for Vision
von: Zheng, Zhentan
Veröffentlicht: (2025) -
ATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models
von: Ye, Xubing, et al.
Veröffentlicht: (2024)