Back to Fundamentals: Low-Level Visual Features Guided Progressive Token Pruning
Fuente:
arXiv
Guardado en:
| Autores principales: | Ouyang, Yuanbing, Liang, Yizhuo, Li, Qingpeng, Guo, Xinfei, Luo, Yiming, Wu, Di, Wang, Hao, Pan, Yushan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Skeleton-Guided Diffusion Model for Accurate Foot X-ray Synthesis in Hallux Valgus Diagnosis
por: Wan, Midi, et al.
Publicado: (2025)
por: Wan, Midi, et al.
Publicado: (2025)
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
por: Wang, Yahong, et al.
Publicado: (2026)
por: Wang, Yahong, et al.
Publicado: (2026)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
por: Huang, Xiaohu, et al.
Publicado: (2024)
por: Huang, Xiaohu, et al.
Publicado: (2024)
Model Compression using Progressive Channel Pruning
por: Guo, Jinyang, et al.
Publicado: (2025)
por: Guo, Jinyang, et al.
Publicado: (2025)
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
por: Zhang, Hao, et al.
Publicado: (2025)
por: Zhang, Hao, et al.
Publicado: (2025)
CROP: Contextual Region-Oriented Visual Token Pruning
por: Guo, Jiawei, et al.
Publicado: (2025)
por: Guo, Jiawei, et al.
Publicado: (2025)
LRCP: Low-Rank Compressibility Guided Visual Token Pruning for Efficient LVLMs
por: Lu, Hongyu, et al.
Publicado: (2026)
por: Lu, Hongyu, et al.
Publicado: (2026)
UTPTrack: Towards Simple and Unified Token Pruning for Visual Tracking
por: Wu, Hao, et al.
Publicado: (2026)
por: Wu, Hao, et al.
Publicado: (2026)
Geometry-Guided 3D Visual Token Pruning for Video-Language Models
por: Li, Han, et al.
Publicado: (2026)
por: Li, Han, et al.
Publicado: (2026)
TrimTokenator-LC: Towards Adaptive Visual Token Pruning for Large Multimodal Models with Long Contexts
por: Zhang, Hao, et al.
Publicado: (2025)
por: Zhang, Hao, et al.
Publicado: (2025)
VFlowOpt: A Token Pruning Framework for LMMs with Visual Information Flow-Guided Optimization
por: Yang, Sihan, et al.
Publicado: (2025)
por: Yang, Sihan, et al.
Publicado: (2025)
When Token Pruning is Worse than Random: Understanding Visual Token Information in VLLMs
por: Wang, Yahong, et al.
Publicado: (2025)
por: Wang, Yahong, et al.
Publicado: (2025)
IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning
por: Sun, Zhichao, et al.
Publicado: (2026)
por: Sun, Zhichao, et al.
Publicado: (2026)
HAWK: Head Importance-Aware Visual Token Pruning in Multimodal Models
por: Zhu, Qihui, et al.
Publicado: (2026)
por: Zhu, Qihui, et al.
Publicado: (2026)
PixelPrune: Pixel-Level Adaptive Visual Token Reduction via Predictive Coding
por: Wang, Nan, et al.
Publicado: (2026)
por: Wang, Nan, et al.
Publicado: (2026)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
por: Luan, Bozhi, et al.
Publicado: (2025)
por: Luan, Bozhi, et al.
Publicado: (2025)
OTPrune: Distribution-Aligned Visual Token Pruning via Optimal Transport
por: Chen, Xiwen, et al.
Publicado: (2026)
por: Chen, Xiwen, et al.
Publicado: (2026)
When Large Vision-Language Model Meets Large Remote Sensing Imagery: Coarse-to-Fine Text-Guided Token Pruning
por: Luo, Junwei, et al.
Publicado: (2025)
por: Luo, Junwei, et al.
Publicado: (2025)
Fit and Prune: Fast and Training-free Visual Token Pruning for Multi-modal Large Language Models
por: Ye, Weihao, et al.
Publicado: (2024)
por: Ye, Weihao, et al.
Publicado: (2024)
GridPrune: From "Where to Look" to "What to Select" in Visual Token Pruning for MLLMs
por: Duan, Yuxiang, et al.
Publicado: (2025)
por: Duan, Yuxiang, et al.
Publicado: (2025)
FastVAR: Linear Visual Autoregressive Modeling via Cached Token Pruning
por: Guo, Hang, et al.
Publicado: (2025)
por: Guo, Hang, et al.
Publicado: (2025)
RedVTP: Training-Free Acceleration of Diffusion Vision-Language Models Inference via Masked Token-Guided Visual Token Pruning
por: Xu, Jingqi, et al.
Publicado: (2025)
por: Xu, Jingqi, et al.
Publicado: (2025)
Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs
por: Zhang, Qizhe, et al.
Publicado: (2024)
por: Zhang, Qizhe, et al.
Publicado: (2024)
Pyramid Token Pruning for High-Resolution Large Vision-Language Models via Region, Token, and Instruction-Guided Importance
por: Liang, Yuxuan, et al.
Publicado: (2025)
por: Liang, Yuxuan, et al.
Publicado: (2025)
PaceVGGT: Pre-Alternating-Attention Token Pruning for Visual Geometry Transformers
por: Li, Haotang, et al.
Publicado: (2026)
por: Li, Haotang, et al.
Publicado: (2026)
ERASE: Eliminating Redundant Visual Tokens via Adaptive Two-Stage Token Pruning
por: Lee, Yuna, et al.
Publicado: (2026)
por: Lee, Yuna, et al.
Publicado: (2026)
ToDRE: Effective Visual Token Pruning via Token Diversity and Task Relevance
por: Li, Duo, et al.
Publicado: (2025)
por: Li, Duo, et al.
Publicado: (2025)
Rethinking Token Pruning for Historical Screenshots in GUI Visual Agents: Semantic, Spatial, and Temporal Perspectives
por: Li, Daiqiang, et al.
Publicado: (2026)
por: Li, Daiqiang, et al.
Publicado: (2026)
DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models
por: Alvar, Saeed Ranjbar, et al.
Publicado: (2025)
por: Alvar, Saeed Ranjbar, et al.
Publicado: (2025)
PGP-DiffSR: Phase-Guided Progressive Pruning for Efficient Diffusion-based Image Super-Resolution
por: Yang, Zhongbao, et al.
Publicado: (2025)
por: Yang, Zhongbao, et al.
Publicado: (2025)
EvoPrune: Early-Stage Visual Token Pruning for Efficient MLLMs
por: Chen, Yuhao, et al.
Publicado: (2026)
por: Chen, Yuhao, et al.
Publicado: (2026)
Language-Guided Temporal Token Pruning for Efficient VideoLLM Processing
por: Kumar, Yogesh
Publicado: (2025)
por: Kumar, Yogesh
Publicado: (2025)
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
por: Chen, Hanning, et al.
Publicado: (2024)
por: Chen, Hanning, et al.
Publicado: (2024)
A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models
por: Zeng, Quan-Sheng, et al.
Publicado: (2025)
por: Zeng, Quan-Sheng, et al.
Publicado: (2025)
Focus-Scan-Refine: From Human Visual Perception to Efficient Visual Token Pruning
por: Tong, Enwei, et al.
Publicado: (2026)
por: Tong, Enwei, et al.
Publicado: (2026)
IDPruner: Harmonizing Importance and Diversity in Visual Token Pruning for MLLMs
por: Tan, Yifan, et al.
Publicado: (2026)
por: Tan, Yifan, et al.
Publicado: (2026)
NeuroMamba: Multi-Perspective Feature Interaction with Visual Mamba for Neuron Segmentation
por: Jiang, Liuyun, et al.
Publicado: (2026)
por: Jiang, Liuyun, et al.
Publicado: (2026)
QuarterMap: Efficient Post-Training Token Pruning for Visual State Space Models
por: Chi, Tien-Yu, et al.
Publicado: (2025)
por: Chi, Tien-Yu, et al.
Publicado: (2025)
DiCoDe: Diffusion-Compressed Deep Tokens for Autoregressive Video Generation with Language Models
por: Li, Yizhuo, et al.
Publicado: (2024)
por: Li, Yizhuo, et al.
Publicado: (2024)
Large Language Model Guided Progressive Feature Alignment for Multimodal UAV Object Detection
por: Wu, Wentao, et al.
Publicado: (2025)
por: Wu, Wentao, et al.
Publicado: (2025)
Ejemplares similares
-
Skeleton-Guided Diffusion Model for Accurate Foot X-ray Synthesis in Hallux Valgus Diagnosis
por: Wan, Midi, et al.
Publicado: (2025) -
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
por: Wang, Yahong, et al.
Publicado: (2026) -
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
por: Huang, Xiaohu, et al.
Publicado: (2024) -
Model Compression using Progressive Channel Pruning
por: Guo, Jinyang, et al.
Publicado: (2025) -
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
por: Zhang, Hao, et al.
Publicado: (2025)