FoPru: Focal Pruning for Efficient Large Vision-Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Jiang, Lei, Huang, Weizhe, Liu, Tongxuan, Zeng, Yuting, Li, Jing, Cheng, Lechao, Xu, Xiaohua |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Decoupled Training with Local Reinforcement Fine-Tuning in Federated Learning
von: Ma, Yuting, et al.
Veröffentlicht: (2026)
von: Ma, Yuting, et al.
Veröffentlicht: (2026)
TARAC: Mitigating Hallucination in LVLMs via Temporal Attention Real-time Accumulative Connection
von: Jiang, Lei, et al.
Veröffentlicht: (2025)
von: Jiang, Lei, et al.
Veröffentlicht: (2025)
Modality Alignment Meets Federated Broadcasting
von: Ma, Yuting, et al.
Veröffentlicht: (2024)
von: Ma, Yuting, et al.
Veröffentlicht: (2024)
FedHPL: Efficient Heterogeneous Federated Learning with Prompt Tuning and Logit Distillation
von: Ma, Yuting, et al.
Veröffentlicht: (2024)
von: Ma, Yuting, et al.
Veröffentlicht: (2024)
Reg4Pru: Regularisation Through Random Token Routing for Token Pruning
von: Wyatt, Julian, et al.
Veröffentlicht: (2026)
von: Wyatt, Julian, et al.
Veröffentlicht: (2026)
A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models
von: Zeng, Quan-Sheng, et al.
Veröffentlicht: (2025)
von: Zeng, Quan-Sheng, et al.
Veröffentlicht: (2025)
LLaVA-PruMerge: Adaptive Token Reduction for Efficient Large Multimodal Models
von: Shang, Yuzhang, et al.
Veröffentlicht: (2024)
von: Shang, Yuzhang, et al.
Veröffentlicht: (2024)
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
von: He, Jiayi, et al.
Veröffentlicht: (2025)
von: He, Jiayi, et al.
Veröffentlicht: (2025)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
von: Huang, Xiaohu, et al.
Veröffentlicht: (2024)
von: Huang, Xiaohu, et al.
Veröffentlicht: (2024)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
von: Li, Ao, et al.
Veröffentlicht: (2025)
von: Li, Ao, et al.
Veröffentlicht: (2025)
PruNeRF: Segment-Centric Dataset Pruning via 3D Spatial Consistency
von: Jung, Yeonsung, et al.
Veröffentlicht: (2024)
von: Jung, Yeonsung, et al.
Veröffentlicht: (2024)
INTERLACE: Interleaved Layer Pruning and Efficient Adaptation in Large Vision-Language Models
von: Madinei, Parsa, et al.
Veröffentlicht: (2025)
von: Madinei, Parsa, et al.
Veröffentlicht: (2025)
Attention Debiasing for Token Pruning in Vision Language Models
von: Zhao, Kai, et al.
Veröffentlicht: (2025)
von: Zhao, Kai, et al.
Veröffentlicht: (2025)
Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models
von: Jiang, Lei, et al.
Veröffentlicht: (2025)
von: Jiang, Lei, et al.
Veröffentlicht: (2025)
Towards Joint Quantization and Token Pruning of Vision-Language Models
von: Li, Xinqing, et al.
Veröffentlicht: (2026)
von: Li, Xinqing, et al.
Veröffentlicht: (2026)
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
von: Liu, Jizhihui, et al.
Veröffentlicht: (2025)
von: Liu, Jizhihui, et al.
Veröffentlicht: (2025)
Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models
von: Ma, Kexin, et al.
Veröffentlicht: (2026)
von: Ma, Kexin, et al.
Veröffentlicht: (2026)
EfficientLLaVA:Generalizable Auto-Pruning for Large Vision-language Models
von: Liang, Yinan, et al.
Veröffentlicht: (2025)
von: Liang, Yinan, et al.
Veröffentlicht: (2025)
PLPHP: Per-Layer Per-Head Vision Token Pruning for Efficient Large Vision-Language Models
von: Meng, Yu, et al.
Veröffentlicht: (2025)
von: Meng, Yu, et al.
Veröffentlicht: (2025)
Cross-Self KV Cache Pruning for Efficient Vision-Language Inference
von: Pei, Xiaohuan, et al.
Veröffentlicht: (2024)
von: Pei, Xiaohuan, et al.
Veröffentlicht: (2024)
Mitigating Information Loss under High Pruning Rates for Efficient Large Vision Language Models
von: Fu, Mingyu, et al.
Veröffentlicht: (2025)
von: Fu, Mingyu, et al.
Veröffentlicht: (2025)
Topology-Aware Layer Pruning for Large Vision-Language Models
von: Zheng, Pengcheng, et al.
Veröffentlicht: (2026)
von: Zheng, Pengcheng, et al.
Veröffentlicht: (2026)
PPT: Token Pruning and Pooling for Efficient Vision Transformers
von: Wu, Xinjian, et al.
Veröffentlicht: (2023)
von: Wu, Xinjian, et al.
Veröffentlicht: (2023)
FoSS: Modeling Long Range Dependencies and Multimodal Uncertainty in Trajectory Prediction via Fourier State Space Integration
von: Huang, Yizhou, et al.
Veröffentlicht: (2026)
von: Huang, Yizhou, et al.
Veröffentlicht: (2026)
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
von: Lee, Dong-Jae, et al.
Veröffentlicht: (2026)
von: Lee, Dong-Jae, et al.
Veröffentlicht: (2026)
Text-Driven Diffusion Model for Sign Language Production
von: He, Jiayi, et al.
Veröffentlicht: (2025)
von: He, Jiayi, et al.
Veröffentlicht: (2025)
MarvelOVD: Marrying Object Recognition and Vision-Language Models for Robust Open-Vocabulary Object Detection
von: Wang, Kuo, et al.
Veröffentlicht: (2024)
von: Wang, Kuo, et al.
Veröffentlicht: (2024)
ViTCoP: Accelerating Large Vision-Language Models via Visual and Textual Semantic Collaborative Pruning
von: Luo, Wen, et al.
Veröffentlicht: (2026)
von: Luo, Wen, et al.
Veröffentlicht: (2026)
CAPA: Contribution-Aware Pruning and FFN Approximation for Efficient Large Vision-Language Models
von: Jha, Samyak, et al.
Veröffentlicht: (2026)
von: Jha, Samyak, et al.
Veröffentlicht: (2026)
CanonSLR: Canonical-View Guided Multi-View Continuous Sign Language Recognition
von: Wang, Xu, et al.
Veröffentlicht: (2026)
von: Wang, Xu, et al.
Veröffentlicht: (2026)
METEOR: Multi-Encoder Collaborative Token Pruning for Efficient Vision Language Models
von: Liu, Yuchen, et al.
Veröffentlicht: (2025)
von: Liu, Yuchen, et al.
Veröffentlicht: (2025)
ATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models
von: Ye, Xubing, et al.
Veröffentlicht: (2024)
von: Ye, Xubing, et al.
Veröffentlicht: (2024)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
von: Luan, Bozhi, et al.
Veröffentlicht: (2025)
von: Luan, Bozhi, et al.
Veröffentlicht: (2025)
Vision SmolMamba: Spike-Guided Token Pruning for Energy-Efficient Spiking State-Space Vision Models
von: Bai, Dewei, et al.
Veröffentlicht: (2026)
von: Bai, Dewei, et al.
Veröffentlicht: (2026)
LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
von: Chen, Hanning, et al.
Veröffentlicht: (2025)
von: Chen, Hanning, et al.
Veröffentlicht: (2025)
LaVi: Efficient Large Vision-Language Models via Internal Feature Modulation
von: Yue, Tongtian, et al.
Veröffentlicht: (2025)
von: Yue, Tongtian, et al.
Veröffentlicht: (2025)
Unsupervised Pre-training with Language-Vision Prompts for Low-Data Instance Segmentation
von: Zhang, Dingwen, et al.
Veröffentlicht: (2024)
von: Zhang, Dingwen, et al.
Veröffentlicht: (2024)
GRIP-VLM: Group-Relative Importance Pruning for Efficient Vision-Language Models
von: Huang, Mingzhe, et al.
Veröffentlicht: (2026)
von: Huang, Mingzhe, et al.
Veröffentlicht: (2026)
Skip-Vision: Efficient and Scalable Acceleration of Vision-Language Models via Adaptive Token Skipping
von: Zeng, Weili, et al.
Veröffentlicht: (2025)
von: Zeng, Weili, et al.
Veröffentlicht: (2025)
Short-LVLM: Compressing and Accelerating Large Vision-Language Models by Pruning Redundant Layers
von: Ma, Ji, et al.
Veröffentlicht: (2025)
von: Ma, Ji, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Decoupled Training with Local Reinforcement Fine-Tuning in Federated Learning
von: Ma, Yuting, et al.
Veröffentlicht: (2026) -
TARAC: Mitigating Hallucination in LVLMs via Temporal Attention Real-time Accumulative Connection
von: Jiang, Lei, et al.
Veröffentlicht: (2025) -
Modality Alignment Meets Federated Broadcasting
von: Ma, Yuting, et al.
Veröffentlicht: (2024) -
FedHPL: Efficient Heterogeneous Federated Learning with Prompt Tuning and Logit Distillation
von: Ma, Yuting, et al.
Veröffentlicht: (2024) -
Reg4Pru: Regularisation Through Random Token Routing for Token Pruning
von: Wyatt, Julian, et al.
Veröffentlicht: (2026)