Salvato in:
| Autori principali: | Pathak, Surendra, Han, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.14549 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Efficient Large Vision-Language Models: A Comprehensive Survey on Inference Strategies
di: Pathak, Surendra, et al.
Pubblicazione: (2026)
di: Pathak, Surendra, et al.
Pubblicazione: (2026)
Ensembling Pruned Attention Heads For Uncertainty-Aware Efficient Transformers
di: Gabetni, Firas, et al.
Pubblicazione: (2025)
di: Gabetni, Firas, et al.
Pubblicazione: (2025)
Rényi Attention Entropy for Patch Pruning
di: Aizawa, Hiroaki, et al.
Pubblicazione: (2026)
di: Aizawa, Hiroaki, et al.
Pubblicazione: (2026)
CAPA: Contribution-Aware Pruning and FFN Approximation for Efficient Large Vision-Language Models
di: Jha, Samyak, et al.
Pubblicazione: (2026)
di: Jha, Samyak, et al.
Pubblicazione: (2026)
Structured Model Pruning for Efficient Inference in Computational Pathology
di: Adnan, Mohammed, et al.
Pubblicazione: (2024)
di: Adnan, Mohammed, et al.
Pubblicazione: (2024)
Hybrid-Regularized Magnitude Pruning for Robust Federated Learning under Covariate Shift
di: Goksu, Ozgu, et al.
Pubblicazione: (2024)
di: Goksu, Ozgu, et al.
Pubblicazione: (2024)
PruneFuse: Efficient Data Selection via Weight Pruning and Network Fusion
di: Kousar, Humaira, et al.
Pubblicazione: (2026)
di: Kousar, Humaira, et al.
Pubblicazione: (2026)
ICE-Pruning: An Iterative Cost-Efficient Pruning Pipeline for Deep Neural Networks
di: Hu, Wenhao, et al.
Pubblicazione: (2025)
di: Hu, Wenhao, et al.
Pubblicazione: (2025)
Equivariant-Aware Structured Pruning for Efficient Edge Deployment: A Comprehensive Framework with Adaptive Fine-Tuning
di: Alnemari, Mohammed
Pubblicazione: (2025)
di: Alnemari, Mohammed
Pubblicazione: (2025)
Adaptive Sharpness-Aware Pruning for Robust Sparse Networks
di: Bair, Anna, et al.
Pubblicazione: (2023)
di: Bair, Anna, et al.
Pubblicazione: (2023)
Make Your LVLM KV Cache More Lightweight
di: Chen, Xihao, et al.
Pubblicazione: (2026)
di: Chen, Xihao, et al.
Pubblicazione: (2026)
VLM-Pruner: Buffering for Spatial Sparsity in an Efficient VLM Centrifugal Token Pruning Paradigm
di: Wu, Zhenkai, et al.
Pubblicazione: (2025)
di: Wu, Zhenkai, et al.
Pubblicazione: (2025)
Large-scale Dataset Pruning with Dynamic Uncertainty
di: He, Muyang, et al.
Pubblicazione: (2023)
di: He, Muyang, et al.
Pubblicazione: (2023)
NEURAL: Attention-Guided Pruning for Unified Multimodal Resource-Constrained Clinical Evaluation
di: Joshi, Devvrat, et al.
Pubblicazione: (2025)
di: Joshi, Devvrat, et al.
Pubblicazione: (2025)
QOC: Quantum On-Chip Training with Parameter Shift and Gradient Pruning
di: Wang, Hanrui, et al.
Pubblicazione: (2022)
di: Wang, Hanrui, et al.
Pubblicazione: (2022)
Aligned but Stereotypical? The Hidden Influence of System Prompts on Social Bias in LVLM-Based Text-to-Image Models
di: Park, NaHyeon, et al.
Pubblicazione: (2025)
di: Park, NaHyeon, et al.
Pubblicazione: (2025)
Interpretability-Aware Pruning for Efficient Medical Image Analysis
di: Malik, Nikita, et al.
Pubblicazione: (2025)
di: Malik, Nikita, et al.
Pubblicazione: (2025)
STAR: Stage-Wise Attention-Guided Token Reduction for Efficient Large Vision-Language Models Inference
di: Guo, Yichen, et al.
Pubblicazione: (2025)
di: Guo, Yichen, et al.
Pubblicazione: (2025)
Efficient Fine-Tuning and Concept Suppression for Pruned Diffusion Models
di: Shirkavand, Reza, et al.
Pubblicazione: (2024)
di: Shirkavand, Reza, et al.
Pubblicazione: (2024)
Domain-Inspired Sharpness-Aware Minimization Under Domain Shifts
di: Zhang, Ruipeng, et al.
Pubblicazione: (2024)
di: Zhang, Ruipeng, et al.
Pubblicazione: (2024)
LD-Pruner: Efficient Pruning of Latent Diffusion Models using Task-Agnostic Insights
di: Castells, Thibault, et al.
Pubblicazione: (2024)
di: Castells, Thibault, et al.
Pubblicazione: (2024)
Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
di: Zhao, Yaqi, et al.
Pubblicazione: (2024)
di: Zhao, Yaqi, et al.
Pubblicazione: (2024)
Fwd2Bot: LVLM Visual Token Compression with Double Forward Bottleneck
di: Bulat, Adrian, et al.
Pubblicazione: (2025)
di: Bulat, Adrian, et al.
Pubblicazione: (2025)
C-SWAP: Explainability-Aware Structured Pruning for Efficient Neural Networks Compression
di: Bauvin, Baptiste, et al.
Pubblicazione: (2025)
di: Bauvin, Baptiste, et al.
Pubblicazione: (2025)
AgilePruner: An Empirical Study of Attention and Diversity for Adaptive Visual Token Pruning in Large Vision-Language Models
di: Baek, Changwoo, et al.
Pubblicazione: (2026)
di: Baek, Changwoo, et al.
Pubblicazione: (2026)
Efficient Unstructured Pruning of Mamba State-Space Models for Resource-Constrained Environments
di: Shihab, Ibne Farabi, et al.
Pubblicazione: (2025)
di: Shihab, Ibne Farabi, et al.
Pubblicazione: (2025)
Multimodal-Guided Dynamic Dataset Pruning for Robust and Efficient Data-Centric Learning
di: Yang, Suorong, et al.
Pubblicazione: (2025)
di: Yang, Suorong, et al.
Pubblicazione: (2025)
OCCAM: Towards Cost-Efficient and Accuracy-Aware Classification Inference
di: Ding, Dujian, et al.
Pubblicazione: (2024)
di: Ding, Dujian, et al.
Pubblicazione: (2024)
Free$^2$Guide: Training-Free Text-to-Video Alignment using Image LVLM
di: Kim, Jaemin, et al.
Pubblicazione: (2024)
di: Kim, Jaemin, et al.
Pubblicazione: (2024)
CHAI: CacHe Attention Inference for text2video
di: Cherian, Joel Mathew, et al.
Pubblicazione: (2026)
di: Cherian, Joel Mathew, et al.
Pubblicazione: (2026)
Decay Pruning Method: Smooth Pruning With a Self-Rectifying Procedure
di: Yang, Minghao, et al.
Pubblicazione: (2024)
di: Yang, Minghao, et al.
Pubblicazione: (2024)
Efficient Vision-Language Reasoning via Adaptive Token Pruning
di: Li, Xue, et al.
Pubblicazione: (2025)
di: Li, Xue, et al.
Pubblicazione: (2025)
LoRAPrune: Structured Pruning Meets Low-Rank Parameter-Efficient Fine-Tuning
di: Zhang, Mingyang, et al.
Pubblicazione: (2023)
di: Zhang, Mingyang, et al.
Pubblicazione: (2023)
Uncertainty-Aware Subset Selection for Robust Visual Explainability under Distribution Shifts
di: Gupta, Madhav, et al.
Pubblicazione: (2025)
di: Gupta, Madhav, et al.
Pubblicazione: (2025)
CoreMatching: A Co-adaptive Sparse Inference Framework with Token and Neuron Pruning for Comprehensive Acceleration of Vision-Language Models
di: Wang, Qinsi, et al.
Pubblicazione: (2025)
di: Wang, Qinsi, et al.
Pubblicazione: (2025)
Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning
di: Zhang, Dingkun, et al.
Pubblicazione: (2026)
di: Zhang, Dingkun, et al.
Pubblicazione: (2026)
Mixture-of-Top-k Attention: Efficient Attention via Scalable Fast Weights
di: Wen, Qishuai, et al.
Pubblicazione: (2026)
di: Wen, Qishuai, et al.
Pubblicazione: (2026)
Is Complexity Required for Neural Network Pruning? A Case Study on Global Magnitude Pruning
di: Gupta, Manas, et al.
Pubblicazione: (2022)
di: Gupta, Manas, et al.
Pubblicazione: (2022)
Efficient Pruning of Text-to-Image Models: Insights from Pruning Stable Diffusion
di: Ramesh, Samarth N, et al.
Pubblicazione: (2024)
di: Ramesh, Samarth N, et al.
Pubblicazione: (2024)
Spectrum-Aware Parameter Efficient Fine-Tuning for Diffusion Models
di: Zhang, Xinxi, et al.
Pubblicazione: (2024)
di: Zhang, Xinxi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Towards Efficient Large Vision-Language Models: A Comprehensive Survey on Inference Strategies
di: Pathak, Surendra, et al.
Pubblicazione: (2026) -
Ensembling Pruned Attention Heads For Uncertainty-Aware Efficient Transformers
di: Gabetni, Firas, et al.
Pubblicazione: (2025) -
Rényi Attention Entropy for Patch Pruning
di: Aizawa, Hiroaki, et al.
Pubblicazione: (2026) -
CAPA: Contribution-Aware Pruning and FFN Approximation for Efficient Large Vision-Language Models
di: Jha, Samyak, et al.
Pubblicazione: (2026) -
Structured Model Pruning for Efficient Inference in Computational Pathology
di: Adnan, Mohammed, et al.
Pubblicazione: (2024)