Enregistré dans:
| Auteurs principaux: | Pathak, Surendra, Han, Bo |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.14549 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Efficient Large Vision-Language Models: A Comprehensive Survey on Inference Strategies
par: Pathak, Surendra, et autres
Publié: (2026)
par: Pathak, Surendra, et autres
Publié: (2026)
Ensembling Pruned Attention Heads For Uncertainty-Aware Efficient Transformers
par: Gabetni, Firas, et autres
Publié: (2025)
par: Gabetni, Firas, et autres
Publié: (2025)
Rényi Attention Entropy for Patch Pruning
par: Aizawa, Hiroaki, et autres
Publié: (2026)
par: Aizawa, Hiroaki, et autres
Publié: (2026)
CAPA: Contribution-Aware Pruning and FFN Approximation for Efficient Large Vision-Language Models
par: Jha, Samyak, et autres
Publié: (2026)
par: Jha, Samyak, et autres
Publié: (2026)
Structured Model Pruning for Efficient Inference in Computational Pathology
par: Adnan, Mohammed, et autres
Publié: (2024)
par: Adnan, Mohammed, et autres
Publié: (2024)
Hybrid-Regularized Magnitude Pruning for Robust Federated Learning under Covariate Shift
par: Goksu, Ozgu, et autres
Publié: (2024)
par: Goksu, Ozgu, et autres
Publié: (2024)
PruneFuse: Efficient Data Selection via Weight Pruning and Network Fusion
par: Kousar, Humaira, et autres
Publié: (2026)
par: Kousar, Humaira, et autres
Publié: (2026)
ICE-Pruning: An Iterative Cost-Efficient Pruning Pipeline for Deep Neural Networks
par: Hu, Wenhao, et autres
Publié: (2025)
par: Hu, Wenhao, et autres
Publié: (2025)
Equivariant-Aware Structured Pruning for Efficient Edge Deployment: A Comprehensive Framework with Adaptive Fine-Tuning
par: Alnemari, Mohammed
Publié: (2025)
par: Alnemari, Mohammed
Publié: (2025)
Adaptive Sharpness-Aware Pruning for Robust Sparse Networks
par: Bair, Anna, et autres
Publié: (2023)
par: Bair, Anna, et autres
Publié: (2023)
Make Your LVLM KV Cache More Lightweight
par: Chen, Xihao, et autres
Publié: (2026)
par: Chen, Xihao, et autres
Publié: (2026)
VLM-Pruner: Buffering for Spatial Sparsity in an Efficient VLM Centrifugal Token Pruning Paradigm
par: Wu, Zhenkai, et autres
Publié: (2025)
par: Wu, Zhenkai, et autres
Publié: (2025)
Large-scale Dataset Pruning with Dynamic Uncertainty
par: He, Muyang, et autres
Publié: (2023)
par: He, Muyang, et autres
Publié: (2023)
NEURAL: Attention-Guided Pruning for Unified Multimodal Resource-Constrained Clinical Evaluation
par: Joshi, Devvrat, et autres
Publié: (2025)
par: Joshi, Devvrat, et autres
Publié: (2025)
QOC: Quantum On-Chip Training with Parameter Shift and Gradient Pruning
par: Wang, Hanrui, et autres
Publié: (2022)
par: Wang, Hanrui, et autres
Publié: (2022)
Aligned but Stereotypical? The Hidden Influence of System Prompts on Social Bias in LVLM-Based Text-to-Image Models
par: Park, NaHyeon, et autres
Publié: (2025)
par: Park, NaHyeon, et autres
Publié: (2025)
Interpretability-Aware Pruning for Efficient Medical Image Analysis
par: Malik, Nikita, et autres
Publié: (2025)
par: Malik, Nikita, et autres
Publié: (2025)
STAR: Stage-Wise Attention-Guided Token Reduction for Efficient Large Vision-Language Models Inference
par: Guo, Yichen, et autres
Publié: (2025)
par: Guo, Yichen, et autres
Publié: (2025)
Efficient Fine-Tuning and Concept Suppression for Pruned Diffusion Models
par: Shirkavand, Reza, et autres
Publié: (2024)
par: Shirkavand, Reza, et autres
Publié: (2024)
Domain-Inspired Sharpness-Aware Minimization Under Domain Shifts
par: Zhang, Ruipeng, et autres
Publié: (2024)
par: Zhang, Ruipeng, et autres
Publié: (2024)
LD-Pruner: Efficient Pruning of Latent Diffusion Models using Task-Agnostic Insights
par: Castells, Thibault, et autres
Publié: (2024)
par: Castells, Thibault, et autres
Publié: (2024)
Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
par: Zhao, Yaqi, et autres
Publié: (2024)
par: Zhao, Yaqi, et autres
Publié: (2024)
Fwd2Bot: LVLM Visual Token Compression with Double Forward Bottleneck
par: Bulat, Adrian, et autres
Publié: (2025)
par: Bulat, Adrian, et autres
Publié: (2025)
C-SWAP: Explainability-Aware Structured Pruning for Efficient Neural Networks Compression
par: Bauvin, Baptiste, et autres
Publié: (2025)
par: Bauvin, Baptiste, et autres
Publié: (2025)
AgilePruner: An Empirical Study of Attention and Diversity for Adaptive Visual Token Pruning in Large Vision-Language Models
par: Baek, Changwoo, et autres
Publié: (2026)
par: Baek, Changwoo, et autres
Publié: (2026)
Efficient Unstructured Pruning of Mamba State-Space Models for Resource-Constrained Environments
par: Shihab, Ibne Farabi, et autres
Publié: (2025)
par: Shihab, Ibne Farabi, et autres
Publié: (2025)
Multimodal-Guided Dynamic Dataset Pruning for Robust and Efficient Data-Centric Learning
par: Yang, Suorong, et autres
Publié: (2025)
par: Yang, Suorong, et autres
Publié: (2025)
OCCAM: Towards Cost-Efficient and Accuracy-Aware Classification Inference
par: Ding, Dujian, et autres
Publié: (2024)
par: Ding, Dujian, et autres
Publié: (2024)
Free$^2$Guide: Training-Free Text-to-Video Alignment using Image LVLM
par: Kim, Jaemin, et autres
Publié: (2024)
par: Kim, Jaemin, et autres
Publié: (2024)
CHAI: CacHe Attention Inference for text2video
par: Cherian, Joel Mathew, et autres
Publié: (2026)
par: Cherian, Joel Mathew, et autres
Publié: (2026)
Decay Pruning Method: Smooth Pruning With a Self-Rectifying Procedure
par: Yang, Minghao, et autres
Publié: (2024)
par: Yang, Minghao, et autres
Publié: (2024)
Efficient Vision-Language Reasoning via Adaptive Token Pruning
par: Li, Xue, et autres
Publié: (2025)
par: Li, Xue, et autres
Publié: (2025)
LoRAPrune: Structured Pruning Meets Low-Rank Parameter-Efficient Fine-Tuning
par: Zhang, Mingyang, et autres
Publié: (2023)
par: Zhang, Mingyang, et autres
Publié: (2023)
Uncertainty-Aware Subset Selection for Robust Visual Explainability under Distribution Shifts
par: Gupta, Madhav, et autres
Publié: (2025)
par: Gupta, Madhav, et autres
Publié: (2025)
CoreMatching: A Co-adaptive Sparse Inference Framework with Token and Neuron Pruning for Comprehensive Acceleration of Vision-Language Models
par: Wang, Qinsi, et autres
Publié: (2025)
par: Wang, Qinsi, et autres
Publié: (2025)
Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning
par: Zhang, Dingkun, et autres
Publié: (2026)
par: Zhang, Dingkun, et autres
Publié: (2026)
Mixture-of-Top-k Attention: Efficient Attention via Scalable Fast Weights
par: Wen, Qishuai, et autres
Publié: (2026)
par: Wen, Qishuai, et autres
Publié: (2026)
Is Complexity Required for Neural Network Pruning? A Case Study on Global Magnitude Pruning
par: Gupta, Manas, et autres
Publié: (2022)
par: Gupta, Manas, et autres
Publié: (2022)
Efficient Pruning of Text-to-Image Models: Insights from Pruning Stable Diffusion
par: Ramesh, Samarth N, et autres
Publié: (2024)
par: Ramesh, Samarth N, et autres
Publié: (2024)
Spectrum-Aware Parameter Efficient Fine-Tuning for Diffusion Models
par: Zhang, Xinxi, et autres
Publié: (2024)
par: Zhang, Xinxi, et autres
Publié: (2024)
Documents similaires
-
Towards Efficient Large Vision-Language Models: A Comprehensive Survey on Inference Strategies
par: Pathak, Surendra, et autres
Publié: (2026) -
Ensembling Pruned Attention Heads For Uncertainty-Aware Efficient Transformers
par: Gabetni, Firas, et autres
Publié: (2025) -
Rényi Attention Entropy for Patch Pruning
par: Aizawa, Hiroaki, et autres
Publié: (2026) -
CAPA: Contribution-Aware Pruning and FFN Approximation for Efficient Large Vision-Language Models
par: Jha, Samyak, et autres
Publié: (2026) -
Structured Model Pruning for Efficient Inference in Computational Pathology
par: Adnan, Mohammed, et autres
Publié: (2024)