BALF: Budgeted Activation-Aware Low-Rank Factorization for Fine-Tuning-Free Model Compression
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | González-Martínez, David |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Memory-Efficient Fine-Tuning via Low-Rank Activation Compression
par: Shi, Jiang-Xin, et autres
Publié: (2025)
par: Shi, Jiang-Xin, et autres
Publié: (2025)
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
par: Zhang, Longteng, et autres
Publié: (2026)
par: Zhang, Longteng, et autres
Publié: (2026)
Decentralized Low-Rank Fine-Tuning of Large Language Models
par: Ghiasvand, Sajjad, et autres
Publié: (2025)
par: Ghiasvand, Sajjad, et autres
Publié: (2025)
LOFT: Low-Rank Orthogonal Fine-Tuning via Task-Aware Support Selection
par: Zhao, Lanxin, et autres
Publié: (2026)
par: Zhao, Lanxin, et autres
Publié: (2026)
AFLoRA: Adaptive Federated Fine-Tuning of Large Language Models with Resource-Aware Low-Rank Adaption
par: Zhou, Yajie, et autres
Publié: (2025)
par: Zhou, Yajie, et autres
Publié: (2025)
Few-Shot Adversarial Low-Rank Fine-Tuning of Vision-Language Models
par: Ghiasvand, Sajjad, et autres
Publié: (2025)
par: Ghiasvand, Sajjad, et autres
Publié: (2025)
Probe-Free Low-Rank Activation Intervention
par: Jiang, Chonghe, et autres
Publié: (2025)
par: Jiang, Chonghe, et autres
Publié: (2025)
LoKO: Low-Rank Kalman Optimizer for Online Fine-Tuning of Large Models
par: Abdi, Hossein, et autres
Publié: (2024)
par: Abdi, Hossein, et autres
Publié: (2024)
NoRA: Nested Low-Rank Adaptation for Efficient Fine-Tuning Large Models
par: Lin, Cheng, et autres
Publié: (2024)
par: Lin, Cheng, et autres
Publié: (2024)
Low-Rank Curvature for Zeroth-Order Optimization in LLM Fine-Tuning
par: Seung, Hyunseok, et autres
Publié: (2025)
par: Seung, Hyunseok, et autres
Publié: (2025)
Budgeted Online Model Selection and Fine-Tuning via Federated Learning
par: Ghari, Pouya M., et autres
Publié: (2024)
par: Ghari, Pouya M., et autres
Publié: (2024)
Smooth Model Compression without Fine-Tuning
par: Runkel, Christina, et autres
Publié: (2025)
par: Runkel, Christina, et autres
Publié: (2025)
Sparse Gradient Compression for Fine-Tuning Large Language Models
par: Yang, David H., et autres
Publié: (2025)
par: Yang, David H., et autres
Publié: (2025)
A Stronger Mixture of Low-Rank Experts for Fine-Tuning Foundation Models
par: Sun, Mengyang, et autres
Publié: (2025)
par: Sun, Mengyang, et autres
Publié: (2025)
Transfer Learning in Physics-Informed Neural Networks: Full Fine-Tuning, Lightweight Fine-Tuning, and Low-Rank Adaptation
par: Wang, Yizheng, et autres
Publié: (2025)
par: Wang, Yizheng, et autres
Publié: (2025)
RefLoRA: Refactored Low-Rank Adaptation for Efficient Fine-Tuning of Large Models
par: Zhang, Yilang, et autres
Publié: (2025)
par: Zhang, Yilang, et autres
Publié: (2025)
ScaLoRA: Optimally Scaled Low-Rank Adaptation for Efficient High-Rank Fine-Tuning
par: Zhang, Yilang, et autres
Publié: (2025)
par: Zhang, Yilang, et autres
Publié: (2025)
On Catastrophic Forgetting in Low-Rank Decomposition-Based Parameter-Efficient Fine-Tuning
par: Ahmad, Muhammad, et autres
Publié: (2026)
par: Ahmad, Muhammad, et autres
Publié: (2026)
Ravan: Multi-Head Low-Rank Adaptation for Federated Fine-Tuning
par: Raje, Arian, et autres
Publié: (2025)
par: Raje, Arian, et autres
Publié: (2025)
Polynomial Expansion Rank Adaptation: Enhancing Low-Rank Fine-Tuning with High-Order Interactions
par: Zhang, Wenhao, et autres
Publié: (2026)
par: Zhang, Wenhao, et autres
Publié: (2026)
Lossless Model Compression via Joint Low-Rank Factorization Optimization
par: Zhang, Boyang, et autres
Publié: (2024)
par: Zhang, Boyang, et autres
Publié: (2024)
Scalable Variational Bayesian Fine-Tuning of LLMs via Orthogonalized Low-Rank Adapters
par: Xiang, Haotian, et autres
Publié: (2026)
par: Xiang, Haotian, et autres
Publié: (2026)
Activation-Informed Pareto-Guided Low-Rank Compression for Efficient LLM/VLM
par: Solgi, Ryan, et autres
Publié: (2025)
par: Solgi, Ryan, et autres
Publié: (2025)
Large Language Model Compression via the Nested Activation-Aware Decomposition
par: Lu, Jun, et autres
Publié: (2025)
par: Lu, Jun, et autres
Publié: (2025)
QR-LoRA: QR-Based Low-Rank Adaptation for Efficient Fine-Tuning of Large Language Models
par: Liang, Jessica, et autres
Publié: (2025)
par: Liang, Jessica, et autres
Publié: (2025)
Optimizing Fine-Tuning through Advanced Initialization Strategies for Low-Rank Adaptation
par: Xue, Yongfu
Publié: (2025)
par: Xue, Yongfu
Publié: (2025)
LoFT: Low-Rank Adaptation That Behaves Like Full Fine-Tuning
par: Tastan, Nurbek, et autres
Publié: (2025)
par: Tastan, Nurbek, et autres
Publié: (2025)
Joint Localization and Activation Editing for Low-Resource Fine-Tuning
par: Lai, Wen, et autres
Publié: (2025)
par: Lai, Wen, et autres
Publié: (2025)
Computational Limits of Low-Rank Adaptation (LoRA) Fine-Tuning for Transformer Models
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2024)
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2024)
Low-Rank Compression of Language Models via Differentiable Rank Selection
par: Sundrani, Sidhant, et autres
Publié: (2025)
par: Sundrani, Sidhant, et autres
Publié: (2025)
LANCE: Low Rank Activation Compression for Efficient On-Device Continual Learning
par: Apolinario, Marco Paul E., et autres
Publié: (2025)
par: Apolinario, Marco Paul E., et autres
Publié: (2025)
OjaKV: Context-Aware Online Low-Rank KV Cache Compression
par: Zhu, Yuxuan, et autres
Publié: (2025)
par: Zhu, Yuxuan, et autres
Publié: (2025)
Continual Gradient Low-Rank Projection Fine-Tuning for LLMs
par: Wang, Chenxu, et autres
Publié: (2025)
par: Wang, Chenxu, et autres
Publié: (2025)
DropLoRA: Sparse Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
par: Zhang, Haojie
Publié: (2025)
par: Zhang, Haojie
Publié: (2025)
GraLoRA: Granular Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
par: Jung, Yeonjoon, et autres
Publié: (2025)
par: Jung, Yeonjoon, et autres
Publié: (2025)
Signs Beat Floats: Low-Rank Double-Binary Adaptation for On-Device Fine-Tuning
par: Fujisawa, Yoshihiko, et autres
Publié: (2026)
par: Fujisawa, Yoshihiko, et autres
Publié: (2026)
FLoRA: Federated Fine-Tuning Large Language Models with Heterogeneous Low-Rank Adaptations
par: Wang, Ziyao, et autres
Publié: (2024)
par: Wang, Ziyao, et autres
Publié: (2024)
Constrained Edge AI Deployment: Fine-Tuning vs Distillation for LLM Compression
par: Sander, Jacob, et autres
Publié: (2025)
par: Sander, Jacob, et autres
Publié: (2025)
Capability-Guided Compression: Toward Interpretability-Aware Budget Allocation for Large Language Models
par: Gupta, Rishaank
Publié: (2026)
par: Gupta, Rishaank
Publié: (2026)
Hybrid-LoRA: Bridging Full Fine-Tuning and Low-Rank Adaptation for Post-Training
par: Zhang, Chengqian, et autres
Publié: (2026)
par: Zhang, Chengqian, et autres
Publié: (2026)
Documents similaires
-
Memory-Efficient Fine-Tuning via Low-Rank Activation Compression
par: Shi, Jiang-Xin, et autres
Publié: (2025) -
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
par: Zhang, Longteng, et autres
Publié: (2026) -
Decentralized Low-Rank Fine-Tuning of Large Language Models
par: Ghiasvand, Sajjad, et autres
Publié: (2025) -
LOFT: Low-Rank Orthogonal Fine-Tuning via Task-Aware Support Selection
par: Zhao, Lanxin, et autres
Publié: (2026) -
AFLoRA: Adaptive Federated Fine-Tuning of Large Language Models with Resource-Aware Low-Rank Adaption
par: Zhou, Yajie, et autres
Publié: (2025)