MGAA: Multi-Granular Adaptive Allocation fof Low-Rank Compression of LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Guangyan, Tang, Yongqiang, Zhang, Wensheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models
di: Li, Guangyan, et al.
Pubblicazione: (2024)
di: Li, Guangyan, et al.
Pubblicazione: (2024)
PLAN: Proactive Low-Rank Allocation for Continual Learning
di: Wang, Xiequn, et al.
Pubblicazione: (2025)
di: Wang, Xiequn, et al.
Pubblicazione: (2025)
DeltaLLM: Compress LLMs with Low-Rank Deltas between Shared Weights
di: Mikaelyan, Liana, et al.
Pubblicazione: (2025)
di: Mikaelyan, Liana, et al.
Pubblicazione: (2025)
CALR: Corrective Adaptive Low-Rank Decomposition for Efficient Large Language Model Layer Compression
di: Kautsar, Muchammad Daniyal, et al.
Pubblicazione: (2025)
di: Kautsar, Muchammad Daniyal, et al.
Pubblicazione: (2025)
UniQL: Unified Quantization and Low-rank Compression for Adaptive Edge LLMs
di: Chiang, Hung-Yueh, et al.
Pubblicazione: (2025)
di: Chiang, Hung-Yueh, et al.
Pubblicazione: (2025)
Low-Rank Compression of Language Models via Differentiable Rank Selection
di: Sundrani, Sidhant, et al.
Pubblicazione: (2025)
di: Sundrani, Sidhant, et al.
Pubblicazione: (2025)
GraLoRA: Granular Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
di: Jung, Yeonjoon, et al.
Pubblicazione: (2025)
di: Jung, Yeonjoon, et al.
Pubblicazione: (2025)
LoRC: Low-Rank Compression for LLMs KV Cache with a Progressive Compression Strategy
di: Zhang, Rongzhi, et al.
Pubblicazione: (2024)
di: Zhang, Rongzhi, et al.
Pubblicazione: (2024)
Hierarchical Sparse Plus Low Rank Compression of LLM
di: Kumar, Pawan, et al.
Pubblicazione: (2025)
di: Kumar, Pawan, et al.
Pubblicazione: (2025)
Palu: Compressing KV-Cache with Low-Rank Projection
di: Chang, Chi-Chih, et al.
Pubblicazione: (2024)
di: Chang, Chi-Chih, et al.
Pubblicazione: (2024)
CoLA: Compute-Efficient Pre-Training of LLMs via Low-Rank Activation
di: Liu, Ziyue, et al.
Pubblicazione: (2025)
di: Liu, Ziyue, et al.
Pubblicazione: (2025)
Memory-Efficient Fine-Tuning via Low-Rank Activation Compression
di: Shi, Jiang-Xin, et al.
Pubblicazione: (2025)
di: Shi, Jiang-Xin, et al.
Pubblicazione: (2025)
Adaptive Budget Allocation for Orthogonal-Subspace Adapter Tuning in LLMs Continual Learning
di: Wan, Zhiyi, et al.
Pubblicazione: (2025)
di: Wan, Zhiyi, et al.
Pubblicazione: (2025)
IGU-LoRA: Adaptive Rank Allocation via Integrated Gradients and Uncertainty-Aware Scoring
di: Cui, Xuan, et al.
Pubblicazione: (2026)
di: Cui, Xuan, et al.
Pubblicazione: (2026)
ReCalKV: Low-Rank KV Cache Compression via Head Reordering and Offline Calibration
di: Yan, Xianglong, et al.
Pubblicazione: (2025)
di: Yan, Xianglong, et al.
Pubblicazione: (2025)
Decomposed Trust: Privacy, Adversarial Robustness, Ethics, and Fairness in Low-Rank LLMs
di: Asante, Daniel Agyei, et al.
Pubblicazione: (2025)
di: Asante, Daniel Agyei, et al.
Pubblicazione: (2025)
Lossless Model Compression via Joint Low-Rank Factorization Optimization
di: Zhang, Boyang, et al.
Pubblicazione: (2024)
di: Zhang, Boyang, et al.
Pubblicazione: (2024)
Lillama: Large Language Models Compression via Low-Rank Feature Distillation
di: Sy, Yaya, et al.
Pubblicazione: (2024)
di: Sy, Yaya, et al.
Pubblicazione: (2024)
D-QRELO: Training- and Data-Free Delta Compression for Large Language Models via Quantization and Residual Low-Rank Approximation
di: Li, Junlin, et al.
Pubblicazione: (2026)
di: Li, Junlin, et al.
Pubblicazione: (2026)
When Is Rank-1 Steering Cheap? Geometry, Granularity, and Budgeted Search
di: Robertson, John T., et al.
Pubblicazione: (2026)
di: Robertson, John T., et al.
Pubblicazione: (2026)
SLoPe: Double-Pruned Sparse Plus Lazy Low-Rank Adapter Pretraining of LLMs
di: Mozaffari, Mohammad, et al.
Pubblicazione: (2024)
di: Mozaffari, Mohammad, et al.
Pubblicazione: (2024)
The Primacy of Magnitude in Low-Rank Adaptation
di: Zhang, Zicheng, et al.
Pubblicazione: (2025)
di: Zhang, Zicheng, et al.
Pubblicazione: (2025)
Lotus: Efficient LLM Training by Randomized Low-Rank Gradient Projection with Adaptive Subspace Switching
di: Miao, Tianhao, et al.
Pubblicazione: (2026)
di: Miao, Tianhao, et al.
Pubblicazione: (2026)
Low-Rank Quantization-Aware Training for LLMs
di: Bondarenko, Yelysei, et al.
Pubblicazione: (2024)
di: Bondarenko, Yelysei, et al.
Pubblicazione: (2024)
Compressing Large Language Models using Low Rank and Low Precision Decomposition
di: Saha, Rajarshi, et al.
Pubblicazione: (2024)
di: Saha, Rajarshi, et al.
Pubblicazione: (2024)
Compressible Dynamics in Deep Overparameterized Low-Rank Learning & Adaptation
di: Yaras, Can, et al.
Pubblicazione: (2024)
di: Yaras, Can, et al.
Pubblicazione: (2024)
MoR: Mixture of Ranks for Low-Rank Adaptation Tuning
di: Tang, Chuanyu, et al.
Pubblicazione: (2024)
di: Tang, Chuanyu, et al.
Pubblicazione: (2024)
Polynomial Expansion Rank Adaptation: Enhancing Low-Rank Fine-Tuning with High-Order Interactions
di: Zhang, Wenhao, et al.
Pubblicazione: (2026)
di: Zhang, Wenhao, et al.
Pubblicazione: (2026)
ASFL: An Adaptive Model Splitting and Resource Allocation Framework for Split Federated Learning
di: Meng, Chuiyang, et al.
Pubblicazione: (2026)
di: Meng, Chuiyang, et al.
Pubblicazione: (2026)
MetaLoRA: Tensor-Enhanced Adaptive Low-Rank Fine-tuning
di: Wang, Maolin, et al.
Pubblicazione: (2025)
di: Wang, Maolin, et al.
Pubblicazione: (2025)
Empower Low-Altitude Economy: A Reliability-Aware Dynamic Weighting Allocation for Multi-modal UAV Beam Prediction
di: Li, Haojin, et al.
Pubblicazione: (2025)
di: Li, Haojin, et al.
Pubblicazione: (2025)
LoRMA: Low-Rank Multiplicative Adaptation for LLMs
di: Bihany, Harsh, et al.
Pubblicazione: (2025)
di: Bihany, Harsh, et al.
Pubblicazione: (2025)
DeLo: Dual Decomposed Low-Rank Experts Collaboration for Continual Missing Modality Learning
di: Liu, Xiwei, et al.
Pubblicazione: (2026)
di: Liu, Xiwei, et al.
Pubblicazione: (2026)
DGP: A Dual-Granularity Prompting Framework for Fraud Detection with Graph-Enhanced LLMs
di: Li, Yuan, et al.
Pubblicazione: (2025)
di: Li, Yuan, et al.
Pubblicazione: (2025)
Low-Rank Adapters Meet Neural Architecture Search for LLM Compression
di: Muñoz, J. Pablo, et al.
Pubblicazione: (2025)
di: Muñoz, J. Pablo, et al.
Pubblicazione: (2025)
Eigen Attention: Attention in Low-Rank Space for KV Cache Compression
di: Saxena, Utkarsh, et al.
Pubblicazione: (2024)
di: Saxena, Utkarsh, et al.
Pubblicazione: (2024)
Low-Rank Compression of Pretrained Models via Randomized Subspace Iteration
di: Pourkamali-Anaraki, Farhad
Pubblicazione: (2026)
di: Pourkamali-Anaraki, Farhad
Pubblicazione: (2026)
A Stronger Mixture of Low-Rank Experts for Fine-Tuning Foundation Models
di: Sun, Mengyang, et al.
Pubblicazione: (2025)
di: Sun, Mengyang, et al.
Pubblicazione: (2025)
Breaking the Blocks: Continuous Low-Rank Decomposed Scaling for Unified LLM Quantization and Adaptation
di: Tang, Pingzhi, et al.
Pubblicazione: (2026)
di: Tang, Pingzhi, et al.
Pubblicazione: (2026)
GaLore$+$: Boosting Low-Rank Adaptation for LLMs with Cross-Head Projection
di: Liao, Xutao, et al.
Pubblicazione: (2024)
di: Liao, Xutao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models
di: Li, Guangyan, et al.
Pubblicazione: (2024) -
PLAN: Proactive Low-Rank Allocation for Continual Learning
di: Wang, Xiequn, et al.
Pubblicazione: (2025) -
DeltaLLM: Compress LLMs with Low-Rank Deltas between Shared Weights
di: Mikaelyan, Liana, et al.
Pubblicazione: (2025) -
CALR: Corrective Adaptive Low-Rank Decomposition for Efficient Large Language Model Layer Compression
di: Kautsar, Muchammad Daniyal, et al.
Pubblicazione: (2025) -
UniQL: Unified Quantization and Low-rank Compression for Adaptive Edge LLMs
di: Chiang, Hung-Yueh, et al.
Pubblicazione: (2025)