Breaking the Blocks: Continuous Low-Rank Decomposed Scaling for Unified LLM Quantization and Adaptation
Fuente:
arXiv
Salvato in:
| Autori principali: | Tang, Pingzhi, Zhou, Ruijie, Meng, Fanxu, Pei, Wenjie, Zhang, Muhan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CLOVER: Cross-Layer Orthogonal Vectors Pruning and Fine-Tuning
di: Meng, Fanxu, et al.
Pubblicazione: (2024)
di: Meng, Fanxu, et al.
Pubblicazione: (2024)
MISA: Mixture of Indexer Sparse Attention for Long-Context LLM Inference
di: Zhou, Ruijie, et al.
Pubblicazione: (2026)
di: Zhou, Ruijie, et al.
Pubblicazione: (2026)
Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation
di: Tang, Pingzhi, et al.
Pubblicazione: (2026)
di: Tang, Pingzhi, et al.
Pubblicazione: (2026)
PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models
di: Meng, Fanxu, et al.
Pubblicazione: (2024)
di: Meng, Fanxu, et al.
Pubblicazione: (2024)
TransMLA: Multi-Head Latent Attention Is All You Need
di: Meng, Fanxu, et al.
Pubblicazione: (2025)
di: Meng, Fanxu, et al.
Pubblicazione: (2025)
HD-PiSSA: High-Rank Distributed Orthogonal Adaptation
di: Wang, Yiding, et al.
Pubblicazione: (2025)
di: Wang, Yiding, et al.
Pubblicazione: (2025)
TPLA: Tensor Parallel Latent Attention for Efficient Disaggregated Prefill and Decode Inference
di: Tang, Xiaojuan, et al.
Pubblicazione: (2025)
di: Tang, Xiaojuan, et al.
Pubblicazione: (2025)
LoRASuite: Efficient LoRA Adaptation Across Large Language Model Upgrades
di: Li, Yanan, et al.
Pubblicazione: (2025)
di: Li, Yanan, et al.
Pubblicazione: (2025)
HISA: Efficient Hierarchical Indexing for Fine-Grained Sparse Attention
di: Xu, Yufei, et al.
Pubblicazione: (2026)
di: Xu, Yufei, et al.
Pubblicazione: (2026)
GQLA: Group-Query Latent Attention for Hardware-Adaptive Large Language Model Decoding
di: Meng, Fanxu
Pubblicazione: (2026)
di: Meng, Fanxu
Pubblicazione: (2026)
DeLo: Dual Decomposed Low-Rank Experts Collaboration for Continual Missing Modality Learning
di: Liu, Xiwei, et al.
Pubblicazione: (2026)
di: Liu, Xiwei, et al.
Pubblicazione: (2026)
Training Acceleration of Low-Rank Decomposed Networks using Sequential Freezing and Rank Quantization
di: Hajimolahoseini, Habib, et al.
Pubblicazione: (2023)
di: Hajimolahoseini, Habib, et al.
Pubblicazione: (2023)
SDQ: Sparse Decomposed Quantization for LLM Inference
di: Jeong, Geonhwa, et al.
Pubblicazione: (2024)
di: Jeong, Geonhwa, et al.
Pubblicazione: (2024)
Why Do Some Inputs Break Low-Bit LLM Quantization?
di: Chang, Ting-Yun, et al.
Pubblicazione: (2025)
di: Chang, Ting-Yun, et al.
Pubblicazione: (2025)
Energy-Structured Low-Rank Adaptation for Continual Learning
di: Li, Longhua, et al.
Pubblicazione: (2026)
di: Li, Longhua, et al.
Pubblicazione: (2026)
Towards Unified Multi-task EEG Analysis with Low-Rank Adaptation
di: Dai, Sicheng, et al.
Pubblicazione: (2026)
di: Dai, Sicheng, et al.
Pubblicazione: (2026)
EDoRA: Efficient Weight-Decomposed Low-Rank Adaptation via Singular Value Decomposition
di: Nasiri, Hamid, et al.
Pubblicazione: (2025)
di: Nasiri, Hamid, et al.
Pubblicazione: (2025)
MoRA: On-the-fly Molecule-aware Low-Rank Adaptation Framework for LLM-based Multi-Modal Molecular Assistant
di: Yin, Tao, et al.
Pubblicazione: (2025)
di: Yin, Tao, et al.
Pubblicazione: (2025)
The Primacy of Magnitude in Low-Rank Adaptation
di: Zhang, Zicheng, et al.
Pubblicazione: (2025)
di: Zhang, Zicheng, et al.
Pubblicazione: (2025)
MoR: Mixture of Ranks for Low-Rank Adaptation Tuning
di: Tang, Chuanyu, et al.
Pubblicazione: (2024)
di: Tang, Chuanyu, et al.
Pubblicazione: (2024)
DL-QAT: Weight-Decomposed Low-Rank Quantization-Aware Training for Large Language Models
di: Ke, Wenjin, et al.
Pubblicazione: (2025)
di: Ke, Wenjin, et al.
Pubblicazione: (2025)
Decomposed Trust: Privacy, Adversarial Robustness, Ethics, and Fairness in Low-Rank LLMs
di: Asante, Daniel Agyei, et al.
Pubblicazione: (2025)
di: Asante, Daniel Agyei, et al.
Pubblicazione: (2025)
BaLoRA: Bayesian Low-Rank Adaptation of Large Scale Models
di: Coscia, Dario, et al.
Pubblicazione: (2026)
di: Coscia, Dario, et al.
Pubblicazione: (2026)
Mixture-of-Subspaces in Low-Rank Adaptation
di: Wu, Taiqiang, et al.
Pubblicazione: (2024)
di: Wu, Taiqiang, et al.
Pubblicazione: (2024)
Strategic Over-Parameterization for Generalizable Low-Rank Adaptation
di: Gao, Jing, et al.
Pubblicazione: (2026)
di: Gao, Jing, et al.
Pubblicazione: (2026)
Polynomial Expansion Rank Adaptation: Enhancing Low-Rank Fine-Tuning with High-Order Interactions
di: Zhang, Wenhao, et al.
Pubblicazione: (2026)
di: Zhang, Wenhao, et al.
Pubblicazione: (2026)
CoLA: Compute-Efficient Pre-Training of LLMs via Low-Rank Activation
di: Liu, Ziyue, et al.
Pubblicazione: (2025)
di: Liu, Ziyue, et al.
Pubblicazione: (2025)
PoLAR: Polar-Decomposed Low-Rank Adapter Representation
di: Lion, Kai, et al.
Pubblicazione: (2025)
di: Lion, Kai, et al.
Pubblicazione: (2025)
iLoRA: Bayesian Low-Rank Adaptation with Latent Interaction Graphs for Microbiome Diagnosis
di: Song, Yang, et al.
Pubblicazione: (2026)
di: Song, Yang, et al.
Pubblicazione: (2026)
LRQ: Optimizing Post-Training Quantization for Large Language Models by Learning Low-Rank Weight-Scaling Matrices
di: Lee, Jung Hyun, et al.
Pubblicazione: (2024)
di: Lee, Jung Hyun, et al.
Pubblicazione: (2024)
GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR
di: Zhang, Jiaying, et al.
Pubblicazione: (2026)
di: Zhang, Jiaying, et al.
Pubblicazione: (2026)
RoRA: Efficient Fine-Tuning of LLM with Reliability Optimization for Rank Adaptation
di: Liu, Jun, et al.
Pubblicazione: (2025)
di: Liu, Jun, et al.
Pubblicazione: (2025)
PLAN: Proactive Low-Rank Allocation for Continual Learning
di: Wang, Xiequn, et al.
Pubblicazione: (2025)
di: Wang, Xiequn, et al.
Pubblicazione: (2025)
Few-Shot Concept Unlearning with Low Rank Adaptation
di: Shreyas, Udaya, et al.
Pubblicazione: (2025)
di: Shreyas, Udaya, et al.
Pubblicazione: (2025)
Low Tensor-Rank Adaptation of Kolmogorov--Arnold Networks
di: Gao, Yihang, et al.
Pubblicazione: (2025)
di: Gao, Yihang, et al.
Pubblicazione: (2025)
Low-Rank Adaptation for Foundation Models: A Comprehensive Review
di: Yang, Menglin, et al.
Pubblicazione: (2024)
di: Yang, Menglin, et al.
Pubblicazione: (2024)
Low-Rank Quantization-Aware Training for LLMs
di: Bondarenko, Yelysei, et al.
Pubblicazione: (2024)
di: Bondarenko, Yelysei, et al.
Pubblicazione: (2024)
CoLoR-GAN: Continual Few-Shot Learning with Low-Rank Adaptation in Generative Adversarial Networks
di: Ali, Munsif, et al.
Pubblicazione: (2025)
di: Ali, Munsif, et al.
Pubblicazione: (2025)
Enhancing Parameter Efficiency and Generalization in Large-Scale Models: A Regularized and Masked Low-Rank Adaptation Approach
di: Mao, Yuzhu, et al.
Pubblicazione: (2024)
di: Mao, Yuzhu, et al.
Pubblicazione: (2024)
DATA: Decomposed Attention-based Task Adaptation for Rehearsal-Free Continual Learning
di: Liao, Huanxuan, et al.
Pubblicazione: (2025)
di: Liao, Huanxuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
CLOVER: Cross-Layer Orthogonal Vectors Pruning and Fine-Tuning
di: Meng, Fanxu, et al.
Pubblicazione: (2024) -
MISA: Mixture of Indexer Sparse Attention for Long-Context LLM Inference
di: Zhou, Ruijie, et al.
Pubblicazione: (2026) -
Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation
di: Tang, Pingzhi, et al.
Pubblicazione: (2026) -
PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models
di: Meng, Fanxu, et al.
Pubblicazione: (2024) -
TransMLA: Multi-Head Latent Attention Is All You Need
di: Meng, Fanxu, et al.
Pubblicazione: (2025)