LoRAQuant: Mixed-Precision Quantization of LoRA to Ultra-Low Bits
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mirzaei, Amir Reza, Wen, Yuqiao, Cao, Yanshuai, Mou, Lili |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring Model Invariance with Discrete Search for Ultra-Low-Bit Quantization
par: Wen, Yuqiao, et autres
Publié: (2025)
par: Wen, Yuqiao, et autres
Publié: (2025)
Run LoRA Run: Faster and Lighter LoRA Implementations
par: Cherniuk, Daria, et autres
Publié: (2023)
par: Cherniuk, Daria, et autres
Publié: (2023)
S-LoRA: Serving Thousands of Concurrent LoRA Adapters
par: Sheng, Ying, et autres
Publié: (2023)
par: Sheng, Ying, et autres
Publié: (2023)
FALQON: Accelerating LoRA Fine-tuning with Low-Bit Floating-Point Arithmetic
par: Choi, Kanghyun, et autres
Publié: (2025)
par: Choi, Kanghyun, et autres
Publié: (2025)
QuAILoRA: Quantization-Aware Initialization for LoRA
par: Lawton, Neal, et autres
Publié: (2024)
par: Lawton, Neal, et autres
Publié: (2024)
Flora: Low-Rank Adapters Are Secretly Gradient Compressors
par: Hao, Yongchang, et autres
Publié: (2024)
par: Hao, Yongchang, et autres
Publié: (2024)
LowRA: Accurate and Efficient LoRA Fine-Tuning of LLMs under 2 Bits
par: Zhou, Zikai, et autres
Publié: (2025)
par: Zhou, Zikai, et autres
Publié: (2025)
CE-LoRA: Computation-Efficient LoRA Fine-Tuning for Language Models
par: Chen, Guanduo, et autres
Publié: (2025)
par: Chen, Guanduo, et autres
Publié: (2025)
LoRA Diffusion: Zero-Shot LoRA Synthesis for Diffusion Model Personalization
par: Smith, Ethan, et autres
Publié: (2024)
par: Smith, Ethan, et autres
Publié: (2024)
Block-Diagonal LoRA for Eliminating Communication Overhead in Tensor Parallel LoRA Serving
par: Wang, Xinyu, et autres
Publié: (2025)
par: Wang, Xinyu, et autres
Publié: (2025)
ALTO: Adaptive LoRA Tuning and Orchestration for Heterogeneous LoRA Training Workloads
par: Zuo, Jingwei, et autres
Publié: (2026)
par: Zuo, Jingwei, et autres
Publié: (2026)
LoRA-drop: Efficient LoRA Parameter Pruning based on Output Evaluation
par: Zhou, Hongyun, et autres
Publié: (2024)
par: Zhou, Hongyun, et autres
Publié: (2024)
LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
par: Lee, Seungeon, et autres
Publié: (2025)
par: Lee, Seungeon, et autres
Publié: (2025)
Cross-LoRA: A Data-Free LoRA Transfer Framework across Heterogeneous LLMs
par: Xia, Feifan, et autres
Publié: (2025)
par: Xia, Feifan, et autres
Publié: (2025)
Enhancing Aviation Communication Transcription: Fine-Tuning Distil-Whisper with LoRA
par: Mirzaei, Shokoufeh, et autres
Publié: (2025)
par: Mirzaei, Shokoufeh, et autres
Publié: (2025)
Kron-LoRA: Hybrid Kronecker-LoRA Adapters for Scalable, Sustainable Fine-tuning
par: Shen, Yixin
Publié: (2025)
par: Shen, Yixin
Publié: (2025)
R-LoRA: Randomized Multi-Head LoRA for Efficient Multi-Task Learning
par: Liu, Jinda, et autres
Publié: (2025)
par: Liu, Jinda, et autres
Publié: (2025)
AFA-LoRA: Enabling Non-Linear Adaptations in LoRA with Activation Function Annealing
par: Li, Jiacheng, et autres
Publié: (2025)
par: Li, Jiacheng, et autres
Publié: (2025)
LoRA-Mixer: Coordinate Modular LoRA Experts Through Serial Attention Routing
par: Li, Wenbing, et autres
Publié: (2025)
par: Li, Wenbing, et autres
Publié: (2025)
LoRA-FAIR: Federated LoRA Fine-Tuning with Aggregation and Initialization Refinement
par: Bian, Jieming, et autres
Publié: (2024)
par: Bian, Jieming, et autres
Publié: (2024)
LoRA Done RITE: Robust Invariant Transformation Equilibration for LoRA Optimization
par: Yen, Jui-Nan, et autres
Publié: (2024)
par: Yen, Jui-Nan, et autres
Publié: (2024)
Latent Space Factorization in LoRA
par: Kumar, Shashi, et autres
Publié: (2025)
par: Kumar, Shashi, et autres
Publié: (2025)
AuroRA: Breaking Low-Rank Bottleneck of LoRA with Nonlinear Mapping
par: Dong, Haonan, et autres
Publié: (2025)
par: Dong, Haonan, et autres
Publié: (2025)
Mixture of LoRA Experts
par: Wu, Xun, et autres
Publié: (2024)
par: Wu, Xun, et autres
Publié: (2024)
Accurate LoRA-Finetuning Quantization of LLMs via Information Retention
par: Qin, Haotong, et autres
Publié: (2024)
par: Qin, Haotong, et autres
Publié: (2024)
LoRA Soups: Merging LoRAs for Practical Skill Composition Tasks
par: Prabhakar, Akshara, et autres
Publié: (2024)
par: Prabhakar, Akshara, et autres
Publié: (2024)
LoRA-MME: Multi-Model Ensemble of LoRA-Tuned Encoders for Code Comment Classification
par: Haider, Md Akib, et autres
Publié: (2026)
par: Haider, Md Akib, et autres
Publié: (2026)
SCALE-LoRA: Auditing Post-Retrieval LoRA Composition with Residual Merging and View Reliability
par: Zhou, Shuaipeng, et autres
Publié: (2026)
par: Zhou, Shuaipeng, et autres
Publié: (2026)
PRoLoRA: Partial Rotation Empowers More Parameter-Efficient LoRA
par: Wang, Sheng, et autres
Publié: (2024)
par: Wang, Sheng, et autres
Publié: (2024)
A Note on LoRA
par: Fomenko, Vlad, et autres
Publié: (2024)
par: Fomenko, Vlad, et autres
Publié: (2024)
FiLoRA: Focus-and-Ignore LoRA for Controllable Feature Reliance
par: Chung, Hyunsuk, et autres
Publié: (2026)
par: Chung, Hyunsuk, et autres
Publié: (2026)
Conditional LoRA Parameter Generation
par: Jin, Xiaolong, et autres
Publié: (2024)
par: Jin, Xiaolong, et autres
Publié: (2024)
LoRACode: LoRA Adapters for Code Embeddings
par: Chaturvedi, Saumya, et autres
Publié: (2025)
par: Chaturvedi, Saumya, et autres
Publié: (2025)
LoRA-GA: Low-Rank Adaptation with Gradient Approximation
par: Wang, Shaowen, et autres
Publié: (2024)
par: Wang, Shaowen, et autres
Publié: (2024)
GPTQ-intrinsic LoRA: A Near-optimal Algorithm for Low-precision Quantization with Low-rank Adaptation
par: Zhang, Shihao, et autres
Publié: (2026)
par: Zhang, Shihao, et autres
Publié: (2026)
SC-LoRA: Balancing Efficient Fine-tuning and Knowledge Preservation via Subspace-Constrained LoRA
par: Luo, Minrui, et autres
Publié: (2025)
par: Luo, Minrui, et autres
Publié: (2025)
On the Convergence Rate of LoRA Gradient Descent
par: Mu, Siqiao, et autres
Publié: (2025)
par: Mu, Siqiao, et autres
Publié: (2025)
tLoRA: Efficient Multi-LoRA Training with Elastic Shared Super-Models
par: Li, Kevin, et autres
Publié: (2026)
par: Li, Kevin, et autres
Publié: (2026)
Sci-LoRA: Mixture of Scientific LoRAs for Cross-Domain Lay Paraphrasing
par: Cheng, Ming, et autres
Publié: (2025)
par: Cheng, Ming, et autres
Publié: (2025)
C-LoRA: Contextual Low-Rank Adaptation for Uncertainty Estimation in Large Language Models
par: Rahmati, Amir Hossein, et autres
Publié: (2025)
par: Rahmati, Amir Hossein, et autres
Publié: (2025)
Documents similaires
-
Exploring Model Invariance with Discrete Search for Ultra-Low-Bit Quantization
par: Wen, Yuqiao, et autres
Publié: (2025) -
Run LoRA Run: Faster and Lighter LoRA Implementations
par: Cherniuk, Daria, et autres
Publié: (2023) -
S-LoRA: Serving Thousands of Concurrent LoRA Adapters
par: Sheng, Ying, et autres
Publié: (2023) -
FALQON: Accelerating LoRA Fine-tuning with Low-Bit Floating-Point Arithmetic
par: Choi, Kanghyun, et autres
Publié: (2025) -
QuAILoRA: Quantization-Aware Initialization for LoRA
par: Lawton, Neal, et autres
Publié: (2024)