Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Jun, Wang, Jue, Li, Huan, Shou, Lidan, Chen, Ke, You, Yang, Xie, Guiming, Gong, Xuejian, Zhou, Kunlong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HMI: Hierarchical Knowledge Management for Efficient Multi-Tenant Inference in Pretrained Language Models
par: Zhang, Jun, et autres
Publié: (2025)
par: Zhang, Jun, et autres
Publié: (2025)
Draft & Verify: Lossless Large Language Model Acceleration via Self-Speculative Decoding
par: Zhang, Jun, et autres
Publié: (2023)
par: Zhang, Jun, et autres
Publié: (2023)
AlphaLoRA: Assigning LoRA Experts Based on Layer Training Quality
par: Qing, Peijun, et autres
Publié: (2024)
par: Qing, Peijun, et autres
Publié: (2024)
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
par: Xiao, Yicheng, et autres
Publié: (2025)
par: Xiao, Yicheng, et autres
Publié: (2025)
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
par: Wang, Hanqing, et autres
Publié: (2024)
par: Wang, Hanqing, et autres
Publié: (2024)
LoRA-drop: Efficient LoRA Parameter Pruning based on Output Evaluation
par: Zhou, Hongyun, et autres
Publié: (2024)
par: Zhou, Hongyun, et autres
Publié: (2024)
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
par: Zhang, Yuxuan, et autres
Publié: (2024)
par: Zhang, Yuxuan, et autres
Publié: (2024)
LoRASuite: Efficient LoRA Adaptation Across Large Language Model Upgrades
par: Li, Yanan, et autres
Publié: (2025)
par: Li, Yanan, et autres
Publié: (2025)
LoRA-Drop: Temporal LoRA Decoding for Efficient LLM Inference
par: Rajabzadeh, Hossein, et autres
Publié: (2026)
par: Rajabzadeh, Hossein, et autres
Publié: (2026)
A Survey on LoRA of Large Language Models
par: Mao, Yuren, et autres
Publié: (2024)
par: Mao, Yuren, et autres
Publié: (2024)
LoRA-SP: Streamlined Partial Parameter Adaptation for Resource-Efficient Fine-Tuning of Large Language Models
par: Wu, Yichao, et autres
Publié: (2024)
par: Wu, Yichao, et autres
Publié: (2024)
LoRA+: Efficient Low Rank Adaptation of Large Models
par: Hayou, Soufiane, et autres
Publié: (2024)
par: Hayou, Soufiane, et autres
Publié: (2024)
MixLoRA: Enhancing Large Language Models Fine-Tuning with LoRA-based Mixture of Experts
par: Li, Dengchun, et autres
Publié: (2024)
par: Li, Dengchun, et autres
Publié: (2024)
MeteoRA: Multiple-tasks Embedded LoRA for Large Language Models
par: Xu, Jingwei, et autres
Publié: (2024)
par: Xu, Jingwei, et autres
Publié: (2024)
Dynamic Adaptation of LoRA Fine-Tuning for Efficient and Task-Specific Optimization of Large Language Models
par: Liao, Xiaoxuan, et autres
Publié: (2025)
par: Liao, Xiaoxuan, et autres
Publié: (2025)
AFA-LoRA: Enabling Non-Linear Adaptations in LoRA with Activation Function Annealing
par: Li, Jiacheng, et autres
Publié: (2025)
par: Li, Jiacheng, et autres
Publié: (2025)
LoRA-Mini : Adaptation Matrices Decomposition and Selective Training
par: Singh, Ayush, et autres
Publié: (2024)
par: Singh, Ayush, et autres
Publié: (2024)
STAR: Constraint LoRA with Dynamic Active Learning for Data-Efficient Fine-Tuning of Large Language Models
par: Zhang, Linhai, et autres
Publié: (2024)
par: Zhang, Linhai, et autres
Publié: (2024)
Efficient Inference for Large Vision-Language Models: Bottlenecks, Techniques, and Prospects
par: Zhang, Jun, et autres
Publié: (2026)
par: Zhang, Jun, et autres
Publié: (2026)
Dual LoRA: Enhancing LoRA with Magnitude and Direction Updates
par: Xu, Yixing, et autres
Publié: (2025)
par: Xu, Yixing, et autres
Publié: (2025)
MeTA-LoRA: Data-Efficient Multi-Task Fine-Tuning for Large Language Models
par: Cheng, Bo, et autres
Publié: (2025)
par: Cheng, Bo, et autres
Publié: (2025)
PLoP: Precise LoRA Placement for Efficient Finetuning of Large Models
par: Hayou, Soufiane, et autres
Publié: (2025)
par: Hayou, Soufiane, et autres
Publié: (2025)
CA-LoRA: Adapting Existing LoRA for Compressed LLMs to Enable Efficient Multi-Tasking on Personal Devices
par: Zhao, Weilin, et autres
Publié: (2023)
par: Zhao, Weilin, et autres
Publié: (2023)
Sci-LoRA: Mixture of Scientific LoRAs for Cross-Domain Lay Paraphrasing
par: Cheng, Ming, et autres
Publié: (2025)
par: Cheng, Ming, et autres
Publié: (2025)
LoRA-Guard: Parameter-Efficient Guardrail Adaptation for Content Moderation of Large Language Models
par: Elesedy, Hayder, et autres
Publié: (2024)
par: Elesedy, Hayder, et autres
Publié: (2024)
Assertion Detection Large Language Model In-context Learning LoRA Fine-tuning
par: Ji, Yuelyu, et autres
Publié: (2024)
par: Ji, Yuelyu, et autres
Publié: (2024)
LoRA-Whisper: Parameter-Efficient and Extensible Multilingual ASR
par: Song, Zheshu, et autres
Publié: (2024)
par: Song, Zheshu, et autres
Publié: (2024)
HydraLoRA: An Asymmetric LoRA Architecture for Efficient Fine-Tuning
par: Tian, Chunlin, et autres
Publié: (2024)
par: Tian, Chunlin, et autres
Publié: (2024)
KD-LoRA: A Hybrid Approach to Efficient Fine-Tuning with LoRA and Knowledge Distillation
par: Azimi, Rambod, et autres
Publié: (2024)
par: Azimi, Rambod, et autres
Publié: (2024)
Personalized LoRA for Human-Centered Text Understanding
par: Zhang, You, et autres
Publié: (2024)
par: Zhang, You, et autres
Publié: (2024)
OPLoRA: Orthogonal Projection LoRA Prevents Catastrophic Forgetting during Parameter-Efficient Fine-Tuning
par: Xiong, Yifeng, et autres
Publié: (2025)
par: Xiong, Yifeng, et autres
Publié: (2025)
RDP LoRA: Geometry-Driven Identification for Parameter-Efficient Adaptation in Large Language Models
par: Çelebi, Yusuf, et autres
Publié: (2026)
par: Çelebi, Yusuf, et autres
Publié: (2026)
LoRA-Leak: Membership Inference Attacks Against LoRA Fine-tuned Language Models
par: Ran, Delong, et autres
Publié: (2025)
par: Ran, Delong, et autres
Publié: (2025)
HyperAdaLoRA: Accelerating LoRA Rank Allocation During Training via Hypernetworks without Sacrificing Performance
par: Zhang, Hao, et autres
Publié: (2025)
par: Zhang, Hao, et autres
Publié: (2025)
Vision as LoRA
par: Wang, Han, et autres
Publié: (2025)
par: Wang, Han, et autres
Publié: (2025)
$D^2LoRA$: Data-Driven LoRA Initialization for Low Resource Tasks
par: SeraJ, Javad, et autres
Publié: (2025)
par: SeraJ, Javad, et autres
Publié: (2025)
LoRA-PAR: A Flexible Dual-System LoRA Partitioning Approach to Efficient LLM Fine-Tuning
par: Huang, Yining, et autres
Publié: (2025)
par: Huang, Yining, et autres
Publié: (2025)
LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
par: Lee, Seungeon, et autres
Publié: (2025)
par: Lee, Seungeon, et autres
Publié: (2025)
ILT-Iterative LoRA Training through Focus-Feedback-Fix for Multilingual Speech Recognition
par: Meng, Qingliang, et autres
Publié: (2025)
par: Meng, Qingliang, et autres
Publié: (2025)
Adapting Large Language Models to a Low-Resource Agglutinative Language: A Comparative Study of LoRA and QLoRA for Bashkir
par: Arabov, Mullosharaf K., et autres
Publié: (2026)
par: Arabov, Mullosharaf K., et autres
Publié: (2026)
Documents similaires
-
HMI: Hierarchical Knowledge Management for Efficient Multi-Tenant Inference in Pretrained Language Models
par: Zhang, Jun, et autres
Publié: (2025) -
Draft & Verify: Lossless Large Language Model Acceleration via Self-Speculative Decoding
par: Zhang, Jun, et autres
Publié: (2023) -
AlphaLoRA: Assigning LoRA Experts Based on Layer Training Quality
par: Qing, Peijun, et autres
Publié: (2024) -
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
par: Xiao, Yicheng, et autres
Publié: (2025) -
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
par: Wang, Hanqing, et autres
Publié: (2024)