On the Convergence Rate of LoRA Gradient Descent
Fuente:
arXiv
Saved in:
| Main Authors: | Mu, Siqiao, Klabjan, Diego |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Descend or Rewind? Stochastic Gradient Descent Unlearning
by: Mu, Siqiao, et al.
Published: (2025)
by: Mu, Siqiao, et al.
Published: (2025)
On the Second-Order Convergence of Biased Policy Gradient Algorithms
by: Mu, Siqiao, et al.
Published: (2023)
by: Mu, Siqiao, et al.
Published: (2023)
Rank-Accuracy Trade-off for LoRA: A Gradient-Flow Analysis
by: Rushka, Michael, et al.
Published: (2026)
by: Rushka, Michael, et al.
Published: (2026)
Rewind-to-Delete: Certified Machine Unlearning for Nonconvex Functions
by: Mu, Siqiao, et al.
Published: (2024)
by: Mu, Siqiao, et al.
Published: (2024)
A Mirror Descent Perspective of Smoothed Sign Descent
by: Wang, Shuyang, et al.
Published: (2024)
by: Wang, Shuyang, et al.
Published: (2024)
Run LoRA Run: Faster and Lighter LoRA Implementations
by: Cherniuk, Daria, et al.
Published: (2023)
by: Cherniuk, Daria, et al.
Published: (2023)
Convergent Stochastic Training of Attention and Understanding LoRA
by: Sun, Zhengkai, et al.
Published: (2026)
by: Sun, Zhengkai, et al.
Published: (2026)
CE-LoRA: Computation-Efficient LoRA Fine-Tuning for Language Models
by: Chen, Guanduo, et al.
Published: (2025)
by: Chen, Guanduo, et al.
Published: (2025)
LoRA Diffusion: Zero-Shot LoRA Synthesis for Diffusion Model Personalization
by: Smith, Ethan, et al.
Published: (2024)
by: Smith, Ethan, et al.
Published: (2024)
Balanced LoRA: Removing Parameter Invariance to Accelerate Convergence
by: Castin, Valérie, et al.
Published: (2026)
by: Castin, Valérie, et al.
Published: (2026)
ALLoRA: Adaptive Learning Rate Mitigates LoRA Fatal Flaws
by: Huang, Hai, et al.
Published: (2024)
by: Huang, Hai, et al.
Published: (2024)
Block-Diagonal LoRA for Eliminating Communication Overhead in Tensor Parallel LoRA Serving
by: Wang, Xinyu, et al.
Published: (2025)
by: Wang, Xinyu, et al.
Published: (2025)
LoRA-GA: Low-Rank Adaptation with Gradient Approximation
by: Wang, Shaowen, et al.
Published: (2024)
by: Wang, Shaowen, et al.
Published: (2024)
S-LoRA: Serving Thousands of Concurrent LoRA Adapters
by: Sheng, Ying, et al.
Published: (2023)
by: Sheng, Ying, et al.
Published: (2023)
FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation
by: Sathyavageeswaran, Ramakrishnan
Published: (2026)
by: Sathyavageeswaran, Ramakrishnan
Published: (2026)
Uniform Spectral Growth and Convergence of Muon in LoRA-Style Matrix Factorization
by: Kang, Changmin, et al.
Published: (2026)
by: Kang, Changmin, et al.
Published: (2026)
LoRA-drop: Efficient LoRA Parameter Pruning based on Output Evaluation
by: Zhou, Hongyun, et al.
Published: (2024)
by: Zhou, Hongyun, et al.
Published: (2024)
Cross-LoRA: A Data-Free LoRA Transfer Framework across Heterogeneous LLMs
by: Xia, Feifan, et al.
Published: (2025)
by: Xia, Feifan, et al.
Published: (2025)
LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
by: Lee, Seungeon, et al.
Published: (2025)
by: Lee, Seungeon, et al.
Published: (2025)
Latent Space Factorization in LoRA
by: Kumar, Shashi, et al.
Published: (2025)
by: Kumar, Shashi, et al.
Published: (2025)
Kron-LoRA: Hybrid Kronecker-LoRA Adapters for Scalable, Sustainable Fine-tuning
by: Shen, Yixin
Published: (2025)
by: Shen, Yixin
Published: (2025)
R-LoRA: Randomized Multi-Head LoRA for Efficient Multi-Task Learning
by: Liu, Jinda, et al.
Published: (2025)
by: Liu, Jinda, et al.
Published: (2025)
AFA-LoRA: Enabling Non-Linear Adaptations in LoRA with Activation Function Annealing
by: Li, Jiacheng, et al.
Published: (2025)
by: Li, Jiacheng, et al.
Published: (2025)
LoRA-Mixer: Coordinate Modular LoRA Experts Through Serial Attention Routing
by: Li, Wenbing, et al.
Published: (2025)
by: Li, Wenbing, et al.
Published: (2025)
GEM-Style Constraints for PEFT with Dual Gradient Projection in LoRA
by: Tekmen, Brian, et al.
Published: (2026)
by: Tekmen, Brian, et al.
Published: (2026)
LoRA-FAIR: Federated LoRA Fine-Tuning with Aggregation and Initialization Refinement
by: Bian, Jieming, et al.
Published: (2024)
by: Bian, Jieming, et al.
Published: (2024)
LoRA Done RITE: Robust Invariant Transformation Equilibration for LoRA Optimization
by: Yen, Jui-Nan, et al.
Published: (2024)
by: Yen, Jui-Nan, et al.
Published: (2024)
Mixture of LoRA Experts
by: Wu, Xun, et al.
Published: (2024)
by: Wu, Xun, et al.
Published: (2024)
Convergence Analysis of Aggregation-Broadcast in LoRA-enabled Distributed Fine-Tuning
by: Chen, Xin, et al.
Published: (2025)
by: Chen, Xin, et al.
Published: (2025)
Divergence Results and Convergence of a Variance Reduced Version of ADAM
by: Wang, Ruiqi, et al.
Published: (2022)
by: Wang, Ruiqi, et al.
Published: (2022)
CopRA: A Progressive LoRA Training Strategy
by: Zhuang, Zhan, et al.
Published: (2024)
by: Zhuang, Zhan, et al.
Published: (2024)
LoRA-MME: Multi-Model Ensemble of LoRA-Tuned Encoders for Code Comment Classification
by: Haider, Md Akib, et al.
Published: (2026)
by: Haider, Md Akib, et al.
Published: (2026)
SCALE-LoRA: Auditing Post-Retrieval LoRA Composition with Residual Merging and View Reliability
by: Zhou, Shuaipeng, et al.
Published: (2026)
by: Zhou, Shuaipeng, et al.
Published: (2026)
A Note on LoRA
by: Fomenko, Vlad, et al.
Published: (2024)
by: Fomenko, Vlad, et al.
Published: (2024)
On the Convergence of Gradient Descent for Large Learning Rates
by: Crăciun, Alexandru, et al.
Published: (2024)
by: Crăciun, Alexandru, et al.
Published: (2024)
PRoLoRA: Partial Rotation Empowers More Parameter-Efficient LoRA
by: Wang, Sheng, et al.
Published: (2024)
by: Wang, Sheng, et al.
Published: (2024)
Recover-to-Forget: Gradient Reconstruction from LoRA for Efficient LLM Unlearning
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Conditional LoRA Parameter Generation
by: Jin, Xiaolong, et al.
Published: (2024)
by: Jin, Xiaolong, et al.
Published: (2024)
LoRA Soups: Merging LoRAs for Practical Skill Composition Tasks
by: Prabhakar, Akshara, et al.
Published: (2024)
by: Prabhakar, Akshara, et al.
Published: (2024)
LoRA-BAM: Input Filtering for Fine-tuned LLMs via Boxed Abstraction Monitors over LoRA Layers
by: Wu, Changshun, et al.
Published: (2025)
by: Wu, Changshun, et al.
Published: (2025)
Similar Items
-
Descend or Rewind? Stochastic Gradient Descent Unlearning
by: Mu, Siqiao, et al.
Published: (2025) -
On the Second-Order Convergence of Biased Policy Gradient Algorithms
by: Mu, Siqiao, et al.
Published: (2023) -
Rank-Accuracy Trade-off for LoRA: A Gradient-Flow Analysis
by: Rushka, Michael, et al.
Published: (2026) -
Rewind-to-Delete: Certified Machine Unlearning for Nonconvex Functions
by: Mu, Siqiao, et al.
Published: (2024) -
A Mirror Descent Perspective of Smoothed Sign Descent
by: Wang, Shuyang, et al.
Published: (2024)