LoRA-Drop: Temporal LoRA Decoding for Efficient LLM Inference
Fuente:
arXiv
Salvato in:
| Autori principali: | Rajabzadeh, Hossein, Dialameh, Maryam, Park, Chul B., Kim, Il-Min, Kwon, Hyock Ju |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Dual LoRA: Enhancing LoRA with Magnitude and Direction Updates
di: Xu, Yixing, et al.
Pubblicazione: (2025)
di: Xu, Yixing, et al.
Pubblicazione: (2025)
LoRA-drop: Efficient LoRA Parameter Pruning based on Output Evaluation
di: Zhou, Hongyun, et al.
Pubblicazione: (2024)
di: Zhou, Hongyun, et al.
Pubblicazione: (2024)
Vision as LoRA
di: Wang, Han, et al.
Pubblicazione: (2025)
di: Wang, Han, et al.
Pubblicazione: (2025)
Bayesian Mixture of Experts For Large Language Models
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
LoRA-PAR: A Flexible Dual-System LoRA Partitioning Approach to Efficient LLM Fine-Tuning
di: Huang, Yining, et al.
Pubblicazione: (2025)
di: Huang, Yining, et al.
Pubblicazione: (2025)
LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
di: Lee, Seungeon, et al.
Pubblicazione: (2025)
di: Lee, Seungeon, et al.
Pubblicazione: (2025)
LoRA-Leak: Membership Inference Attacks Against LoRA Fine-tuned Language Models
di: Ran, Delong, et al.
Pubblicazione: (2025)
di: Ran, Delong, et al.
Pubblicazione: (2025)
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
$D^2LoRA$: Data-Driven LoRA Initialization for Low Resource Tasks
di: SeraJ, Javad, et al.
Pubblicazione: (2025)
di: SeraJ, Javad, et al.
Pubblicazione: (2025)
QDyLoRA: Quantized Dynamic Low-Rank Adaptation for Efficient Large Language Model Tuning
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2024)
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2024)
KD-LoRA: A Hybrid Approach to Efficient Fine-Tuning with LoRA and Knowledge Distillation
di: Azimi, Rambod, et al.
Pubblicazione: (2024)
di: Azimi, Rambod, et al.
Pubblicazione: (2024)
LoRA Done RITE: Robust Invariant Transformation Equilibration for LoRA Optimization
di: Yen, Jui-Nan, et al.
Pubblicazione: (2024)
di: Yen, Jui-Nan, et al.
Pubblicazione: (2024)
CA-LoRA: Adapting Existing LoRA for Compressed LLMs to Enable Efficient Multi-Tasking on Personal Devices
di: Zhao, Weilin, et al.
Pubblicazione: (2023)
di: Zhao, Weilin, et al.
Pubblicazione: (2023)
HydraLoRA: An Asymmetric LoRA Architecture for Efficient Fine-Tuning
di: Tian, Chunlin, et al.
Pubblicazione: (2024)
di: Tian, Chunlin, et al.
Pubblicazione: (2024)
DR-LoRA: Dynamic Rank LoRA for Fine-Tuning Mixture-of-Experts Models
di: Deng, Guanzhi, et al.
Pubblicazione: (2026)
di: Deng, Guanzhi, et al.
Pubblicazione: (2026)
LoRA-Squeeze: Simple and Effective Post-Tuning and In-Tuning Compression of LoRA Modules
di: Vulić, Ivan, et al.
Pubblicazione: (2026)
di: Vulić, Ivan, et al.
Pubblicazione: (2026)
AFA-LoRA: Enabling Non-Linear Adaptations in LoRA with Activation Function Annealing
di: Li, Jiacheng, et al.
Pubblicazione: (2025)
di: Li, Jiacheng, et al.
Pubblicazione: (2025)
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
di: Xiao, Yicheng, et al.
Pubblicazione: (2025)
di: Xiao, Yicheng, et al.
Pubblicazione: (2025)
Mixture of LoRA Experts
di: Wu, Xun, et al.
Pubblicazione: (2024)
di: Wu, Xun, et al.
Pubblicazione: (2024)
A Note on LoRA
di: Fomenko, Vlad, et al.
Pubblicazione: (2024)
di: Fomenko, Vlad, et al.
Pubblicazione: (2024)
LLM Encoder vs. Decoder: Robust Detection of Chinese AI-Generated Text with LoRA
di: Jin, Houji, et al.
Pubblicazione: (2025)
di: Jin, Houji, et al.
Pubblicazione: (2025)
PeriodicLoRA: Breaking the Low-Rank Bottleneck in LoRA Optimization
di: Meng, Xiangdi, et al.
Pubblicazione: (2024)
di: Meng, Xiangdi, et al.
Pubblicazione: (2024)
LoraMap: Harnessing the Power of LoRA Connections
di: Park, Hyeryun, et al.
Pubblicazione: (2024)
di: Park, Hyeryun, et al.
Pubblicazione: (2024)
LoRA Soups: Merging LoRAs for Practical Skill Composition Tasks
di: Prabhakar, Akshara, et al.
Pubblicazione: (2024)
di: Prabhakar, Akshara, et al.
Pubblicazione: (2024)
Make LoRA Great Again: Boosting LoRA with Adaptive Singular Values and Mixture-of-Experts Optimization Alignment
di: Fan, Chenghao, et al.
Pubblicazione: (2025)
di: Fan, Chenghao, et al.
Pubblicazione: (2025)
TC-LoRA: Temporally Modulated Conditional LoRA for Adaptive Diffusion Control
di: Cho, Minkyoung, et al.
Pubblicazione: (2025)
di: Cho, Minkyoung, et al.
Pubblicazione: (2025)
Not All LoRA Parameters Are Essential: Insights on Inference Necessity
di: Chen, Guanhua, et al.
Pubblicazione: (2025)
di: Chen, Guanhua, et al.
Pubblicazione: (2025)
In-Context Meta LoRA Generation
di: Shao, Yihua, et al.
Pubblicazione: (2025)
di: Shao, Yihua, et al.
Pubblicazione: (2025)
AlphaLoRA: Assigning LoRA Experts Based on Layer Training Quality
di: Qing, Peijun, et al.
Pubblicazione: (2024)
di: Qing, Peijun, et al.
Pubblicazione: (2024)
Improving LoRA with Variational Learning
di: Cong, Bai, et al.
Pubblicazione: (2025)
di: Cong, Bai, et al.
Pubblicazione: (2025)
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
Budgeted LoRA: Distillation as Structured Compute Allocation for Efficient Inference
di: Sabry, Mohammed, et al.
Pubblicazione: (2026)
di: Sabry, Mohammed, et al.
Pubblicazione: (2026)
Sci-LoRA: Mixture of Scientific LoRAs for Cross-Domain Lay Paraphrasing
di: Cheng, Ming, et al.
Pubblicazione: (2025)
di: Cheng, Ming, et al.
Pubblicazione: (2025)
QuAILoRA: Quantization-Aware Initialization for LoRA
di: Lawton, Neal, et al.
Pubblicazione: (2024)
di: Lawton, Neal, et al.
Pubblicazione: (2024)
S-LoRA: Serving Thousands of Concurrent LoRA Adapters
di: Sheng, Ying, et al.
Pubblicazione: (2023)
di: Sheng, Ying, et al.
Pubblicazione: (2023)
FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation
di: Sathyavageeswaran, Ramakrishnan
Pubblicazione: (2026)
di: Sathyavageeswaran, Ramakrishnan
Pubblicazione: (2026)
Personalized LoRA for Human-Centered Text Understanding
di: Zhang, You, et al.
Pubblicazione: (2024)
di: Zhang, You, et al.
Pubblicazione: (2024)
Recover-to-Forget: Gradient Reconstruction from LoRA for Efficient LLM Unlearning
di: Liu, Yezi, et al.
Pubblicazione: (2025)
di: Liu, Yezi, et al.
Pubblicazione: (2025)
EMA-SAM: Exponential Moving-average for SAM-based PTMC Segmentation
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
The Impact of Initialization on LoRA Finetuning Dynamics
di: Hayou, Soufiane, et al.
Pubblicazione: (2024)
di: Hayou, Soufiane, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Dual LoRA: Enhancing LoRA with Magnitude and Direction Updates
di: Xu, Yixing, et al.
Pubblicazione: (2025) -
LoRA-drop: Efficient LoRA Parameter Pruning based on Output Evaluation
di: Zhou, Hongyun, et al.
Pubblicazione: (2024) -
Vision as LoRA
di: Wang, Han, et al.
Pubblicazione: (2025) -
Bayesian Mixture of Experts For Large Language Models
di: Dialameh, Maryam, et al.
Pubblicazione: (2025) -
LoRA-PAR: A Flexible Dual-System LoRA Partitioning Approach to Efficient LLM Fine-Tuning
di: Huang, Yining, et al.
Pubblicazione: (2025)