QDyLoRA: Quantized Dynamic Low-Rank Adaptation for Efficient Large Language Model Tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Rajabzadeh, Hossein, Valipour, Mojtaba, Zhu, Tianshu, Tahaei, Marzieh, Kwon, Hyock Ju, Ghodsi, Ali, Chen, Boxing, Rezagholizadeh, Mehdi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SortedNet: A Scalable and Generalized Framework for Training Modular Deep Neural Networks
di: Valipour, Mojtaba, et al.
Pubblicazione: (2023)
di: Valipour, Mojtaba, et al.
Pubblicazione: (2023)
Sorted LLaMA: Unlocking the Potential of Intermediate Layers of Large Language Models for Dynamic Inference
di: Kavehzadeh, Parsa, et al.
Pubblicazione: (2023)
di: Kavehzadeh, Parsa, et al.
Pubblicazione: (2023)
EchoAtt: Attend, Copy, then Adjust for More Efficient Large Language Models
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2024)
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2024)
LoRA-Drop: Temporal LoRA Decoding for Efficient LLM Inference
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2026)
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2026)
Balcony: A Lightweight Approach to Dynamic Inference of Generative Language Models
di: Jamialahmadi, Benyamin, et al.
Pubblicazione: (2025)
di: Jamialahmadi, Benyamin, et al.
Pubblicazione: (2025)
S2D: Sorted Speculative Decoding For More Efficient Deployment of Nested Large Language Models
di: Kavehzadeh, Parsa, et al.
Pubblicazione: (2024)
di: Kavehzadeh, Parsa, et al.
Pubblicazione: (2024)
EMA-SAM: Exponential Moving-average for SAM-based PTMC Segmentation
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
ECHO-LLaMA: Efficient Caching for High-Performance LLaMA Training
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
Bayesian Mixture of Experts For Large Language Models
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
DTRNet: Dynamic Token Routing Network to Reduce Quadratic Costs in Transformers
di: Sharma, Aman, et al.
Pubblicazione: (2025)
di: Sharma, Aman, et al.
Pubblicazione: (2025)
DualSwinUnet++: An Enhanced Swin-Unet Architecture With Dual Decoders For PTMC Segmentation
di: Dialameh, Maryam, et al.
Pubblicazione: (2024)
di: Dialameh, Maryam, et al.
Pubblicazione: (2024)
DropLoRA: Sparse Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
di: Zhang, Haojie
Pubblicazione: (2025)
di: Zhang, Haojie
Pubblicazione: (2025)
GraLoRA: Granular Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
di: Jung, Yeonjoon, et al.
Pubblicazione: (2025)
di: Jung, Yeonjoon, et al.
Pubblicazione: (2025)
ScaLoRA: Optimally Scaled Low-Rank Adaptation for Efficient High-Rank Fine-Tuning
di: Zhang, Yilang, et al.
Pubblicazione: (2025)
di: Zhang, Yilang, et al.
Pubblicazione: (2025)
LoRA+: Efficient Low Rank Adaptation of Large Models
di: Hayou, Soufiane, et al.
Pubblicazione: (2024)
di: Hayou, Soufiane, et al.
Pubblicazione: (2024)
Batch-Max: Higher LLM Throughput using Larger Batch Sizes and KV Cache Compression
di: Metel, Michael R., et al.
Pubblicazione: (2024)
di: Metel, Michael R., et al.
Pubblicazione: (2024)
ElaLoRA: Elastic & Learnable Low-Rank Adaptation for Efficient Model Fine-Tuning
di: Chang, Huandong, et al.
Pubblicazione: (2025)
di: Chang, Huandong, et al.
Pubblicazione: (2025)
TsqLoRA: Towards Sensitivity and Quality Low-Rank Adaptation for Efficient Fine-Tuning
di: Chen, Yu, et al.
Pubblicazione: (2025)
di: Chen, Yu, et al.
Pubblicazione: (2025)
RefLoRA: Refactored Low-Rank Adaptation for Efficient Fine-Tuning of Large Models
di: Zhang, Yilang, et al.
Pubblicazione: (2025)
di: Zhang, Yilang, et al.
Pubblicazione: (2025)
On-the-Fly Adaptation to Quantization: Configuration-Aware LoRA for Efficient Fine-Tuning of Quantized LLMs
di: Ye, Rongguang, et al.
Pubblicazione: (2025)
di: Ye, Rongguang, et al.
Pubblicazione: (2025)
ABM-LoRA: Activation Boundary Matching for Fast Convergence in Low-Rank Adaptation
di: Lee, Dongha, et al.
Pubblicazione: (2025)
di: Lee, Dongha, et al.
Pubblicazione: (2025)
On the importance of Data Scale in Pretraining Arabic Language Models
di: Ghaddar, Abbas, et al.
Pubblicazione: (2024)
di: Ghaddar, Abbas, et al.
Pubblicazione: (2024)
Computational Limits of Low-Rank Adaptation (LoRA) Fine-Tuning for Transformer Models
di: Hu, Jerry Yao-Chieh, et al.
Pubblicazione: (2024)
di: Hu, Jerry Yao-Chieh, et al.
Pubblicazione: (2024)
AutoLoRA: Automatically Tuning Matrix Ranks in Low-Rank Adaptation Based on Meta Learning
di: Zhang, Ruiyi, et al.
Pubblicazione: (2024)
di: Zhang, Ruiyi, et al.
Pubblicazione: (2024)
QR-LoRA: QR-Based Low-Rank Adaptation for Efficient Fine-Tuning of Large Language Models
di: Liang, Jessica, et al.
Pubblicazione: (2025)
di: Liang, Jessica, et al.
Pubblicazione: (2025)
FinLoRA: Finetuning Quantized Financial Large Language Models Using Low-Rank Adaptation
di: Wang, Dannong, et al.
Pubblicazione: (2024)
di: Wang, Dannong, et al.
Pubblicazione: (2024)
Hybrid-LoRA: Bridging Full Fine-Tuning and Low-Rank Adaptation for Post-Training
di: Zhang, Chengqian, et al.
Pubblicazione: (2026)
di: Zhang, Chengqian, et al.
Pubblicazione: (2026)
SCOUT: Toward Sub-Quadratic Attention via Segment Compression for Optimized Utility in Transformers
di: Jafari, Aref, et al.
Pubblicazione: (2025)
di: Jafari, Aref, et al.
Pubblicazione: (2025)
TriAdaptLoRA: Brain-Inspired Triangular Adaptive Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
di: Liang, Yao, et al.
Pubblicazione: (2025)
di: Liang, Yao, et al.
Pubblicazione: (2025)
Null-LoRA: Low-Rank Adaptation on Null Space
di: Zhang, Yi, et al.
Pubblicazione: (2025)
di: Zhang, Yi, et al.
Pubblicazione: (2025)
BeamLoRA: Beam-Constraint Low-Rank Adaptation
di: Gu, Naibin, et al.
Pubblicazione: (2025)
di: Gu, Naibin, et al.
Pubblicazione: (2025)
TensLoRA: Tensor Alternatives for Low-Rank Adaptation
di: Marmoret, Axel, et al.
Pubblicazione: (2025)
di: Marmoret, Axel, et al.
Pubblicazione: (2025)
LoRA-GA: Low-Rank Adaptation with Gradient Approximation
di: Wang, Shaowen, et al.
Pubblicazione: (2024)
di: Wang, Shaowen, et al.
Pubblicazione: (2024)
ID-LoRA: Efficient Low-Rank Adaptation Inspired by Matrix Interpolative Decomposition
di: Ma, Xindian, et al.
Pubblicazione: (2026)
di: Ma, Xindian, et al.
Pubblicazione: (2026)
FoRA: Fisher-orthogonal Rank Adaptation for Parameter-Efficient Fine-Tuning
di: Park, Juneyoung, et al.
Pubblicazione: (2026)
di: Park, Juneyoung, et al.
Pubblicazione: (2026)
C-LoRA: Contextual Low-Rank Adaptation for Uncertainty Estimation in Large Language Models
di: Rahmati, Amir Hossein, et al.
Pubblicazione: (2025)
di: Rahmati, Amir Hossein, et al.
Pubblicazione: (2025)
Localized LoRA: A Structured Low-Rank Approximation for Efficient Fine-Tuning
di: Barazandeh, Babak, et al.
Pubblicazione: (2025)
di: Barazandeh, Babak, et al.
Pubblicazione: (2025)
LoREnc: Low-Rank Encryption for Securing Foundation Models and LoRA Adapters
di: Ahn, Beomjin, et al.
Pubblicazione: (2026)
di: Ahn, Beomjin, et al.
Pubblicazione: (2026)
TalkLoRA: Low-Rank Adaptation for Speech-Driven Animation
di: Saunders, Jack, et al.
Pubblicazione: (2024)
di: Saunders, Jack, et al.
Pubblicazione: (2024)
Stable-LoRA: Stabilizing Feature Learning of Low-Rank Adaptation
di: Wu, Yize, et al.
Pubblicazione: (2026)
di: Wu, Yize, et al.
Pubblicazione: (2026)
Documenti analoghi
-
SortedNet: A Scalable and Generalized Framework for Training Modular Deep Neural Networks
di: Valipour, Mojtaba, et al.
Pubblicazione: (2023) -
Sorted LLaMA: Unlocking the Potential of Intermediate Layers of Large Language Models for Dynamic Inference
di: Kavehzadeh, Parsa, et al.
Pubblicazione: (2023) -
EchoAtt: Attend, Copy, then Adjust for More Efficient Large Language Models
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2024) -
LoRA-Drop: Temporal LoRA Decoding for Efficient LLM Inference
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2026) -
Balcony: A Lightweight Approach to Dynamic Inference of Generative Language Models
di: Jamialahmadi, Benyamin, et al.
Pubblicazione: (2025)