SALAAD: Sparse And Low-Rank Adaptation via ADMM for Large Language Model Inference
Fuente:
arXiv
Salvato in:
| Autori principali: | Ma, Hao, Bal, Melis Ilayda, Zhang, Liang, Li, Bingcong, He, Niao, Zeilinger, Melanie, Muehlebach, Michael |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ESLM: Risk-Averse Selective Language Modeling for Efficient Pretraining
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
Adversarial Training for Defense Against Label Poisoning Attacks
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
Stochastic Online Optimization for Cyber-Physical and Robotic Systems
di: Ma, Hao, et al.
Pubblicazione: (2024)
di: Ma, Hao, et al.
Pubblicazione: (2024)
PoLAR: Polar-Decomposed Low-Rank Adapter Representation
di: Lion, Kai, et al.
Pubblicazione: (2025)
di: Lion, Kai, et al.
Pubblicazione: (2025)
Zeroth-Order Optimization at the Edge of Stability
di: Song, Minhak, et al.
Pubblicazione: (2026)
di: Song, Minhak, et al.
Pubblicazione: (2026)
Low-Rank Adaptation Redux for Large Models
di: Li, Bingcong, et al.
Pubblicazione: (2026)
di: Li, Bingcong, et al.
Pubblicazione: (2026)
Primal Methods for Variational Inequality Problems with Functional Constraints
di: Zhang, Liang, et al.
Pubblicazione: (2024)
di: Zhang, Liang, et al.
Pubblicazione: (2024)
Zeroth-Order Optimization Finds Flat Minima
di: Zhang, Liang, et al.
Pubblicazione: (2025)
di: Zhang, Liang, et al.
Pubblicazione: (2025)
Implicit Regularization of Sharpness-Aware Minimization for Scale-Invariant Problems
di: Li, Bingcong, et al.
Pubblicazione: (2024)
di: Li, Bingcong, et al.
Pubblicazione: (2024)
RefLoRA: Refactored Low-Rank Adaptation for Efficient Fine-Tuning of Large Models
di: Zhang, Yilang, et al.
Pubblicazione: (2025)
di: Zhang, Yilang, et al.
Pubblicazione: (2025)
Distributed Event-Based Learning via ADMM
di: Er, Guner Dilsad, et al.
Pubblicazione: (2024)
di: Er, Guner Dilsad, et al.
Pubblicazione: (2024)
DPZero: Private Fine-Tuning of Language Models without Backpropagation
di: Zhang, Liang, et al.
Pubblicazione: (2023)
di: Zhang, Liang, et al.
Pubblicazione: (2023)
On the Benefits of Weight Normalization for Overparameterized Matrix Sensing
di: Wei, Yudong, et al.
Pubblicazione: (2025)
di: Wei, Yudong, et al.
Pubblicazione: (2025)
On the Crucial Role of Initialization for Matrix Factorization
di: Li, Bingcong, et al.
Pubblicazione: (2024)
di: Li, Bingcong, et al.
Pubblicazione: (2024)
Can RLHF be More Efficient with Imperfect Reward Models? A Policy Coverage Perspective
di: Huang, Jiawei, et al.
Pubblicazione: (2025)
di: Huang, Jiawei, et al.
Pubblicazione: (2025)
Dynamic Low-Rank Sparse Adaptation for Large Language Models
di: Huang, Weizhong, et al.
Pubblicazione: (2025)
di: Huang, Weizhong, et al.
Pubblicazione: (2025)
Scalable Variational Bayesian Fine-Tuning of LLMs via Orthogonalized Low-Rank Adapters
di: Xiang, Haotian, et al.
Pubblicazione: (2026)
di: Xiang, Haotian, et al.
Pubblicazione: (2026)
ANCRe: Adaptive Neural Connection Reassignment for Efficient Depth Scaling
di: Zhang, Yilang, et al.
Pubblicazione: (2026)
di: Zhang, Yilang, et al.
Pubblicazione: (2026)
Optimistic Games for Combinatorial Bayesian Optimization with Application to Protein Design
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2024)
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2024)
Muown: Row-Norm Control for Muon Optimization
di: Lion, Kai, et al.
Pubblicazione: (2026)
di: Lion, Kai, et al.
Pubblicazione: (2026)
Low Rank Tensor Completion via Adaptive ADMM
di: Führling, Niclas, et al.
Pubblicazione: (2026)
di: Führling, Niclas, et al.
Pubblicazione: (2026)
Constraint-Aware Diffusion Guidance for Robotics: Real-Time Obstacle Avoidance for Autonomous Racing
di: Ma, Hao, et al.
Pubblicazione: (2025)
di: Ma, Hao, et al.
Pubblicazione: (2025)
Scalable Bayesian Low-Rank Adaptation of Large Language Models via Stochastic Variational Subspace Inference
di: Samplawski, Colin, et al.
Pubblicazione: (2025)
di: Samplawski, Colin, et al.
Pubblicazione: (2025)
BLoB: Bayesian Low-Rank Adaptation by Backpropagation for Large Language Models
di: Wang, Yibin, et al.
Pubblicazione: (2024)
di: Wang, Yibin, et al.
Pubblicazione: (2024)
QR-LoRA: QR-Based Low-Rank Adaptation for Efficient Fine-Tuning of Large Language Models
di: Liang, Jessica, et al.
Pubblicazione: (2025)
di: Liang, Jessica, et al.
Pubblicazione: (2025)
A Convex Framework for Confounding Robust Inference
di: Ishikawa, Kei, et al.
Pubblicazione: (2023)
di: Ishikawa, Kei, et al.
Pubblicazione: (2023)
On Fairness of Low-Rank Adaptation of Large Models
di: Ding, Zhoujie, et al.
Pubblicazione: (2024)
di: Ding, Zhoujie, et al.
Pubblicazione: (2024)
TLoRA: Tri-Matrix Low-Rank Adaptation of Large Language Models
di: Islam, Tanvir
Pubblicazione: (2025)
di: Islam, Tanvir
Pubblicazione: (2025)
FLoRA: Federated Fine-Tuning Large Language Models with Heterogeneous Low-Rank Adaptations
di: Wang, Ziyao, et al.
Pubblicazione: (2024)
di: Wang, Ziyao, et al.
Pubblicazione: (2024)
ConMeZO: Adaptive Descent-Direction Sampling for Gradient-Free Finetuning of Large Language Models
di: Behric, Lejs Deen, et al.
Pubblicazione: (2025)
di: Behric, Lejs Deen, et al.
Pubblicazione: (2025)
Efficient Low Rank Attention for Long-Context Inference in Large Language Models
di: Li, Tenghui, et al.
Pubblicazione: (2025)
di: Li, Tenghui, et al.
Pubblicazione: (2025)
Lambda-Skip Connections: the architectural component that prevents Rank Collapse
di: Joseph, Federico Arangath, et al.
Pubblicazione: (2024)
di: Joseph, Federico Arangath, et al.
Pubblicazione: (2024)
Towards Federated Low-Rank Adaptation of Language Models with Rank Heterogeneity
di: Byun, Yuji, et al.
Pubblicazione: (2024)
di: Byun, Yuji, et al.
Pubblicazione: (2024)
Differentially Private Low-Rank Adaptation of Large Language Model Using Federated Learning
di: Liu, Xiao-Yang, et al.
Pubblicazione: (2023)
di: Liu, Xiao-Yang, et al.
Pubblicazione: (2023)
Efficient Diffusion Models under Nonconvex Equality and Inequality constraints via Landing
di: Jeon, Kijung, et al.
Pubblicazione: (2026)
di: Jeon, Kijung, et al.
Pubblicazione: (2026)
Route Sparse Autoencoder to Interpret Large Language Models
di: Shi, Wei, et al.
Pubblicazione: (2025)
di: Shi, Wei, et al.
Pubblicazione: (2025)
C-LoRA: Contextual Low-Rank Adaptation for Uncertainty Estimation in Large Language Models
di: Rahmati, Amir Hossein, et al.
Pubblicazione: (2025)
di: Rahmati, Amir Hossein, et al.
Pubblicazione: (2025)
C-LoRA: Continual Low-Rank Adaptation for Pre-trained Models
di: Zhang, Xin, et al.
Pubblicazione: (2025)
di: Zhang, Xin, et al.
Pubblicazione: (2025)
CTR-LoRA: Curvature-Aware and Trust-Region Guided Low-Rank Adaptation for Large Language Models
di: Wang, Zhuxuanzi, et al.
Pubblicazione: (2025)
di: Wang, Zhuxuanzi, et al.
Pubblicazione: (2025)
CoRA: Optimizing Low-Rank Adaptation with Common Subspace of Large Language Models
di: Xiao, Xiaojun, et al.
Pubblicazione: (2024)
di: Xiao, Xiaojun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ESLM: Risk-Averse Selective Language Modeling for Efficient Pretraining
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025) -
Adversarial Training for Defense Against Label Poisoning Attacks
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025) -
Stochastic Online Optimization for Cyber-Physical and Robotic Systems
di: Ma, Hao, et al.
Pubblicazione: (2024) -
PoLAR: Polar-Decomposed Low-Rank Adapter Representation
di: Lion, Kai, et al.
Pubblicazione: (2025) -
Zeroth-Order Optimization at the Edge of Stability
di: Song, Minhak, et al.
Pubblicazione: (2026)