SaLoRA: Safety-Alignment Preserved Low-Rank Adaptation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Mingjie, Si, Wai Man, Backes, Michael, Zhang, Yang, Wang, Yisen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Excessive Reasoning Attack on Reasoning LLMs
par: Si, Wai Man, et autres
Publié: (2025)
par: Si, Wai Man, et autres
Publié: (2025)
Pruning Unsafe Tickets: A Resource-Efficient Framework for Safer and More Robust LLMs
par: Si, Wai Man, et autres
Publié: (2026)
par: Si, Wai Man, et autres
Publié: (2026)
FlexLoRA: Entropy-Guided Flexible Low-Rank Adaptation
par: Liu, Muqing, et autres
Publié: (2026)
par: Liu, Muqing, et autres
Publié: (2026)
Finding and Reactivating Post-Trained LLMs' Hidden Safety Mechanisms
par: Li, Mingjie, et autres
Publié: (2026)
par: Li, Mingjie, et autres
Publié: (2026)
LoRA-GA: Low-Rank Adaptation with Gradient Approximation
par: Wang, Shaowen, et autres
Publié: (2024)
par: Wang, Shaowen, et autres
Publié: (2024)
C-LoRA: Continual Low-Rank Adaptation for Pre-trained Models
par: Zhang, Xin, et autres
Publié: (2025)
par: Zhang, Xin, et autres
Publié: (2025)
ScaLoRA: Optimally Scaled Low-Rank Adaptation for Efficient High-Rank Fine-Tuning
par: Zhang, Yilang, et autres
Publié: (2025)
par: Zhang, Yilang, et autres
Publié: (2025)
Flat-LoRA: Low-Rank Adaptation over a Flat Loss Landscape
par: Li, Tao, et autres
Publié: (2024)
par: Li, Tao, et autres
Publié: (2024)
Stable-LoRA: Stabilizing Feature Learning of Low-Rank Adaptation
par: Wu, Yize, et autres
Publié: (2026)
par: Wu, Yize, et autres
Publié: (2026)
MTL-LoRA: Low-Rank Adaptation for Multi-Task Learning
par: Yang, Yaming, et autres
Publié: (2024)
par: Yang, Yaming, et autres
Publié: (2024)
RefLoRA: Refactored Low-Rank Adaptation for Efficient Fine-Tuning of Large Models
par: Zhang, Yilang, et autres
Publié: (2025)
par: Zhang, Yilang, et autres
Publié: (2025)
SD-LoRA: Scalable Decoupled Low-Rank Adaptation for Class Incremental Learning
par: Wu, Yichen, et autres
Publié: (2025)
par: Wu, Yichen, et autres
Publié: (2025)
Advancing LLM Safe Alignment with Safety Representation Ranking
par: Du, Tianqi, et autres
Publié: (2025)
par: Du, Tianqi, et autres
Publié: (2025)
LoRA+: Efficient Low Rank Adaptation of Large Models
par: Hayou, Soufiane, et autres
Publié: (2024)
par: Hayou, Soufiane, et autres
Publié: (2024)
FinLoRA: Finetuning Quantized Financial Large Language Models Using Low-Rank Adaptation
par: Wang, Dannong, et autres
Publié: (2024)
par: Wang, Dannong, et autres
Publié: (2024)
iLoRA: Bayesian Low-Rank Adaptation with Latent Interaction Graphs for Microbiome Diagnosis
par: Song, Yang, et autres
Publié: (2026)
par: Song, Yang, et autres
Publié: (2026)
C-LoRA: Contextual Low-Rank Adaptation for Uncertainty Estimation in Large Language Models
par: Rahmati, Amir Hossein, et autres
Publié: (2025)
par: Rahmati, Amir Hossein, et autres
Publié: (2025)
TrustLoRA: Low-Rank Adaptation for Failure Detection under Out-of-distribution Data
par: Zhu, Fei, et autres
Publié: (2025)
par: Zhu, Fei, et autres
Publié: (2025)
TalkLoRA: Communication-Aware Mixture of Low-Rank Adaptation for Large Language Models
par: Mu, Lin, et autres
Publié: (2026)
par: Mu, Lin, et autres
Publié: (2026)
DropLoRA: Sparse Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
par: Zhang, Haojie
Publié: (2025)
par: Zhang, Haojie
Publié: (2025)
SBoRA: Low-Rank Adaptation with Regional Weight Updates
par: Po, Lai-Man, et autres
Publié: (2024)
par: Po, Lai-Man, et autres
Publié: (2024)
AltLoRA: Towards Better Gradient Approximation in Low-Rank Adaptation with Alternating Projections
par: Yu, Xin, et autres
Publié: (2025)
par: Yu, Xin, et autres
Publié: (2025)
SwitchLoRA: Switched Low-Rank Adaptation Can Learn Full-Rank Information
par: Zhou, Kaiye, et autres
Publié: (2024)
par: Zhou, Kaiye, et autres
Publié: (2024)
RepLoRA: Reparameterizing Low-Rank Adaptation via the Perspective of Mixture of Experts
par: Truong, Tuan, et autres
Publié: (2025)
par: Truong, Tuan, et autres
Publié: (2025)
AuroRA: Breaking Low-Rank Bottleneck of LoRA with Nonlinear Mapping
par: Dong, Haonan, et autres
Publié: (2025)
par: Dong, Haonan, et autres
Publié: (2025)
AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation
par: Liu, Ziyun, et autres
Publié: (2026)
par: Liu, Ziyun, et autres
Publié: (2026)
Bernoulli-LoRA: A Theoretical Framework for Randomized Low-Rank Adaptation
par: Sokolov, Igor, et autres
Publié: (2025)
par: Sokolov, Igor, et autres
Publié: (2025)
BaLoRA: Bayesian Low-Rank Adaptation of Large Scale Models
par: Coscia, Dario, et autres
Publié: (2026)
par: Coscia, Dario, et autres
Publié: (2026)
LoRA-DA: Data-Aware Initialization for Low-Rank Adaptation via Asymptotic Analysis
par: Zhang, Qingyue, et autres
Publié: (2025)
par: Zhang, Qingyue, et autres
Publié: (2025)
GraphLoRA: Structure-Aware Contrastive Low-Rank Adaptation for Cross-Graph Transfer Learning
par: Yang, Zhe-Rui, et autres
Publié: (2024)
par: Yang, Zhe-Rui, et autres
Publié: (2024)
Hybrid-LoRA: Bridging Full Fine-Tuning and Low-Rank Adaptation for Post-Training
par: Zhang, Chengqian, et autres
Publié: (2026)
par: Zhang, Chengqian, et autres
Publié: (2026)
G2LoRA: Gradient Orthogonal Low-Rank Adaptation Framework for Graph Continual Learning on Text-Attributed Graphs
par: Wang, Yuhan, et autres
Publié: (2026)
par: Wang, Yuhan, et autres
Publié: (2026)
InfLoRA: Interference-Free Low-Rank Adaptation for Continual Learning
par: Liang, Yan-Shuo, et autres
Publié: (2024)
par: Liang, Yan-Shuo, et autres
Publié: (2024)
AutoLoRA: Automatically Tuning Matrix Ranks in Low-Rank Adaptation Based on Meta Learning
par: Zhang, Ruiyi, et autres
Publié: (2024)
par: Zhang, Ruiyi, et autres
Publié: (2024)
D2-LoRA: A Synergistic Approach to Differential and Directional Low-Rank Adaptation
par: Fujisawa, Nozomu, et autres
Publié: (2026)
par: Fujisawa, Nozomu, et autres
Publié: (2026)
GraLoRA: Granular Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
par: Jung, Yeonjoon, et autres
Publié: (2025)
par: Jung, Yeonjoon, et autres
Publié: (2025)
HiP-LoRA: Budgeted Spectral Plasticity for Robust Low-Rank Adaptation
par: Chen, Lixian, et autres
Publié: (2026)
par: Chen, Lixian, et autres
Publié: (2026)
LoRA-XS: Low-Rank Adaptation with Extremely Small Number of Parameters
par: Bałazy, Klaudia, et autres
Publié: (2024)
par: Bałazy, Klaudia, et autres
Publié: (2024)
CTR-LoRA: Curvature-Aware and Trust-Region Guided Low-Rank Adaptation for Large Language Models
par: Wang, Zhuxuanzi, et autres
Publié: (2025)
par: Wang, Zhuxuanzi, et autres
Publié: (2025)
Safe Pruning LoRA: Robust Distance-Guided Pruning for Safety Alignment in Adaptation of LLMs
par: Ao, Shuang, et autres
Publié: (2025)
par: Ao, Shuang, et autres
Publié: (2025)
Documents similaires
-
Excessive Reasoning Attack on Reasoning LLMs
par: Si, Wai Man, et autres
Publié: (2025) -
Pruning Unsafe Tickets: A Resource-Efficient Framework for Safer and More Robust LLMs
par: Si, Wai Man, et autres
Publié: (2026) -
FlexLoRA: Entropy-Guided Flexible Low-Rank Adaptation
par: Liu, Muqing, et autres
Publié: (2026) -
Finding and Reactivating Post-Trained LLMs' Hidden Safety Mechanisms
par: Li, Mingjie, et autres
Publié: (2026) -
LoRA-GA: Low-Rank Adaptation with Gradient Approximation
par: Wang, Shaowen, et autres
Publié: (2024)