Safe Pruning LoRA: Robust Distance-Guided Pruning for Safety Alignment in Adaptation of LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ao, Shuang, Dong, Yi, Hu, Jinwei, Ramchurn, Sarvapali |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
S3LoRA: Safe Spectral Sharpness-Guided Pruning in Adaptation of Agent Planner
par: Ao, Shuang, et autres
Publié: (2025)
par: Ao, Shuang, et autres
Publié: (2025)
PrunedLoRA: Robust Gradient-Based structured pruning for Low-rank Adaptation in Fine-tuning
par: Yu, Xin, et autres
Publié: (2025)
par: Yu, Xin, et autres
Publié: (2025)
R-LoRA: Randomized Multi-Head LoRA for Efficient Multi-Task Learning
par: Liu, Jinda, et autres
Publié: (2025)
par: Liu, Jinda, et autres
Publié: (2025)
Robust Federated Finetuning of LLMs via Alternating Optimization of LoRA
par: Chen, Shuangyi, et autres
Publié: (2025)
par: Chen, Shuangyi, et autres
Publié: (2025)
LoRA Done RITE: Robust Invariant Transformation Equilibration for LoRA Optimization
par: Yen, Jui-Nan, et autres
Publié: (2024)
par: Yen, Jui-Nan, et autres
Publié: (2024)
Activated LoRA: Fine-tuned LLMs for Intrinsics
par: Greenewald, Kristjan, et autres
Publié: (2025)
par: Greenewald, Kristjan, et autres
Publié: (2025)
IterIS: Iterative Inference-Solving Alignment for LoRA Merging
par: Chen, Hongxu, et autres
Publié: (2024)
par: Chen, Hongxu, et autres
Publié: (2024)
On-the-Fly Adaptation to Quantization: Configuration-Aware LoRA for Efficient Fine-Tuning of Quantized LLMs
par: Ye, Rongguang, et autres
Publié: (2025)
par: Ye, Rongguang, et autres
Publié: (2025)
Kron-LoRA: Hybrid Kronecker-LoRA Adapters for Scalable, Sustainable Fine-tuning
par: Shen, Yixin
Publié: (2025)
par: Shen, Yixin
Publié: (2025)
LoRA-Mixer: Coordinate Modular LoRA Experts Through Serial Attention Routing
par: Li, Wenbing, et autres
Publié: (2025)
par: Li, Wenbing, et autres
Publié: (2025)
ST-LoRA: Low-rank Adaptation for Spatio-Temporal Forecasting
par: Ruan, Weilin, et autres
Publié: (2024)
par: Ruan, Weilin, et autres
Publié: (2024)
Stable-LoRA: Stabilizing Feature Learning of Low-Rank Adaptation
par: Wu, Yize, et autres
Publié: (2026)
par: Wu, Yize, et autres
Publié: (2026)
SCALE-LoRA: Auditing Post-Retrieval LoRA Composition with Residual Merging and View Reliability
par: Zhou, Shuaipeng, et autres
Publié: (2026)
par: Zhou, Shuaipeng, et autres
Publié: (2026)
LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
par: Lee, Seungeon, et autres
Publié: (2025)
par: Lee, Seungeon, et autres
Publié: (2025)
CTR-LoRA: Curvature-Aware and Trust-Region Guided Low-Rank Adaptation for Large Language Models
par: Wang, Zhuxuanzi, et autres
Publié: (2025)
par: Wang, Zhuxuanzi, et autres
Publié: (2025)
Conditional LoRA Parameter Generation
par: Jin, Xiaolong, et autres
Publié: (2024)
par: Jin, Xiaolong, et autres
Publié: (2024)
S-LoRA: Serving Thousands of Concurrent LoRA Adapters
par: Sheng, Ying, et autres
Publié: (2023)
par: Sheng, Ying, et autres
Publié: (2023)
LoRA-Mini : Adaptation Matrices Decomposition and Selective Training
par: Singh, Ayush, et autres
Publié: (2024)
par: Singh, Ayush, et autres
Publié: (2024)
LoRA+: Efficient Low Rank Adaptation of Large Models
par: Hayou, Soufiane, et autres
Publié: (2024)
par: Hayou, Soufiane, et autres
Publié: (2024)
Rethinking LoRA for Data Heterogeneous Federated Learning: Subspace and State Alignment
par: Peng, Hongyi, et autres
Publié: (2026)
par: Peng, Hongyi, et autres
Publié: (2026)
SC-LoRA: Balancing Efficient Fine-tuning and Knowledge Preservation via Subspace-Constrained LoRA
par: Luo, Minrui, et autres
Publié: (2025)
par: Luo, Minrui, et autres
Publié: (2025)
FiLoRA: Focus-and-Ignore LoRA for Controllable Feature Reliance
par: Chung, Hyunsuk, et autres
Publié: (2026)
par: Chung, Hyunsuk, et autres
Publié: (2026)
LoRAFusion: Efficient LoRA Fine-Tuning for LLMs
par: Zhu, Zhanda, et autres
Publié: (2025)
par: Zhu, Zhanda, et autres
Publié: (2025)
A Note on LoRA
par: Fomenko, Vlad, et autres
Publié: (2024)
par: Fomenko, Vlad, et autres
Publié: (2024)
Mitigating Unintended Memorization with LoRA in Federated Learning for LLMs
par: Bossy, Thierry, et autres
Publié: (2025)
par: Bossy, Thierry, et autres
Publié: (2025)
LoRASuite: Efficient LoRA Adaptation Across Large Language Model Upgrades
par: Li, Yanan, et autres
Publié: (2025)
par: Li, Yanan, et autres
Publié: (2025)
Mechanistic Interpretability of LoRA-Adapted Language Models for Nuclear Reactor Safety Applications
par: Lee, Yoon Pyo
Publié: (2025)
par: Lee, Yoon Pyo
Publié: (2025)
MTL-LoRA: Low-Rank Adaptation for Multi-Task Learning
par: Yang, Yaming, et autres
Publié: (2024)
par: Yang, Yaming, et autres
Publié: (2024)
Computational Limits of Low-Rank Adaptation (LoRA) Fine-Tuning for Transformer Models
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2024)
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2024)
Semantic-guided LoRA Parameters Generation
par: Li, Miaoge, et autres
Publié: (2025)
par: Li, Miaoge, et autres
Publié: (2025)
Riemannian Optimization for LoRA on the Stiefel Manifold
par: Park, Juneyoung, et autres
Publié: (2025)
par: Park, Juneyoung, et autres
Publié: (2025)
Text-to-LoRA: Instant Transformer Adaption
par: Charakorn, Rujikorn, et autres
Publié: (2025)
par: Charakorn, Rujikorn, et autres
Publié: (2025)
Subliminal Learning is a LoRA Artifact
par: Nief, Todd, et autres
Publié: (2026)
par: Nief, Todd, et autres
Publié: (2026)
DAC-LoRA: Dynamic Adversarial Curriculum for Efficient and Robust Few-Shot Adaptation
par: Umrajkar, Ved
Publié: (2025)
par: Umrajkar, Ved
Publié: (2025)
AlignGuard-LoRA: Alignment-Preserving Fine-Tuning via Fisher-Guided Decomposition and Riemannian-Geodesic Collision Regularization
par: Das, Amitava, et autres
Publié: (2025)
par: Das, Amitava, et autres
Publié: (2025)
KD-LoRA: A Hybrid Approach to Efficient Fine-Tuning with LoRA and Knowledge Distillation
par: Azimi, Rambod, et autres
Publié: (2024)
par: Azimi, Rambod, et autres
Publié: (2024)
LoRA-drop: Efficient LoRA Parameter Pruning based on Output Evaluation
par: Zhou, Hongyun, et autres
Publié: (2024)
par: Zhou, Hongyun, et autres
Publié: (2024)
Origin Tracer: A Method for Detecting LoRA Fine-Tuning Origins in LLMs
par: Liang, Hongyu, et autres
Publié: (2025)
par: Liang, Hongyu, et autres
Publié: (2025)
HiLoRA: Adaptive Hierarchical LoRA Routing for Training-Free Domain Generalization
par: Han, Ziyi, et autres
Publié: (2025)
par: Han, Ziyi, et autres
Publié: (2025)
LoRA-DA: Data-Aware Initialization for Low-Rank Adaptation via Asymptotic Analysis
par: Zhang, Qingyue, et autres
Publié: (2025)
par: Zhang, Qingyue, et autres
Publié: (2025)
Documents similaires
-
S3LoRA: Safe Spectral Sharpness-Guided Pruning in Adaptation of Agent Planner
par: Ao, Shuang, et autres
Publié: (2025) -
PrunedLoRA: Robust Gradient-Based structured pruning for Low-rank Adaptation in Fine-tuning
par: Yu, Xin, et autres
Publié: (2025) -
R-LoRA: Randomized Multi-Head LoRA for Efficient Multi-Task Learning
par: Liu, Jinda, et autres
Publié: (2025) -
Robust Federated Finetuning of LLMs via Alternating Optimization of LoRA
par: Chen, Shuangyi, et autres
Publié: (2025) -
LoRA Done RITE: Robust Invariant Transformation Equilibration for LoRA Optimization
par: Yen, Jui-Nan, et autres
Publié: (2024)