A Shared Low-Rank Adaptation Approach to Personalized RLHF
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Renpu, Wang, Peng, Li, Donghao, Shen, Cong, Yang, Jing |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the Learn-to-Optimize Capabilities of Transformers in In-Context Sparse Recovery
par: Liu, Renpu, et autres
Publié: (2024)
par: Liu, Renpu, et autres
Publié: (2024)
Greedy Sampling Is Provably Efficient for RLHF
par: Wu, Di, et autres
Publié: (2025)
par: Wu, Di, et autres
Publié: (2025)
Mixture of Low Rank Adaptation with Partial Parameter Sharing for Time Series Forecasting
par: Pan, Licheng, et autres
Publié: (2025)
par: Pan, Licheng, et autres
Publié: (2025)
Efficient Multi-objective Prompt Optimization via Pure-exploration Bandits
par: Li, Donghao, et autres
Publié: (2026)
par: Li, Donghao, et autres
Publié: (2026)
$f$-Divergence Regularized RLHF: Two Tales of Sampling and Unified Analyses
par: Wu, Di, et autres
Publié: (2026)
par: Wu, Di, et autres
Publié: (2026)
The Primacy of Magnitude in Low-Rank Adaptation
par: Zhang, Zicheng, et autres
Publié: (2025)
par: Zhang, Zicheng, et autres
Publié: (2025)
Variational Low-Rank Adaptation Using IVON
par: Cong, Bai, et autres
Publié: (2024)
par: Cong, Bai, et autres
Publié: (2024)
Federated Representation Learning in the Under-Parameterized Regime
par: Liu, Renpu, et autres
Publié: (2024)
par: Liu, Renpu, et autres
Publié: (2024)
Strategic Over-Parameterization for Generalizable Low-Rank Adaptation
par: Gao, Jing, et autres
Publié: (2026)
par: Gao, Jing, et autres
Publié: (2026)
Mixture-of-Subspaces in Low-Rank Adaptation
par: Wu, Taiqiang, et autres
Publié: (2024)
par: Wu, Taiqiang, et autres
Publié: (2024)
Enhancing Parameter Efficiency and Generalization in Large-Scale Models: A Regularized and Masked Low-Rank Adaptation Approach
par: Mao, Yuzhu, et autres
Publié: (2024)
par: Mao, Yuzhu, et autres
Publié: (2024)
FedHL: Federated Learning for Heterogeneous Low-Rank Adaptation via Unbiased Aggregation
par: Peng, Zihao, et autres
Publié: (2025)
par: Peng, Zihao, et autres
Publié: (2025)
Circuit-Aware Reward Training: A Mechanistic Framework for Longtail Robustness in RLHF
par: Liu, Jing
Publié: (2025)
par: Liu, Jing
Publié: (2025)
RLHF from Heterogeneous Feedback via Personalization and Preference Aggregation
par: Park, Chanwoo, et autres
Publié: (2024)
par: Park, Chanwoo, et autres
Publié: (2024)
Energy-Structured Low-Rank Adaptation for Continual Learning
par: Li, Longhua, et autres
Publié: (2026)
par: Li, Longhua, et autres
Publié: (2026)
Compressible Dynamics in Deep Overparameterized Low-Rank Learning & Adaptation
par: Yaras, Can, et autres
Publié: (2024)
par: Yaras, Can, et autres
Publié: (2024)
Joint Tensor-Train Parameterization for Efficient and Expressive Low-Rank Adaptation
par: Qi, Jun, et autres
Publié: (2025)
par: Qi, Jun, et autres
Publié: (2025)
GraphLoRA: Structure-Aware Contrastive Low-Rank Adaptation for Cross-Graph Transfer Learning
par: Yang, Zhe-Rui, et autres
Publié: (2024)
par: Yang, Zhe-Rui, et autres
Publié: (2024)
MTL-LoRA: Low-Rank Adaptation for Multi-Task Learning
par: Yang, Yaming, et autres
Publié: (2024)
par: Yang, Yaming, et autres
Publié: (2024)
CoRA: Optimizing Low-Rank Adaptation with Common Subspace of Large Language Models
par: Xiao, Xiaojun, et autres
Publié: (2024)
par: Xiao, Xiaojun, et autres
Publié: (2024)
GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR
par: Zhang, Jiaying, et autres
Publié: (2026)
par: Zhang, Jiaying, et autres
Publié: (2026)
Polynomial Expansion Rank Adaptation: Enhancing Low-Rank Fine-Tuning with High-Order Interactions
par: Zhang, Wenhao, et autres
Publié: (2026)
par: Zhang, Wenhao, et autres
Publié: (2026)
Value-Incentivized Preference Optimization: A Unified Approach to Online and Offline RLHF
par: Cen, Shicong, et autres
Publié: (2024)
par: Cen, Shicong, et autres
Publié: (2024)
MoR: Mixture of Ranks for Low-Rank Adaptation Tuning
par: Tang, Chuanyu, et autres
Publié: (2024)
par: Tang, Chuanyu, et autres
Publié: (2024)
LoRA-DA: Data-Aware Initialization for Low-Rank Adaptation via Asymptotic Analysis
par: Zhang, Qingyue, et autres
Publié: (2025)
par: Zhang, Qingyue, et autres
Publié: (2025)
Few-Shot Concept Unlearning with Low Rank Adaptation
par: Shreyas, Udaya, et autres
Publié: (2025)
par: Shreyas, Udaya, et autres
Publié: (2025)
Low Tensor-Rank Adaptation of Kolmogorov--Arnold Networks
par: Gao, Yihang, et autres
Publié: (2025)
par: Gao, Yihang, et autres
Publié: (2025)
Stable-LoRA: Stabilizing Feature Learning of Low-Rank Adaptation
par: Wu, Yize, et autres
Publié: (2026)
par: Wu, Yize, et autres
Publié: (2026)
Boosting Deductive Reasoning with Step Signals In RLHF
par: Li, Jialian, et autres
Publié: (2024)
par: Li, Jialian, et autres
Publié: (2024)
OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework
par: Hu, Jian, et autres
Publié: (2024)
par: Hu, Jian, et autres
Publié: (2024)
A Robust Incomplete Multimodal Low-Rank Adaptation Approach for Emotion Recognition
par: Zhao, Xinkui, et autres
Publié: (2025)
par: Zhao, Xinkui, et autres
Publié: (2025)
On Fairness of Low-Rank Adaptation of Large Models
par: Ding, Zhoujie, et autres
Publié: (2024)
par: Ding, Zhoujie, et autres
Publié: (2024)
SBoRA: Low-Rank Adaptation with Regional Weight Updates
par: Po, Lai-Man, et autres
Publié: (2024)
par: Po, Lai-Man, et autres
Publié: (2024)
Low-Rank Adaptation for Foundation Models: A Comprehensive Review
par: Yang, Menglin, et autres
Publié: (2024)
par: Yang, Menglin, et autres
Publié: (2024)
Decoupling General and Personalized Knowledge in Federated Learning via Additive and Low-Rank Decomposition
par: Wu, Xinghao, et autres
Publié: (2024)
par: Wu, Xinghao, et autres
Publié: (2024)
The Expressive Power of Low-Rank Adaptation
par: Zeng, Yuchen, et autres
Publié: (2023)
par: Zeng, Yuchen, et autres
Publié: (2023)
GoRA: Gradient-driven Adaptive Low Rank Adaptation
par: He, Haonan, et autres
Publié: (2025)
par: He, Haonan, et autres
Publié: (2025)
iLoRA: Bayesian Low-Rank Adaptation with Latent Interaction Graphs for Microbiome Diagnosis
par: Song, Yang, et autres
Publié: (2026)
par: Song, Yang, et autres
Publié: (2026)
Policy Filtration for RLHF to Mitigate Noise in Reward Models
par: Zhang, Chuheng, et autres
Publié: (2024)
par: Zhang, Chuheng, et autres
Publié: (2024)
TalkLoRA: Communication-Aware Mixture of Low-Rank Adaptation for Large Language Models
par: Mu, Lin, et autres
Publié: (2026)
par: Mu, Lin, et autres
Publié: (2026)
Documents similaires
-
On the Learn-to-Optimize Capabilities of Transformers in In-Context Sparse Recovery
par: Liu, Renpu, et autres
Publié: (2024) -
Greedy Sampling Is Provably Efficient for RLHF
par: Wu, Di, et autres
Publié: (2025) -
Mixture of Low Rank Adaptation with Partial Parameter Sharing for Time Series Forecasting
par: Pan, Licheng, et autres
Publié: (2025) -
Efficient Multi-objective Prompt Optimization via Pure-exploration Bandits
par: Li, Donghao, et autres
Publié: (2026) -
$f$-Divergence Regularized RLHF: Two Tales of Sampling and Unified Analyses
par: Wu, Di, et autres
Publié: (2026)