Projection Optimization: A General Framework for Multi-Objective and Multi-Group RLHF
Fuente:
arXiv
Saved in:
| Main Authors: | Xiong, Nuoya, Singh, Aarti |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Cooperative Multi-agent RL with Communication Constraints
by: Xiong, Nuoya, et al.
Published: (2026)
by: Xiong, Nuoya, et al.
Published: (2026)
Divide and Learn: Multi-Objective Combinatorial Optimization at Scale
by: Singh, Esha, et al.
Published: (2026)
by: Singh, Esha, et al.
Published: (2026)
In-Context Multi-Objective Optimization
by: Zhang, Xinyu, et al.
Published: (2025)
by: Zhang, Xinyu, et al.
Published: (2025)
A Unified Framework for Gradient Aggregation in Multi-Objective Optimization
by: Hu, Zeou, et al.
Published: (2026)
by: Hu, Zeou, et al.
Published: (2026)
Multi-Objective Multi-Fidelity Bayesian Optimization with Causal Priors
by: Hossen, Md Abir, et al.
Published: (2026)
by: Hossen, Md Abir, et al.
Published: (2026)
Generative Sequential Notification Optimization via Multi-Objective Decision Transformers
by: Ocejo, Borja, et al.
Published: (2025)
by: Ocejo, Borja, et al.
Published: (2025)
Non-Myopic Multi-Objective Bayesian Optimization
by: Belakaria, Syrine, et al.
Published: (2024)
by: Belakaria, Syrine, et al.
Published: (2024)
Regressing the Relative Future: Efficient Policy Optimization for Multi-turn RLHF
by: Gao, Zhaolin, et al.
Published: (2024)
by: Gao, Zhaolin, et al.
Published: (2024)
RLHF Workflow: From Reward Modeling to Online RLHF
by: Dong, Hanze, et al.
Published: (2024)
by: Dong, Hanze, et al.
Published: (2024)
Preference-Guided Diffusion for Multi-Objective Offline Optimization
by: Annadani, Yashas, et al.
Published: (2025)
by: Annadani, Yashas, et al.
Published: (2025)
Distributionally Robust Token Optimization in RLHF
by: Jin, Yeping, et al.
Published: (2026)
by: Jin, Yeping, et al.
Published: (2026)
PSMGD: Periodic Stochastic Multi-Gradient Descent for Fast Multi-Objective Optimization
by: Xu, Mingjing, et al.
Published: (2024)
by: Xu, Mingjing, et al.
Published: (2024)
Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
by: Gu, Shangding, et al.
Published: (2024)
by: Gu, Shangding, et al.
Published: (2024)
Jacobian Descent for Multi-Objective Optimization
by: Quinton, Pierre, et al.
Published: (2024)
by: Quinton, Pierre, et al.
Published: (2024)
Pareto-Conditioned Diffusion Models for Offline Multi-Objective Optimization
by: Shrestha, Jatan, et al.
Published: (2026)
by: Shrestha, Jatan, et al.
Published: (2026)
Expensive Multi-Objective Bayesian Optimization Based on Diffusion Models
by: Li, Bingdong, et al.
Published: (2024)
by: Li, Bingdong, et al.
Published: (2024)
Pareto Front-Diverse Batch Multi-Objective Bayesian Optimization
by: Ahmadianshalchi, Alaleh, et al.
Published: (2024)
by: Ahmadianshalchi, Alaleh, et al.
Published: (2024)
Evidence-Gated LLM Priors for Multi-Objective Bayesian Optimization
by: Chen, Jiangyu, et al.
Published: (2026)
by: Chen, Jiangyu, et al.
Published: (2026)
Offline Multi-Objective Optimization
by: Xue, Ke, et al.
Published: (2024)
by: Xue, Ke, et al.
Published: (2024)
An Offline Adaptation Framework for Constrained Multi-Objective Reinforcement Learning
by: Lin, Qian, et al.
Published: (2024)
by: Lin, Qian, et al.
Published: (2024)
Not Just RLHF: Why Alignment Alone Won't Fix Multi-Agent Sycophancy
by: Kumarappan, Adarsh, et al.
Published: (2026)
by: Kumarappan, Adarsh, et al.
Published: (2026)
Multi-Objective Optimization for Sparse Deep Multi-Task Learning
by: Hotegni, S. S., et al.
Published: (2023)
by: Hotegni, S. S., et al.
Published: (2023)
DPO Meets PPO: Reinforced Token Optimization for RLHF
by: Zhong, Han, et al.
Published: (2024)
by: Zhong, Han, et al.
Published: (2024)
MILLION: A General Multi-Objective Framework with Controllable Risk for Portfolio Management
by: Deng, Liwei, et al.
Published: (2024)
by: Deng, Liwei, et al.
Published: (2024)
Conditional Language Policy: A General Framework for Steerable Multi-Objective Finetuning
by: Wang, Kaiwen, et al.
Published: (2024)
by: Wang, Kaiwen, et al.
Published: (2024)
A Unifying Post-Processing Framework for Multi-Objective Learn-to-Defer Problems
by: Charusaie, Mohammad-Amin, et al.
Published: (2024)
by: Charusaie, Mohammad-Amin, et al.
Published: (2024)
OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework
by: Hu, Jian, et al.
Published: (2024)
by: Hu, Jian, et al.
Published: (2024)
A Theoretical Framework for Partially Observed Reward-States in RLHF
by: Kausik, Chinmaya, et al.
Published: (2024)
by: Kausik, Chinmaya, et al.
Published: (2024)
Over-the-Air Fair Federated Learning via Multi-Objective Optimization
by: Hamidi, Shayan Mohajer, et al.
Published: (2025)
by: Hamidi, Shayan Mohajer, et al.
Published: (2025)
Combining Multi-Objective Bayesian Optimization with Reinforcement Learning for TinyML
by: Deutel, Mark, et al.
Published: (2023)
by: Deutel, Mark, et al.
Published: (2023)
Context-aware Diversity Enhancement for Neural Multi-Objective Combinatorial Optimization
by: Lu, Yongfan, et al.
Published: (2024)
by: Lu, Yongfan, et al.
Published: (2024)
Interactive Hyperparameter Optimization in Multi-Objective Problems via Preference Learning
by: Giovanelli, Joseph, et al.
Published: (2023)
by: Giovanelli, Joseph, et al.
Published: (2023)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
by: Ji, Jiaming, et al.
Published: (2025)
by: Ji, Jiaming, et al.
Published: (2025)
Collaborative Expert LLMs Guided Multi-Objective Molecular Optimization
by: Yu, Jiajun, et al.
Published: (2025)
by: Yu, Jiajun, et al.
Published: (2025)
Robust Counterfactual Explanations under Model Multiplicity Using Multi-Objective Optimization
by: Kinjo, Keita
Published: (2025)
by: Kinjo, Keita
Published: (2025)
Multi-Objective Optimization for Privacy-Utility Balance in Differentially Private Federated Learning
by: Ranaweera, Kanishka, et al.
Published: (2025)
by: Ranaweera, Kanishka, et al.
Published: (2025)
Approximation of Box Decomposition Algorithm for Fast Hypervolume-Based Multi-Objective Optimization
by: Watanabe, Shuhei
Published: (2025)
by: Watanabe, Shuhei
Published: (2025)
C-MORAL: Controllable Multi-Objective Molecular Optimization with Reinforcement Alignment for LLMs
by: Gao, Rui, et al.
Published: (2026)
by: Gao, Rui, et al.
Published: (2026)
Meta-Aligner: Bidirectional Preference-Policy Optimization for Multi-Objective LLMs Alignment
by: Xu, Wenzhe, et al.
Published: (2026)
by: Xu, Wenzhe, et al.
Published: (2026)
Deep Multi-Objective Reinforcement Learning for Utility-Based Infrastructural Maintenance Optimization
by: van Remmerden, Jesse, et al.
Published: (2024)
by: van Remmerden, Jesse, et al.
Published: (2024)
Similar Items
-
Cooperative Multi-agent RL with Communication Constraints
by: Xiong, Nuoya, et al.
Published: (2026) -
Divide and Learn: Multi-Objective Combinatorial Optimization at Scale
by: Singh, Esha, et al.
Published: (2026) -
In-Context Multi-Objective Optimization
by: Zhang, Xinyu, et al.
Published: (2025) -
A Unified Framework for Gradient Aggregation in Multi-Objective Optimization
by: Hu, Zeou, et al.
Published: (2026) -
Multi-Objective Multi-Fidelity Bayesian Optimization with Causal Priors
by: Hossen, Md Abir, et al.
Published: (2026)