Guardado en:
| Autores principales: | Lu, Yining, Jiang, Meng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.06869 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Learning to Optimize Multi-Objective Alignment Through Dynamic Reward Weighting
por: Lu, Yining, et al.
Publicado: (2025)
por: Lu, Yining, et al.
Publicado: (2025)
OrthAlign: Orthogonal Subspace Decomposition for Non-Interfering Multi-Objective Alignment
por: Lin, Liang, et al.
Publicado: (2025)
por: Lin, Liang, et al.
Publicado: (2025)
Multi-Objective Alignment of Language Models for Personalized Psychotherapy
por: Beikzadeh, Mehrab, et al.
Publicado: (2026)
por: Beikzadeh, Mehrab, et al.
Publicado: (2026)
Robust Multi-Objective Preference Alignment with Online DPO
por: Gupta, Raghav, et al.
Publicado: (2025)
por: Gupta, Raghav, et al.
Publicado: (2025)
Pareto Multi-Objective Alignment for Language Models
por: He, Qiang, et al.
Publicado: (2025)
por: He, Qiang, et al.
Publicado: (2025)
Reward-free Alignment for Conflicting Objectives
por: Chen, Peter, et al.
Publicado: (2026)
por: Chen, Peter, et al.
Publicado: (2026)
Discovering Implicit Large Language Model Alignment Objectives
por: Chen, Edward, et al.
Publicado: (2026)
por: Chen, Edward, et al.
Publicado: (2026)
Self-Improvement Towards Pareto Optimality: Mitigating Preference Conflicts in Multi-Objective Alignment
por: Li, Moxin, et al.
Publicado: (2025)
por: Li, Moxin, et al.
Publicado: (2025)
The Alignment Auditor: A Bayesian Framework for Verifying and Refining LLM Objectives
por: Bou, Matthieu, et al.
Publicado: (2025)
por: Bou, Matthieu, et al.
Publicado: (2025)
Improving LLM Safety Alignment with Dual-Objective Optimization
por: Zhao, Xuandong, et al.
Publicado: (2025)
por: Zhao, Xuandong, et al.
Publicado: (2025)
One Model for All: Multi-Objective Controllable Language Models
por: He, Qiang, et al.
Publicado: (2026)
por: He, Qiang, et al.
Publicado: (2026)
Gradient-Adaptive Policy Optimization: Towards Multi-Objective Alignment of Large Language Models
por: Li, Chengao, et al.
Publicado: (2025)
por: Li, Chengao, et al.
Publicado: (2025)
Bradley-Terry and Multi-Objective Reward Modeling Are Complementary
por: Zhang, Zhiwei, et al.
Publicado: (2025)
por: Zhang, Zhiwei, et al.
Publicado: (2025)
Objective Matters: Fine-Tuning Objectives Shape Safety, Robustness, and Persona Drift
por: Vennemeyer, Daniel, et al.
Publicado: (2026)
por: Vennemeyer, Daniel, et al.
Publicado: (2026)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
por: Wang, Haoxiang, et al.
Publicado: (2024)
por: Wang, Haoxiang, et al.
Publicado: (2024)
GIFT: Reconciling Post-Training Objectives via Finite-Temperature Gibbs Initialization
por: Zhao, Zhengyang, et al.
Publicado: (2026)
por: Zhao, Zhengyang, et al.
Publicado: (2026)
Multi-Objective Large Language Model Unlearning
por: Pan, Zibin, et al.
Publicado: (2024)
por: Pan, Zibin, et al.
Publicado: (2024)
SABER: Uncovering Vulnerabilities in Safety Alignment via Cross-Layer Residual Connection
por: Joshi, Maithili, et al.
Publicado: (2025)
por: Joshi, Maithili, et al.
Publicado: (2025)
Interpretable Preferences via Multi-Objective Reward Modeling and Mixture-of-Experts
por: Wang, Haoxiang, et al.
Publicado: (2024)
por: Wang, Haoxiang, et al.
Publicado: (2024)
SAHOO: Safeguarded Alignment for High-Order Optimization Objectives in Recursive Self-Improvement
por: Sahoo, Subramanyam, et al.
Publicado: (2026)
por: Sahoo, Subramanyam, et al.
Publicado: (2026)
Blockwise Advantage Estimation for Multi-Objective RL with Verifiable Rewards
por: Pavlenko, Kirill, et al.
Publicado: (2026)
por: Pavlenko, Kirill, et al.
Publicado: (2026)
Multi-Objective and Mixed-Reward Reinforcement Learning via Reward-Decorrelated Policy Optimization
por: Bai, Yang, et al.
Publicado: (2026)
por: Bai, Yang, et al.
Publicado: (2026)
Drifting Objectives for Refining Discrete Diffusion Language Models
por: Oba, Daisuke, et al.
Publicado: (2026)
por: Oba, Daisuke, et al.
Publicado: (2026)
LLMAP: LLM-Assisted Multi-Objective Route Planning with User Preferences
por: Yuan, Liangqi, et al.
Publicado: (2025)
por: Yuan, Liangqi, et al.
Publicado: (2025)
RLP: Reinforcement as a Pretraining Objective
por: Hatamizadeh, Ali, et al.
Publicado: (2025)
por: Hatamizadeh, Ali, et al.
Publicado: (2025)
Reinforce-Ada: An Adaptive Sampling Framework under Non-linear RL Objectives
por: Xiong, Wei, et al.
Publicado: (2025)
por: Xiong, Wei, et al.
Publicado: (2025)
COS-DPO: Conditioned One-Shot Multi-Objective Fine-Tuning Framework
por: Ren, Yinuo, et al.
Publicado: (2024)
por: Ren, Yinuo, et al.
Publicado: (2024)
Conditional Language Policy: A General Framework for Steerable Multi-Objective Finetuning
por: Wang, Kaiwen, et al.
Publicado: (2024)
por: Wang, Kaiwen, et al.
Publicado: (2024)
Aligning the Objective of LLM-based Program Repair
por: Xu, Junjielong, et al.
Publicado: (2024)
por: Xu, Junjielong, et al.
Publicado: (2024)
EMORL: Ensemble Multi-Objective Reinforcement Learning for Efficient and Flexible LLM Fine-Tuning
por: Kong, Lingxiao, et al.
Publicado: (2025)
por: Kong, Lingxiao, et al.
Publicado: (2025)
Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search
por: Lu, Jialin, et al.
Publicado: (2026)
por: Lu, Jialin, et al.
Publicado: (2026)
Objective Metrics for Evaluating Large Language Models Using External Data Sources
por: Du, Haoze, et al.
Publicado: (2025)
por: Du, Haoze, et al.
Publicado: (2025)
On the Hidden Objective Biases of Group-based Reinforcement Learning
por: Fontana, Aleksandar, et al.
Publicado: (2026)
por: Fontana, Aleksandar, et al.
Publicado: (2026)
Adversarial Decoding: Generating Readable Documents for Adversarial Objectives
por: Zhang, Collin, et al.
Publicado: (2024)
por: Zhang, Collin, et al.
Publicado: (2024)
A Local Perturbation Theory for Cross-Domain Interference and Recovery in Multi-Domain RL
por: Yang, Lei, et al.
Publicado: (2026)
por: Yang, Lei, et al.
Publicado: (2026)
Evolutionary Multi-Objective Optimization of Large Language Model Prompts for Balancing Sentiments
por: Baumann, Jill, et al.
Publicado: (2024)
por: Baumann, Jill, et al.
Publicado: (2024)
Bone Soups: A Seek-and-Soup Model Merging Approach for Controllable Multi-Objective Generation
por: Xie, Guofu, et al.
Publicado: (2025)
por: Xie, Guofu, et al.
Publicado: (2025)
Multi-Objective Reinforcement Learning for Large Language Model Optimization: Visionary Perspective
por: Kong, Lingxiao, et al.
Publicado: (2025)
por: Kong, Lingxiao, et al.
Publicado: (2025)
AdvPrefix: An Objective for Nuanced LLM Jailbreaks
por: Zhu, Sicheng, et al.
Publicado: (2024)
por: Zhu, Sicheng, et al.
Publicado: (2024)
M3: A Multi-Task Mixed-Objective Learning Framework for Open-Domain Multi-Hop Dense Sentence Retrieval
por: Bai, Yang, et al.
Publicado: (2024)
por: Bai, Yang, et al.
Publicado: (2024)
Ejemplares similares
-
Learning to Optimize Multi-Objective Alignment Through Dynamic Reward Weighting
por: Lu, Yining, et al.
Publicado: (2025) -
OrthAlign: Orthogonal Subspace Decomposition for Non-Interfering Multi-Objective Alignment
por: Lin, Liang, et al.
Publicado: (2025) -
Multi-Objective Alignment of Language Models for Personalized Psychotherapy
por: Beikzadeh, Mehrab, et al.
Publicado: (2026) -
Robust Multi-Objective Preference Alignment with Online DPO
por: Gupta, Raghav, et al.
Publicado: (2025) -
Pareto Multi-Objective Alignment for Language Models
por: He, Qiang, et al.
Publicado: (2025)