Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier
Fuente:
arXiv
Guardado en:
| Autores principales: | Badrinath, Anirudhan, Agarwal, Prabhat, Xu, Jiajing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Beyond Preferences in AI Alignment
por: Zhi-Xuan, Tan, et al.
Publicado: (2024)
por: Zhi-Xuan, Tan, et al.
Publicado: (2024)
Strong Preferences Affect the Robustness of Preference Models and Value Alignment
por: Xu, Ziwei, et al.
Publicado: (2024)
por: Xu, Ziwei, et al.
Publicado: (2024)
Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization
por: Zhou, Zhanhui, et al.
Publicado: (2023)
por: Zhou, Zhanhui, et al.
Publicado: (2023)
On Diversified Preferences of Large Language Model Alignment
por: Zeng, Dun, et al.
Publicado: (2023)
por: Zeng, Dun, et al.
Publicado: (2023)
Generalized Preference Optimization: A Unified Approach to Offline Alignment
por: Tang, Yunhao, et al.
Publicado: (2024)
por: Tang, Yunhao, et al.
Publicado: (2024)
PinRec: Outcome-Conditioned, Multi-Token Generative Retrieval for Industry-Scale Recommendation Systems
por: Agarwal, Prabhat, et al.
Publicado: (2025)
por: Agarwal, Prabhat, et al.
Publicado: (2025)
Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment
por: Zhang, Yifan, et al.
Publicado: (2024)
por: Zhang, Yifan, et al.
Publicado: (2024)
Accelerated Preference Optimization for Large Language Model Alignment
por: He, Jiafan, et al.
Publicado: (2024)
por: He, Jiafan, et al.
Publicado: (2024)
Self-Play Preference Optimization for Language Model Alignment
por: Wu, Yue, et al.
Publicado: (2024)
por: Wu, Yue, et al.
Publicado: (2024)
pyBKT: An Accessible Python Library of Bayesian Knowledge Tracing Models
por: Badrinath, Anirudhan, et al.
Publicado: (2021)
por: Badrinath, Anirudhan, et al.
Publicado: (2021)
Preference Packing: Efficient Preference Optimization for Large Language Models
por: Cho, Jaekyung
Publicado: (2026)
por: Cho, Jaekyung
Publicado: (2026)
Beyond Under-Alignment: Atomic Preference Enhanced Factuality Tuning for Large Language Models
por: Yuan, Hongbang, et al.
Publicado: (2024)
por: Yuan, Hongbang, et al.
Publicado: (2024)
Replacing Parameters with Preferences: Federated Alignment of Heterogeneous Vision-Language Models
por: Lu, Shule, et al.
Publicado: (2026)
por: Lu, Shule, et al.
Publicado: (2026)
Replacing Parameters with Preferences: Federated Alignment of Heterogeneous Vision-Language Models
por: Lu, Shule, et al.
Publicado: (2026)
por: Lu, Shule, et al.
Publicado: (2026)
Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
por: Li, Jian, et al.
Publicado: (2024)
por: Li, Jian, et al.
Publicado: (2024)
Preference Ranking Optimization for Human Alignment
por: Song, Feifan, et al.
Publicado: (2023)
por: Song, Feifan, et al.
Publicado: (2023)
HPS: Hard Preference Sampling for Human Preference Alignment
por: Zou, Xiandong, et al.
Publicado: (2025)
por: Zou, Xiandong, et al.
Publicado: (2025)
Group Preference Optimization: Few-Shot Alignment of Large Language Models
por: Zhao, Siyan, et al.
Publicado: (2023)
por: Zhao, Siyan, et al.
Publicado: (2023)
Preference Alignment Improves Language Model-Based TTS
por: Tian, Jinchuan, et al.
Publicado: (2024)
por: Tian, Jinchuan, et al.
Publicado: (2024)
Beyond Pairs: Your Language Model is Secretly Optimizing a Preference Graph
por: Liu, Ning, et al.
Publicado: (2026)
por: Liu, Ning, et al.
Publicado: (2026)
Mitigating Preference Hacking in Policy Optimization with Pessimism
por: Gupta, Dhawal, et al.
Publicado: (2025)
por: Gupta, Dhawal, et al.
Publicado: (2025)
Beyond Ordinal Preferences: Why Alignment Needs Cardinal Human Feedback
por: Whitfill, Parker, et al.
Publicado: (2025)
por: Whitfill, Parker, et al.
Publicado: (2025)
OmniSage: Large Scale, Multi-Entity Heterogeneous Graph Representation Learning
por: Badrinath, Anirudhan, et al.
Publicado: (2025)
por: Badrinath, Anirudhan, et al.
Publicado: (2025)
OPERA: Automatic Offline Policy Evaluation with Re-weighted Aggregates of Multiple Estimators
por: Nie, Allen, et al.
Publicado: (2024)
por: Nie, Allen, et al.
Publicado: (2024)
Towards Robust Alignment of Language Models: Distributionally Robustifying Direct Preference Optimization
por: Wu, Junkang, et al.
Publicado: (2024)
por: Wu, Junkang, et al.
Publicado: (2024)
Preference Orchestrator: Prompt-Aware Multi-Objective Alignment for Large Language Models
por: Liu, Biao, et al.
Publicado: (2025)
por: Liu, Biao, et al.
Publicado: (2025)
SGDPO: Self-Guided Direct Preference Optimization for Language Model Alignment
por: Zhu, Wenqiao, et al.
Publicado: (2025)
por: Zhu, Wenqiao, et al.
Publicado: (2025)
Assessing and Mitigating Data Memorization Risks in Fine-Tuned Large Language Models
por: Ramakrishnan, Badrinath, et al.
Publicado: (2025)
por: Ramakrishnan, Badrinath, et al.
Publicado: (2025)
The Anatomy of Alignment: Decomposing Preference Optimization by Steering Sparse Features
por: Ferrao, Jeremias, et al.
Publicado: (2025)
por: Ferrao, Jeremias, et al.
Publicado: (2025)
Improving Safety Alignment via Balanced Direct Preference Optimization
por: Zhao, Shiji, et al.
Publicado: (2026)
por: Zhao, Shiji, et al.
Publicado: (2026)
Direct Preference Optimization with Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
por: Chidambaram, Keertana, et al.
Publicado: (2025)
por: Chidambaram, Keertana, et al.
Publicado: (2025)
Not All Preferences are What You Need for Post-Training: Selective Alignment Strategy for Preference Optimization
por: Dong, Zhijin
Publicado: (2025)
por: Dong, Zhijin
Publicado: (2025)
Beyond Compromise: Pareto-Lenient Consensus for Efficient Multi-Preference LLM Alignment
por: Tan, Renxuan, et al.
Publicado: (2026)
por: Tan, Renxuan, et al.
Publicado: (2026)
Meta-Aligner: Bidirectional Preference-Policy Optimization for Multi-Objective LLMs Alignment
por: Xu, Wenzhe, et al.
Publicado: (2026)
por: Xu, Wenzhe, et al.
Publicado: (2026)
LLMdoctor: Token-Level Flow-Guided Preference Optimization for Efficient Test-Time Alignment of Large Language Models
por: Shen, Tiesunlong, et al.
Publicado: (2026)
por: Shen, Tiesunlong, et al.
Publicado: (2026)
Robust LLM Alignment via Distributionally Robust Direct Preference Optimization
por: Xu, Zaiyan, et al.
Publicado: (2025)
por: Xu, Zaiyan, et al.
Publicado: (2025)
Self-Exploring Language Models: Active Preference Elicitation for Online Alignment
por: Zhang, Shenao, et al.
Publicado: (2024)
por: Zhang, Shenao, et al.
Publicado: (2024)
Human Alignment of Large Language Models through Online Preference Optimisation
por: Calandriello, Daniele, et al.
Publicado: (2024)
por: Calandriello, Daniele, et al.
Publicado: (2024)
Alignment Revisited: Are Large Language Models Consistent in Stated and Revealed Preferences?
por: Gu, Zhuojun, et al.
Publicado: (2025)
por: Gu, Zhuojun, et al.
Publicado: (2025)
RainbowPO: A Unified Framework for Combining Improvements in Preference Optimization
por: Zhao, Hanyang, et al.
Publicado: (2024)
por: Zhao, Hanyang, et al.
Publicado: (2024)
Ejemplares similares
-
Beyond Preferences in AI Alignment
por: Zhi-Xuan, Tan, et al.
Publicado: (2024) -
Strong Preferences Affect the Robustness of Preference Models and Value Alignment
por: Xu, Ziwei, et al.
Publicado: (2024) -
Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization
por: Zhou, Zhanhui, et al.
Publicado: (2023) -
On Diversified Preferences of Large Language Model Alignment
por: Zeng, Dun, et al.
Publicado: (2023) -
Generalized Preference Optimization: A Unified Approach to Offline Alignment
por: Tang, Yunhao, et al.
Publicado: (2024)