Data-Centric Human Preference with Rationales for Direct Preference Alignment
Fuente:
arXiv
Guardado en:
| Autores principales: | Just, Hoang Anh, Jin, Ming, Sahu, Anit, Phan, Huy, Jia, Ruoxi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
The Signal is in the Steps: Local Scoring for Reasoning Data Selection
por: Just, Hoang Anh, et al.
Publicado: (2025)
por: Just, Hoang Anh, et al.
Publicado: (2025)
Get more for less: Principled Data Selection for Warming Up Fine-Tuning in LLMs
por: Kang, Feiyang, et al.
Publicado: (2024)
por: Kang, Feiyang, et al.
Publicado: (2024)
DiPT: Enhancing LLM reasoning through diversified perspective-taking
por: Just, Hoang Anh, et al.
Publicado: (2024)
por: Just, Hoang Anh, et al.
Publicado: (2024)
Probing Knowledge Holes in Unlearned LLMs
por: Ko, Myeongseob, et al.
Publicado: (2025)
por: Ko, Myeongseob, et al.
Publicado: (2025)
Direct Preference Optimization for Primitive-Enabled Hierarchical RL: A Bilevel Approach
por: Singh, Utsav, et al.
Publicado: (2024)
por: Singh, Utsav, et al.
Publicado: (2024)
Direct Alignment with Heterogeneous Preferences
por: Shirali, Ali, et al.
Publicado: (2025)
por: Shirali, Ali, et al.
Publicado: (2025)
Data Selection for LLM Alignment Using Fine-Grained Preferences
por: Zhang, Jia, et al.
Publicado: (2025)
por: Zhang, Jia, et al.
Publicado: (2025)
Reward-Augmented Data Enhances Direct Preference Alignment of LLMs
por: Zhang, Shenao, et al.
Publicado: (2024)
por: Zhang, Shenao, et al.
Publicado: (2024)
Spread Preference Annotation: Direct Preference Judgment for Efficient LLM Alignment
por: Kim, Dongyoung, et al.
Publicado: (2024)
por: Kim, Dongyoung, et al.
Publicado: (2024)
Refined Direct Preference Optimization with Synthetic Data for Behavioral Alignment of LLMs
por: Gallego, Víctor
Publicado: (2024)
por: Gallego, Víctor
Publicado: (2024)
Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization
por: Zhou, Zhanhui, et al.
Publicado: (2023)
por: Zhou, Zhanhui, et al.
Publicado: (2023)
Direct Preference Optimization With Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
por: Chidambaram, Keertana, et al.
Publicado: (2024)
por: Chidambaram, Keertana, et al.
Publicado: (2024)
Provably Efficient Multi-Objective Bandit Algorithms under Preference-Centric Customization
por: Cao, Linfeng, et al.
Publicado: (2025)
por: Cao, Linfeng, et al.
Publicado: (2025)
Gradient Imbalance in Direct Preference Optimization
por: Ma, Qinwei, et al.
Publicado: (2025)
por: Ma, Qinwei, et al.
Publicado: (2025)
Preference Alignment with Flow Matching
por: Kim, Minu, et al.
Publicado: (2024)
por: Kim, Minu, et al.
Publicado: (2024)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
por: Wang, Haoxiang, et al.
Publicado: (2024)
por: Wang, Haoxiang, et al.
Publicado: (2024)
Tangent Space Fine-Tuning for Directional Preference Alignment in Large Language Models
por: Erdogan, Mete
Publicado: (2026)
por: Erdogan, Mete
Publicado: (2026)
CompassDPO: Dynamics-Controlled Direct Preference Optimization for Robust Safety Alignment
por: Liu, Jilong, et al.
Publicado: (2026)
por: Liu, Jilong, et al.
Publicado: (2026)
Decoding Human Preferences in Alignment: An Improved Approach to Inverse Constitutional AI
por: Henneking, Carl-Leander, et al.
Publicado: (2025)
por: Henneking, Carl-Leander, et al.
Publicado: (2025)
Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models
por: Agnihotri, Akhil, et al.
Publicado: (2025)
por: Agnihotri, Akhil, et al.
Publicado: (2025)
Distributed Direct Preference Optimization
por: Jiang, Zhanhong
Publicado: (2026)
por: Jiang, Zhanhong
Publicado: (2026)
From Demonstrations to Rewards: Alignment Without Explicit Human Preferences
por: Zeng, Siliang, et al.
Publicado: (2025)
por: Zeng, Siliang, et al.
Publicado: (2025)
Cal-DPO: Calibrated Direct Preference Optimization for Language Model Alignment
por: Xiao, Teng, et al.
Publicado: (2024)
por: Xiao, Teng, et al.
Publicado: (2024)
ActiveDPO: Active Direct Preference Optimization for Sample-Efficient Alignment
por: Lin, Xiaoqiang, et al.
Publicado: (2025)
por: Lin, Xiaoqiang, et al.
Publicado: (2025)
Robust LLM Alignment via Distributionally Robust Direct Preference Optimization
por: Xu, Zaiyan, et al.
Publicado: (2025)
por: Xu, Zaiyan, et al.
Publicado: (2025)
Towards Understanding Valuable Preference Data for Large Language Model Alignment
por: Zhang, Zizhuo, et al.
Publicado: (2025)
por: Zhang, Zizhuo, et al.
Publicado: (2025)
Latent Embedding Adaptation for Human Preference Alignment in Diffusion Planners
por: Ng, Wen Zheng Terence, et al.
Publicado: (2025)
por: Ng, Wen Zheng Terence, et al.
Publicado: (2025)
MaxMin-RLHF: Alignment with Diverse Human Preferences
por: Chakraborty, Souradip, et al.
Publicado: (2024)
por: Chakraborty, Souradip, et al.
Publicado: (2024)
DreamDPO: Aligning Text-to-3D Generation with Human Preferences via Direct Preference Optimization
por: Zhou, Zhenglin, et al.
Publicado: (2025)
por: Zhou, Zhenglin, et al.
Publicado: (2025)
Towards Data-Centric RLHF: Simple Metrics for Preference Dataset Comparison
por: Shen, Judy Hanwen, et al.
Publicado: (2024)
por: Shen, Judy Hanwen, et al.
Publicado: (2024)
Human Alignment of Large Language Models through Online Preference Optimisation
por: Calandriello, Daniele, et al.
Publicado: (2024)
por: Calandriello, Daniele, et al.
Publicado: (2024)
Beyond Preferences: Learning Alignment Principles Grounded in Human Reasons and Values
por: Bell, Henry, et al.
Publicado: (2026)
por: Bell, Henry, et al.
Publicado: (2026)
Active Learning for Direct Preference Optimization
por: Kveton, Branislav, et al.
Publicado: (2025)
por: Kveton, Branislav, et al.
Publicado: (2025)
Lightweight Robust Direct Preference Optimization
por: Kim, Cheol Woo, et al.
Publicado: (2025)
por: Kim, Cheol Woo, et al.
Publicado: (2025)
A Survey of Direct Preference Optimization
por: Liu, Shunyu, et al.
Publicado: (2025)
por: Liu, Shunyu, et al.
Publicado: (2025)
Distortion of AI Alignment: Does Preference Optimization Optimize for Preferences?
por: Gölz, Paul, et al.
Publicado: (2025)
por: Gölz, Paul, et al.
Publicado: (2025)
Right Now, Wrong Then: Non-Stationary Direct Preference Optimization under Preference Drift
por: Son, Seongho, et al.
Publicado: (2024)
por: Son, Seongho, et al.
Publicado: (2024)
DOPL: Direct Online Preference Learning for Restless Bandits with Preference Feedback
por: Xiong, Guojun, et al.
Publicado: (2024)
por: Xiong, Guojun, et al.
Publicado: (2024)
Orthogonal Finetuning for Direct Preference Optimization
por: Yang, Chenxu, et al.
Publicado: (2024)
por: Yang, Chenxu, et al.
Publicado: (2024)
Cost-Adaptive Recourse Recommendation by Adaptive Preference Elicitation
por: Nguyen, Duy, et al.
Publicado: (2024)
por: Nguyen, Duy, et al.
Publicado: (2024)
Ejemplares similares
-
The Signal is in the Steps: Local Scoring for Reasoning Data Selection
por: Just, Hoang Anh, et al.
Publicado: (2025) -
Get more for less: Principled Data Selection for Warming Up Fine-Tuning in LLMs
por: Kang, Feiyang, et al.
Publicado: (2024) -
DiPT: Enhancing LLM reasoning through diversified perspective-taking
por: Just, Hoang Anh, et al.
Publicado: (2024) -
Probing Knowledge Holes in Unlearned LLMs
por: Ko, Myeongseob, et al.
Publicado: (2025) -
Direct Preference Optimization for Primitive-Enabled Hierarchical RL: A Bilevel Approach
por: Singh, Utsav, et al.
Publicado: (2024)