Understanding Reference Policies in Direct Preference Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Yixin, Liu, Pengfei, Cohan, Arman |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On Evaluating LLM Alignment by Evaluating LLMs as Judges
di: Liu, Yixin, et al.
Pubblicazione: (2025)
di: Liu, Yixin, et al.
Pubblicazione: (2025)
COMAL: A Convergent Meta-Algorithm for Aligning LLMs with General Preferences
di: Liu, Yixin, et al.
Pubblicazione: (2024)
di: Liu, Yixin, et al.
Pubblicazione: (2024)
Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference
di: Gao, Mingqi, et al.
Pubblicazione: (2024)
di: Gao, Mingqi, et al.
Pubblicazione: (2024)
References Improve LLM Alignment in Non-Verifiable Domains
di: Shi, Kejian, et al.
Pubblicazione: (2026)
di: Shi, Kejian, et al.
Pubblicazione: (2026)
Observable Propagation: Uncovering Feature Vectors in Transformers
di: Dunefsky, Jacob, et al.
Pubblicazione: (2023)
di: Dunefsky, Jacob, et al.
Pubblicazione: (2023)
Calibrating Long-form Generations from Large Language Models
di: Huang, Yukun, et al.
Pubblicazione: (2024)
di: Huang, Yukun, et al.
Pubblicazione: (2024)
Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization
di: Liu, Yixin, et al.
Pubblicazione: (2023)
di: Liu, Yixin, et al.
Pubblicazione: (2023)
Length Desensitization in Direct Preference Optimization
di: Liu, Wei, et al.
Pubblicazione: (2024)
di: Liu, Wei, et al.
Pubblicazione: (2024)
Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models
di: Riddell, Martin, et al.
Pubblicazione: (2024)
di: Riddell, Martin, et al.
Pubblicazione: (2024)
Enhancing LLM Safety via Constrained Direct Preference Optimization
di: Liu, Zixuan, et al.
Pubblicazione: (2024)
di: Liu, Zixuan, et al.
Pubblicazione: (2024)
MDCure: A Scalable Pipeline for Multi-Document Instruction-Following
di: Liu, Gabrielle Kaili-May, et al.
Pubblicazione: (2024)
di: Liu, Gabrielle Kaili-May, et al.
Pubblicazione: (2024)
References Indeed Matter? Reference-Free Preference Optimization for Conversational Query Reformulation
di: Kim, Doyoung, et al.
Pubblicazione: (2025)
di: Kim, Doyoung, et al.
Pubblicazione: (2025)
Online DPO: Online Direct Preference Optimization with Fast-Slow Chasing
di: Qi, Biqing, et al.
Pubblicazione: (2024)
di: Qi, Biqing, et al.
Pubblicazione: (2024)
Multi-Reference Preference Optimization for Large Language Models
di: Le, Hung, et al.
Pubblicazione: (2024)
di: Le, Hung, et al.
Pubblicazione: (2024)
ReIFE: Re-evaluating Instruction-Following Evaluation
di: Liu, Yixin, et al.
Pubblicazione: (2024)
di: Liu, Yixin, et al.
Pubblicazione: (2024)
Accelerating Direct Preference Optimization with Prefix Sharing
di: Wang, Franklin, et al.
Pubblicazione: (2024)
di: Wang, Franklin, et al.
Pubblicazione: (2024)
On Learning to Summarize with Large Language Models as References
di: Liu, Yixin, et al.
Pubblicazione: (2023)
di: Liu, Yixin, et al.
Pubblicazione: (2023)
Examining Reasoning LLMs-as-Judges in Non-Verifiable LLM Post-Training
di: Liu, Yixin, et al.
Pubblicazione: (2026)
di: Liu, Yixin, et al.
Pubblicazione: (2026)
Filtered Direct Preference Optimization
di: Morimura, Tetsuro, et al.
Pubblicazione: (2024)
di: Morimura, Tetsuro, et al.
Pubblicazione: (2024)
Direct Preference Optimization with an Offset
di: Amini, Afra, et al.
Pubblicazione: (2024)
di: Amini, Afra, et al.
Pubblicazione: (2024)
Direct Multi-Turn Preference Optimization for Language Agents
di: Shi, Wentao, et al.
Pubblicazione: (2024)
di: Shi, Wentao, et al.
Pubblicazione: (2024)
The Crucial Role of Samplers in Online Direct Preference Optimization
di: Shi, Ruizhe, et al.
Pubblicazione: (2024)
di: Shi, Ruizhe, et al.
Pubblicazione: (2024)
Disentangling Length from Quality in Direct Preference Optimization
di: Park, Ryan, et al.
Pubblicazione: (2024)
di: Park, Ryan, et al.
Pubblicazione: (2024)
SimPO: Simple Preference Optimization with a Reference-Free Reward
di: Meng, Yu, et al.
Pubblicazione: (2024)
di: Meng, Yu, et al.
Pubblicazione: (2024)
FinTrust: A Comprehensive Benchmark of Trustworthiness Evaluation in Finance Domain
di: Hu, Tiansheng, et al.
Pubblicazione: (2025)
di: Hu, Tiansheng, et al.
Pubblicazione: (2025)
MetaFaith: Faithful Natural Language Uncertainty Expression in LLMs
di: Liu, Gabrielle Kaili-May, et al.
Pubblicazione: (2025)
di: Liu, Gabrielle Kaili-May, et al.
Pubblicazione: (2025)
Entropy Controllable Direct Preference Optimization
di: Omura, Motoki, et al.
Pubblicazione: (2024)
di: Omura, Motoki, et al.
Pubblicazione: (2024)
Orthogonal Finetuning for Direct Preference Optimization
di: Yang, Chenxu, et al.
Pubblicazione: (2024)
di: Yang, Chenxu, et al.
Pubblicazione: (2024)
VERI-DPO: Evidence-Aware Alignment for Clinical Summarization via Claim Verification and Direct Preference Optimization
di: Liu, Weixin, et al.
Pubblicazione: (2026)
di: Liu, Weixin, et al.
Pubblicazione: (2026)
Refined Direct Preference Optimization with Synthetic Data for Behavioral Alignment of LLMs
di: Gallego, Víctor
Pubblicazione: (2024)
di: Gallego, Víctor
Pubblicazione: (2024)
Cal-DPO: Calibrated Direct Preference Optimization for Language Model Alignment
di: Xiao, Teng, et al.
Pubblicazione: (2024)
di: Xiao, Teng, et al.
Pubblicazione: (2024)
On the Limited Generalization Capability of the Implicit Reward Model Induced by Direct Preference Optimization
di: Lin, Yong, et al.
Pubblicazione: (2024)
di: Lin, Yong, et al.
Pubblicazione: (2024)
AdaDPO: Self-Adaptive Direct Preference Optimization with Balanced Gradient Updates
di: Chen, Shaolong, et al.
Pubblicazione: (2026)
di: Chen, Shaolong, et al.
Pubblicazione: (2026)
Self-Augmented Preference Optimization: Off-Policy Paradigms for Language Model Alignment
di: Yin, Yueqin, et al.
Pubblicazione: (2024)
di: Yin, Yueqin, et al.
Pubblicazione: (2024)
DreamDPO: Aligning Text-to-3D Generation with Human Preferences via Direct Preference Optimization
di: Zhou, Zhenglin, et al.
Pubblicazione: (2025)
di: Zhou, Zhenglin, et al.
Pubblicazione: (2025)
Unintentional Unalignment: Likelihood Displacement in Direct Preference Optimization
di: Razin, Noam, et al.
Pubblicazione: (2024)
di: Razin, Noam, et al.
Pubblicazione: (2024)
FedPDPO: Federated Personalized Direct Preference Optimization for Large Language Model Alignment
di: Zhu, Kewen, et al.
Pubblicazione: (2026)
di: Zhu, Kewen, et al.
Pubblicazione: (2026)
LiPO: Listwise Preference Optimization through Learning-to-Rank
di: Liu, Tianqi, et al.
Pubblicazione: (2024)
di: Liu, Tianqi, et al.
Pubblicazione: (2024)
FinDVer: Explainable Claim Verification over Long and Hybrid-Content Financial Documents
di: Zhao, Yilun, et al.
Pubblicazione: (2024)
di: Zhao, Yilun, et al.
Pubblicazione: (2024)
Adaptive Preference Optimization with Uncertainty-aware Utility Anchor
di: Wang, Xiaobo, et al.
Pubblicazione: (2025)
di: Wang, Xiaobo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
On Evaluating LLM Alignment by Evaluating LLMs as Judges
di: Liu, Yixin, et al.
Pubblicazione: (2025) -
COMAL: A Convergent Meta-Algorithm for Aligning LLMs with General Preferences
di: Liu, Yixin, et al.
Pubblicazione: (2024) -
Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference
di: Gao, Mingqi, et al.
Pubblicazione: (2024) -
References Improve LLM Alignment in Non-Verifiable Domains
di: Shi, Kejian, et al.
Pubblicazione: (2026) -
Observable Propagation: Uncovering Feature Vectors in Transformers
di: Dunefsky, Jacob, et al.
Pubblicazione: (2023)