Filtered Direct Preference Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Morimura, Tetsuro, Sakamoto, Mitsuki, Jinnai, Yuu, Abe, Kenshi, Ariu, Kaito |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Regularized Best-of-N Sampling with Minimum Bayes Risk Objective for Language Model Alignment
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
Model-Based Minimum Bayes Risk Decoding for Text Generation
di: Jinnai, Yuu, et al.
Pubblicazione: (2023)
di: Jinnai, Yuu, et al.
Pubblicazione: (2023)
Evaluation of Best-of-N Sampling Strategies for Language Model Alignment
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
Hyperparameter-Free Approach for Faster Minimum Bayes Risk Decoding
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
Does Cross-Cultural Alignment Change the Commonsense Morality of Language Models?
di: Jinnai, Yuu
Pubblicazione: (2024)
di: Jinnai, Yuu
Pubblicazione: (2024)
Theoretical Guarantees for Minimum Bayes Risk Decoding
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
On the True Distribution Approximation of Minimum Bayes-Risk Decoding
di: Ohashi, Atsumoto, et al.
Pubblicazione: (2024)
di: Ohashi, Atsumoto, et al.
Pubblicazione: (2024)
Generating Diverse and High-Quality Texts by Minimum Bayes Risk Decoding
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
Adaptively Perturbed Mirror Descent for Learning in Games
di: Abe, Kenshi, et al.
Pubblicazione: (2023)
di: Abe, Kenshi, et al.
Pubblicazione: (2023)
Annotation-Efficient Language Model Alignment via Diverse and Representative Response Texts
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
MO-GRPO: Mitigating Reward Hacking of Group Relative Policy Optimization on Multi-Objective Problems
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
Policy Gradient Algorithms with Monte Carlo Tree Learning for Non-Markov Decision Processes
di: Morimura, Tetsuro, et al.
Pubblicazione: (2022)
di: Morimura, Tetsuro, et al.
Pubblicazione: (2022)
Document-Level Text Generation with Minimum Bayes Risk Decoding using Optimal Transport
di: Jinnai, Yuu
Pubblicazione: (2025)
di: Jinnai, Yuu
Pubblicazione: (2025)
Return-Aligned Decision Transformer
di: Tanaka, Tsunehiko, et al.
Pubblicazione: (2024)
di: Tanaka, Tsunehiko, et al.
Pubblicazione: (2024)
Consensus Group Relative Policy Optimization for Text Generation
di: Ichihara, Yuki, et al.
Pubblicazione: (2026)
di: Ichihara, Yuki, et al.
Pubblicazione: (2026)
On the Power of Perturbation under Sampling in Solving Extensive-Form Games
di: Masaka, Wataru, et al.
Pubblicazione: (2025)
di: Masaka, Wataru, et al.
Pubblicazione: (2025)
Re-evaluating Minimum Bayes Risk Decoding for Automatic Speech Recognition
di: Jinnai, Yuu
Pubblicazione: (2025)
di: Jinnai, Yuu
Pubblicazione: (2025)
Boosting Perturbed Gradient Ascent for Last-Iterate Convergence in Games
di: Abe, Kenshi, et al.
Pubblicazione: (2024)
di: Abe, Kenshi, et al.
Pubblicazione: (2024)
Last Iterate Convergence in Monotone Mean Field Games
di: Isobe, Noboru, et al.
Pubblicazione: (2024)
di: Isobe, Noboru, et al.
Pubblicazione: (2024)
Asymmetric Perturbation in Solving Bilinear Saddle-Point Optimization
di: Abe, Kenshi, et al.
Pubblicazione: (2025)
di: Abe, Kenshi, et al.
Pubblicazione: (2025)
Learning from Delayed Feedback in Games via Extra Prediction
di: Fujimoto, Yuma, et al.
Pubblicazione: (2025)
di: Fujimoto, Yuma, et al.
Pubblicazione: (2025)
Linear Convergence in Games with Delayed Feedback via Extra Prediction
di: Fujimoto, Yuma, et al.
Pubblicazione: (2026)
di: Fujimoto, Yuma, et al.
Pubblicazione: (2026)
Direct Preference Optimization with an Offset
di: Amini, Afra, et al.
Pubblicazione: (2024)
di: Amini, Afra, et al.
Pubblicazione: (2024)
Entropy Controllable Direct Preference Optimization
di: Omura, Motoki, et al.
Pubblicazione: (2024)
di: Omura, Motoki, et al.
Pubblicazione: (2024)
Orthogonal Finetuning for Direct Preference Optimization
di: Yang, Chenxu, et al.
Pubblicazione: (2024)
di: Yang, Chenxu, et al.
Pubblicazione: (2024)
Policy Gradient with Kernel Quadrature
di: Hayakawa, Satoshi, et al.
Pubblicazione: (2023)
di: Hayakawa, Satoshi, et al.
Pubblicazione: (2023)
Interaction Locality in Hierarchical Recursive Reasoning
di: Miyanishi, Yosuke, et al.
Pubblicazione: (2026)
di: Miyanishi, Yosuke, et al.
Pubblicazione: (2026)
Unintentional Unalignment: Likelihood Displacement in Direct Preference Optimization
di: Razin, Noam, et al.
Pubblicazione: (2024)
di: Razin, Noam, et al.
Pubblicazione: (2024)
AlphaDPO: Adaptive Reward Margin for Direct Preference Optimization
di: Wu, Junkang, et al.
Pubblicazione: (2024)
di: Wu, Junkang, et al.
Pubblicazione: (2024)
Online DPO: Online Direct Preference Optimization with Fast-Slow Chasing
di: Qi, Biqing, et al.
Pubblicazione: (2024)
di: Qi, Biqing, et al.
Pubblicazione: (2024)
Inducing Robustness in a 2 Dimensional Direct Preference Optimization Paradigm
di: Shashidhar, Sarvesh, et al.
Pubblicazione: (2025)
di: Shashidhar, Sarvesh, et al.
Pubblicazione: (2025)
Differential Information Distribution: A Bayesian Perspective on Direct Preference Optimization
di: Won, Yunjae, et al.
Pubblicazione: (2025)
di: Won, Yunjae, et al.
Pubblicazione: (2025)
Direct Nash Optimization: Teaching Language Models to Self-Improve with General Preferences
di: Rosset, Corby, et al.
Pubblicazione: (2024)
di: Rosset, Corby, et al.
Pubblicazione: (2024)
A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications
di: Xiao, Wenyi, et al.
Pubblicazione: (2024)
di: Xiao, Wenyi, et al.
Pubblicazione: (2024)
Towards Robust Alignment of Language Models: Distributionally Robustifying Direct Preference Optimization
di: Wu, Junkang, et al.
Pubblicazione: (2024)
di: Wu, Junkang, et al.
Pubblicazione: (2024)
TGDPO: Harnessing Token-Level Reward Guidance for Enhancing Direct Preference Optimization
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
Direct Preference Optimization: Your Language Model is Secretly a Reward Model
di: Rafailov, Rafael, et al.
Pubblicazione: (2023)
di: Rafailov, Rafael, et al.
Pubblicazione: (2023)
Mix- and MoE-DPO: A Variational Inference Approach to Direct Preference Optimization
di: Bohne, Jason, et al.
Pubblicazione: (2025)
di: Bohne, Jason, et al.
Pubblicazione: (2025)
On the Role of Preference Variance in Preference Optimization
di: Guo, Jiacheng, et al.
Pubblicazione: (2025)
di: Guo, Jiacheng, et al.
Pubblicazione: (2025)
Spread Preference Annotation: Direct Preference Judgment for Efficient LLM Alignment
di: Kim, Dongyoung, et al.
Pubblicazione: (2024)
di: Kim, Dongyoung, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Regularized Best-of-N Sampling with Minimum Bayes Risk Objective for Language Model Alignment
di: Jinnai, Yuu, et al.
Pubblicazione: (2024) -
Model-Based Minimum Bayes Risk Decoding for Text Generation
di: Jinnai, Yuu, et al.
Pubblicazione: (2023) -
Evaluation of Best-of-N Sampling Strategies for Language Model Alignment
di: Ichihara, Yuki, et al.
Pubblicazione: (2025) -
Hyperparameter-Free Approach for Faster Minimum Bayes Risk Decoding
di: Jinnai, Yuu, et al.
Pubblicazione: (2024) -
Does Cross-Cultural Alignment Change the Commonsense Morality of Language Models?
di: Jinnai, Yuu
Pubblicazione: (2024)