Enregistré dans:
| Auteurs principaux: | Liu, Zixuan, Sun, Xiaolin, Zheng, Zizhan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2403.02475 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Robust Optimization for Mitigating Reward Hacking with Correlated Proxies
par: Liu, Zixuan, et autres
Publié: (2026)
par: Liu, Zixuan, et autres
Publié: (2026)
Belief-Enriched Pessimistic Q-Learning against Adversarial State Perturbations
par: Sun, Xiaolin, et autres
Publié: (2024)
par: Sun, Xiaolin, et autres
Publié: (2024)
Orthogonal Finetuning for Direct Preference Optimization
par: Yang, Chenxu, et autres
Publié: (2024)
par: Yang, Chenxu, et autres
Publié: (2024)
Understanding Reference Policies in Direct Preference Optimization
par: Liu, Yixin, et autres
Publié: (2024)
par: Liu, Yixin, et autres
Publié: (2024)
Length Desensitization in Direct Preference Optimization
par: Liu, Wei, et autres
Publié: (2024)
par: Liu, Wei, et autres
Publié: (2024)
Towards Auto-Regressive Next-Token Prediction: In-Context Learning Emerges from Generalization
par: Gong, Zixuan, et autres
Publié: (2025)
par: Gong, Zixuan, et autres
Publié: (2025)
Adversarial Preference Optimization: Enhancing Your Alignment via RM-LLM Game
par: Cheng, Pengyu, et autres
Publié: (2023)
par: Cheng, Pengyu, et autres
Publié: (2023)
Accelerating Direct Preference Optimization with Prefix Sharing
par: Wang, Franklin, et autres
Publié: (2024)
par: Wang, Franklin, et autres
Publié: (2024)
Filtered Direct Preference Optimization
par: Morimura, Tetsuro, et autres
Publié: (2024)
par: Morimura, Tetsuro, et autres
Publié: (2024)
Direct Preference Optimization with an Offset
par: Amini, Afra, et autres
Publié: (2024)
par: Amini, Afra, et autres
Publié: (2024)
MemBoost: A Memory-Boosted Framework for Cost-Aware LLM Inference
par: Köster, Joris, et autres
Publié: (2026)
par: Köster, Joris, et autres
Publié: (2026)
DreamDPO: Aligning Text-to-3D Generation with Human Preferences via Direct Preference Optimization
par: Zhou, Zhenglin, et autres
Publié: (2025)
par: Zhou, Zhenglin, et autres
Publié: (2025)
Direct Multi-Turn Preference Optimization for Language Agents
par: Shi, Wentao, et autres
Publié: (2024)
par: Shi, Wentao, et autres
Publié: (2024)
The Crucial Role of Samplers in Online Direct Preference Optimization
par: Shi, Ruizhe, et autres
Publié: (2024)
par: Shi, Ruizhe, et autres
Publié: (2024)
Disentangling Length from Quality in Direct Preference Optimization
par: Park, Ryan, et autres
Publié: (2024)
par: Park, Ryan, et autres
Publié: (2024)
VERI-DPO: Evidence-Aware Alignment for Clinical Summarization via Claim Verification and Direct Preference Optimization
par: Liu, Weixin, et autres
Publié: (2026)
par: Liu, Weixin, et autres
Publié: (2026)
Entropy Controllable Direct Preference Optimization
par: Omura, Motoki, et autres
Publié: (2024)
par: Omura, Motoki, et autres
Publié: (2024)
Spread Preference Annotation: Direct Preference Judgment for Efficient LLM Alignment
par: Kim, Dongyoung, et autres
Publié: (2024)
par: Kim, Dongyoung, et autres
Publié: (2024)
Clinical Reading Comprehension with Encoder-Decoder Models Enhanced by Direct Preference Optimization
par: Nahian, Md Sultan Al, et autres
Publié: (2024)
par: Nahian, Md Sultan Al, et autres
Publié: (2024)
TGDPO: Harnessing Token-Level Reward Guidance for Enhancing Direct Preference Optimization
par: Zhu, Mingkang, et autres
Publié: (2025)
par: Zhu, Mingkang, et autres
Publié: (2025)
PerPO: Perceptual Preference Optimization via Discriminative Rewarding
par: Zhu, Zining, et autres
Publié: (2025)
par: Zhu, Zining, et autres
Publié: (2025)
DuPO: Enabling Reliable LLM Self-Verification via Dual Preference Optimization
par: She, Shuaijie, et autres
Publié: (2025)
par: She, Shuaijie, et autres
Publié: (2025)
Correcting the Mythos of KL-Regularization: Direct Alignment without Overoptimization via Chi-Squared Preference Optimization
par: Huang, Audrey, et autres
Publié: (2024)
par: Huang, Audrey, et autres
Publié: (2024)
Adaptive Preference Optimization with Uncertainty-aware Utility Anchor
par: Wang, Xiaobo, et autres
Publié: (2025)
par: Wang, Xiaobo, et autres
Publié: (2025)
Refined Direct Preference Optimization with Synthetic Data for Behavioral Alignment of LLMs
par: Gallego, Víctor
Publié: (2024)
par: Gallego, Víctor
Publié: (2024)
Cal-DPO: Calibrated Direct Preference Optimization for Language Model Alignment
par: Xiao, Teng, et autres
Publié: (2024)
par: Xiao, Teng, et autres
Publié: (2024)
Simplicity Prevails: Rethinking Negative Preference Optimization for LLM Unlearning
par: Fan, Chongyu, et autres
Publié: (2024)
par: Fan, Chongyu, et autres
Publié: (2024)
On the Limited Generalization Capability of the Implicit Reward Model Induced by Direct Preference Optimization
par: Lin, Yong, et autres
Publié: (2024)
par: Lin, Yong, et autres
Publié: (2024)
AdaDPO: Self-Adaptive Direct Preference Optimization with Balanced Gradient Updates
par: Chen, Shaolong, et autres
Publié: (2026)
par: Chen, Shaolong, et autres
Publié: (2026)
Unintentional Unalignment: Likelihood Displacement in Direct Preference Optimization
par: Razin, Noam, et autres
Publié: (2024)
par: Razin, Noam, et autres
Publié: (2024)
Enhancing LLM Agent Safety via Causal Influence Prompting
par: Hahm, Dongyoon, et autres
Publié: (2025)
par: Hahm, Dongyoon, et autres
Publié: (2025)
What Matters in LLM-generated Data: Diversity and Its Effect on Model Fine-Tuning
par: Zhu, Yuchang, et autres
Publié: (2025)
par: Zhu, Yuchang, et autres
Publié: (2025)
FedPDPO: Federated Personalized Direct Preference Optimization for Large Language Model Alignment
par: Zhu, Kewen, et autres
Publié: (2026)
par: Zhu, Kewen, et autres
Publié: (2026)
InCo-DPO: Balancing Distribution Shift and Data Quality for Enhanced Preference Optimization
par: Wang, Yunan, et autres
Publié: (2025)
par: Wang, Yunan, et autres
Publié: (2025)
AlphaDPO: Adaptive Reward Margin for Direct Preference Optimization
par: Wu, Junkang, et autres
Publié: (2024)
par: Wu, Junkang, et autres
Publié: (2024)
Safety Training Persists Through Helpfulness Optimization in LLM Agents
par: Plaut, Benjamin
Publié: (2026)
par: Plaut, Benjamin
Publié: (2026)
Less is More: Improving LLM Alignment via Preference Data Selection
par: Deng, Xun, et autres
Publié: (2025)
par: Deng, Xun, et autres
Publié: (2025)
Bi-Factorial Preference Optimization: Balancing Safety-Helpfulness in Language Models
par: Zhang, Wenxuan, et autres
Publié: (2024)
par: Zhang, Wenxuan, et autres
Publié: (2024)
Intrinsic Mutual Information as a Modulator for Preference Optimization
par: Liao, Peng, et autres
Publié: (2026)
par: Liao, Peng, et autres
Publié: (2026)
Federated Fine-Tuning of Large Language Models: Kahneman-Tversky vs. Direct Preference Optimization
par: Spadea, Fernando, et autres
Publié: (2025)
par: Spadea, Fernando, et autres
Publié: (2025)
Documents similaires
-
Robust Optimization for Mitigating Reward Hacking with Correlated Proxies
par: Liu, Zixuan, et autres
Publié: (2026) -
Belief-Enriched Pessimistic Q-Learning against Adversarial State Perturbations
par: Sun, Xiaolin, et autres
Publié: (2024) -
Orthogonal Finetuning for Direct Preference Optimization
par: Yang, Chenxu, et autres
Publié: (2024) -
Understanding Reference Policies in Direct Preference Optimization
par: Liu, Yixin, et autres
Publié: (2024) -
Length Desensitization in Direct Preference Optimization
par: Liu, Wei, et autres
Publié: (2024)