ICDPO: Effectively Borrowing Alignment Capability of Others via In-context Direct Preference Optimization
Fuente:
arXiv
Guardado en:
| Autores principales: | Song, Feifan, Fan, Yuxuan, Zhang, Xin, Wang, Peiyi, Wang, Houfeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding
por: Song, Feifan, et al.
Publicado: (2025)
por: Song, Feifan, et al.
Publicado: (2025)
Preference Ranking Optimization for Human Alignment
por: Song, Feifan, et al.
Publicado: (2023)
por: Song, Feifan, et al.
Publicado: (2023)
P-Aligner: Enabling Pre-Alignment of Language Models via Principled Instruction Synthesis
por: Song, Feifan, et al.
Publicado: (2025)
por: Song, Feifan, et al.
Publicado: (2025)
Scaling Data Diversity for Fine-Tuning Language Models in Human Alignment
por: Song, Feifan, et al.
Publicado: (2024)
por: Song, Feifan, et al.
Publicado: (2024)
Effectively Steer LLM To Follow Preference via Building Confident Directions
por: Song, Bingqing, et al.
Publicado: (2025)
por: Song, Bingqing, et al.
Publicado: (2025)
TIME: A Multi-level Benchmark for Temporal Reasoning of LLMs in Real-World Scenarios
por: Wei, Shaohang, et al.
Publicado: (2025)
por: Wei, Shaohang, et al.
Publicado: (2025)
Token-level Direct Preference Optimization
por: Zeng, Yongcheng, et al.
Publicado: (2024)
por: Zeng, Yongcheng, et al.
Publicado: (2024)
Is On-Policy Data always the Best Choice for Direct Preference Optimization-based LM Alignment?
por: Sun, Zetian, et al.
Publicado: (2025)
por: Sun, Zetian, et al.
Publicado: (2025)
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
por: Wu, Jiayi, et al.
Publicado: (2024)
por: Wu, Jiayi, et al.
Publicado: (2024)
Two Pathways to Truthfulness: On the Intrinsic Encoding of LLM Hallucinations
por: Luo, Wen, et al.
Publicado: (2026)
por: Luo, Wen, et al.
Publicado: (2026)
Enhancing Multilingual Counterfactual Generation through Alignment-as-Preference Optimization
por: Wang, Yilong, et al.
Publicado: (2026)
por: Wang, Yilong, et al.
Publicado: (2026)
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
por: Lyu, Yougang, et al.
Publicado: (2024)
por: Lyu, Yougang, et al.
Publicado: (2024)
Towards Robust Alignment of Language Models: Distributionally Robustifying Direct Preference Optimization
por: Wu, Junkang, et al.
Publicado: (2024)
por: Wu, Junkang, et al.
Publicado: (2024)
Mitigating Overthinking through Reasoning Shaping
por: Song, Feifan, et al.
Publicado: (2025)
por: Song, Feifan, et al.
Publicado: (2025)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
por: Wang, Haoxiang, et al.
Publicado: (2024)
por: Wang, Haoxiang, et al.
Publicado: (2024)
Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning
por: Zhang, Ruiqi, et al.
Publicado: (2024)
por: Zhang, Ruiqi, et al.
Publicado: (2024)
SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization
por: Sun, Huashan, et al.
Publicado: (2025)
por: Sun, Huashan, et al.
Publicado: (2025)
Correcting the Mythos of KL-Regularization: Direct Alignment without Overoptimization via Chi-Squared Preference Optimization
por: Huang, Audrey, et al.
Publicado: (2024)
por: Huang, Audrey, et al.
Publicado: (2024)
Knowledge Editing in Language Models via Adapted Direct Preference Optimization
por: Rozner, Amit, et al.
Publicado: (2024)
por: Rozner, Amit, et al.
Publicado: (2024)
FlipGuard: Defending Preference Alignment against Update Regression with Constrained Optimization
por: Zhu, Mingye, et al.
Publicado: (2024)
por: Zhu, Mingye, et al.
Publicado: (2024)
IIMedGPT: Promoting Large Language Model Capabilities of Medical Tasks by Efficient Human Preference Alignment
por: Zhang, Yiming, et al.
Publicado: (2025)
por: Zhang, Yiming, et al.
Publicado: (2025)
Disentangling Preference Representation and Text Generation for Efficient Individual Preference Alignment
por: Zhang, Jianfei, et al.
Publicado: (2024)
por: Zhang, Jianfei, et al.
Publicado: (2024)
Evaluating the Effectiveness of Direct Preference Optimization for Personalizing German Automatic Text Simplifications for Persons with Intellectual Disabilities
por: Gao, Yingqiang, et al.
Publicado: (2025)
por: Gao, Yingqiang, et al.
Publicado: (2025)
SDPO: Segment-Level Direct Preference Optimization for Social Agents
por: Kong, Aobo, et al.
Publicado: (2025)
por: Kong, Aobo, et al.
Publicado: (2025)
On-the-fly Preference Alignment via Principle-Guided Decoding
por: Zhu, Mingye, et al.
Publicado: (2025)
por: Zhu, Mingye, et al.
Publicado: (2025)
Orthogonal Finetuning for Direct Preference Optimization
por: Yang, Chenxu, et al.
Publicado: (2024)
por: Yang, Chenxu, et al.
Publicado: (2024)
Utilizing Local Hierarchy with Adversarial Training for Hierarchical Text Classification
por: Wang, Zihan, et al.
Publicado: (2024)
por: Wang, Zihan, et al.
Publicado: (2024)
Direct Alignment of Language Models via Quality-Aware Self-Refinement
por: Yu, Runsheng, et al.
Publicado: (2024)
por: Yu, Runsheng, et al.
Publicado: (2024)
Spread Preference Annotation: Direct Preference Judgment for Efficient LLM Alignment
por: Kim, Dongyoung, et al.
Publicado: (2024)
por: Kim, Dongyoung, et al.
Publicado: (2024)
Northeastern Uni at Multilingual Counterspeech Generation: Enhancing Counter Speech Generation with LLM Alignment through Direct Preference Optimization
por: Wadhwa, Sahil, et al.
Publicado: (2024)
por: Wadhwa, Sahil, et al.
Publicado: (2024)
Implicit Cross-Lingual Rewarding for Efficient Multilingual Preference Alignment
por: Yang, Wen, et al.
Publicado: (2025)
por: Yang, Wen, et al.
Publicado: (2025)
Not All Preferences are What You Need for Post-Training: Selective Alignment Strategy for Preference Optimization
por: Dong, Zhijin
Publicado: (2025)
por: Dong, Zhijin
Publicado: (2025)
Filtered Direct Preference Optimization
por: Morimura, Tetsuro, et al.
Publicado: (2024)
por: Morimura, Tetsuro, et al.
Publicado: (2024)
Direct Preference Optimization with an Offset
por: Amini, Afra, et al.
Publicado: (2024)
por: Amini, Afra, et al.
Publicado: (2024)
Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
por: Li, Jian, et al.
Publicado: (2024)
por: Li, Jian, et al.
Publicado: (2024)
POPI: Personalizing LLMs via Optimized Natural Language Preference Inference
por: Chen, Yizhuo, et al.
Publicado: (2025)
por: Chen, Yizhuo, et al.
Publicado: (2025)
Chinese Essay Rhetoric Recognition Using LoRA, In-context Learning and Model Ensemble
por: Lai, Yuxuan, et al.
Publicado: (2026)
por: Lai, Yuxuan, et al.
Publicado: (2026)
2D-DPO: Scaling Direct Preference Optimization with 2-Dimensional Supervision
por: Li, Shilong, et al.
Publicado: (2024)
por: Li, Shilong, et al.
Publicado: (2024)
AlphaDPO: Adaptive Reward Margin for Direct Preference Optimization
por: Wu, Junkang, et al.
Publicado: (2024)
por: Wu, Junkang, et al.
Publicado: (2024)
PMMT: Preference Alignment in Multilingual Machine Translation via LLM Distillation
por: Sun, Shuqiao, et al.
Publicado: (2024)
por: Sun, Shuqiao, et al.
Publicado: (2024)
Ejemplares similares
-
Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding
por: Song, Feifan, et al.
Publicado: (2025) -
Preference Ranking Optimization for Human Alignment
por: Song, Feifan, et al.
Publicado: (2023) -
P-Aligner: Enabling Pre-Alignment of Language Models via Principled Instruction Synthesis
por: Song, Feifan, et al.
Publicado: (2025) -
Scaling Data Diversity for Fine-Tuning Language Models in Human Alignment
por: Song, Feifan, et al.
Publicado: (2024) -
Effectively Steer LLM To Follow Preference via Building Confident Directions
por: Song, Bingqing, et al.
Publicado: (2025)