AMaPO: Adaptive Margin-attached Preference Optimization for Language Model Alignment
Fuente:
arXiv
Salvato in:
| Autori principali: | Deng, Ruibo, Feng, Duanyu, Lei, Wenqiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Legend: Leveraging Representation Engineering to Annotate Safety Margin for Preference Datasets
di: Feng, Duanyu, et al.
Pubblicazione: (2024)
di: Feng, Duanyu, et al.
Pubblicazione: (2024)
Towards Understanding the Influence of Reward Margin on Preference Model Performance
di: Qin, Bowen, et al.
Pubblicazione: (2024)
di: Qin, Bowen, et al.
Pubblicazione: (2024)
DREditor: An Time-efficient Approach for Building a Domain-specific Dense Retrieval Model
di: Huang, Chen, et al.
Pubblicazione: (2024)
di: Huang, Chen, et al.
Pubblicazione: (2024)
Cross-model Transferability among Large Language Models on the Platonic Representations of Concepts
di: Huang, Youcheng, et al.
Pubblicazione: (2025)
di: Huang, Youcheng, et al.
Pubblicazione: (2025)
Dishonesty in Helpful and Harmless Alignment
di: Huang, Youcheng, et al.
Pubblicazione: (2024)
di: Huang, Youcheng, et al.
Pubblicazione: (2024)
Towards Analyzing and Understanding the Limitations of DPO: A Theoretical Perspective
di: Feng, Duanyu, et al.
Pubblicazione: (2024)
di: Feng, Duanyu, et al.
Pubblicazione: (2024)
Margin Matching Preference Optimization: Enhanced Model Alignment with Granular Feedback
di: Kim, Kyuyoung, et al.
Pubblicazione: (2024)
di: Kim, Kyuyoung, et al.
Pubblicazione: (2024)
DiffPO: Diffusion-styled Preference Optimization for Efficient Inference-Time Alignment of Large Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2025)
di: Chen, Ruizhe, et al.
Pubblicazione: (2025)
Beyond Solving Math Quiz: Evaluating the Ability of Large Reasoning Models to Ask for Information
di: Huang, Youcheng, et al.
Pubblicazione: (2025)
di: Huang, Youcheng, et al.
Pubblicazione: (2025)
SeaPO: Strategic Error Amplification for Robust Preference Optimization of Large Language Models
di: Rao, Jun, et al.
Pubblicazione: (2025)
di: Rao, Jun, et al.
Pubblicazione: (2025)
ComPO: Community Preferences for Language Model Personalization
di: Kumar, Sachin, et al.
Pubblicazione: (2024)
di: Kumar, Sachin, et al.
Pubblicazione: (2024)
PrefPO: Pairwise Preference Prompt Optimization
di: Singhal, Rahul, et al.
Pubblicazione: (2026)
di: Singhal, Rahul, et al.
Pubblicazione: (2026)
AlphaDPO: Adaptive Reward Margin for Direct Preference Optimization
di: Wu, Junkang, et al.
Pubblicazione: (2024)
di: Wu, Junkang, et al.
Pubblicazione: (2024)
StoicLLM: Preference Optimization for Philosophical Alignment in Small Language Models
di: Khan, Ishmam, et al.
Pubblicazione: (2026)
di: Khan, Ishmam, et al.
Pubblicazione: (2026)
Breaking the Stigma! Unobtrusively Probe Symptoms in Depression Disorder Diagnosis Dialogue
di: Cao, Jieming, et al.
Pubblicazione: (2025)
di: Cao, Jieming, et al.
Pubblicazione: (2025)
ComPO: Preference Alignment via Comparison Oracles
di: Chen, Peter, et al.
Pubblicazione: (2025)
di: Chen, Peter, et al.
Pubblicazione: (2025)
TAB-PO: Preference Optimization with a Token-Level Adaptive Barrier for Token-Critical Structured Generation
di: Fodeh, Samah, et al.
Pubblicazione: (2026)
di: Fodeh, Samah, et al.
Pubblicazione: (2026)
Adaptive Margin RLHF via Preference over Preferences
di: Chittepu, Yaswanth, et al.
Pubblicazione: (2025)
di: Chittepu, Yaswanth, et al.
Pubblicazione: (2025)
Length-Controlled Margin-Based Preference Optimization without Reference Model
di: Li, Gengxu, et al.
Pubblicazione: (2025)
di: Li, Gengxu, et al.
Pubblicazione: (2025)
Magnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model Alignment
di: Wang, Mingzhi, et al.
Pubblicazione: (2024)
di: Wang, Mingzhi, et al.
Pubblicazione: (2024)
Accelerated Preference Optimization for Large Language Model Alignment
di: He, Jiafan, et al.
Pubblicazione: (2024)
di: He, Jiafan, et al.
Pubblicazione: (2024)
Self-Play Preference Optimization for Language Model Alignment
di: Wu, Yue, et al.
Pubblicazione: (2024)
di: Wu, Yue, et al.
Pubblicazione: (2024)
FocalPO: Enhancing Preference Optimizing by Focusing on Correct Preference Rankings
di: Liu, Tong, et al.
Pubblicazione: (2025)
di: Liu, Tong, et al.
Pubblicazione: (2025)
Robust Preference Optimization via Dynamic Target Margins
di: Sun, Jie, et al.
Pubblicazione: (2025)
di: Sun, Jie, et al.
Pubblicazione: (2025)
M3PO: Multimodal-Model-Guided Preference Optimization for Visual Instruction Following
di: Gao, Ruirui, et al.
Pubblicazione: (2025)
di: Gao, Ruirui, et al.
Pubblicazione: (2025)
CiPO: Counterfactual Unlearning for Large Reasoning Models through Iterative Preference Optimization
di: Li, Junyi, et al.
Pubblicazione: (2026)
di: Li, Junyi, et al.
Pubblicazione: (2026)
Larger or Smaller Reward Margins to Select Preferences for Alignment?
di: Huang, Kexin, et al.
Pubblicazione: (2025)
di: Huang, Kexin, et al.
Pubblicazione: (2025)
MidPO: Dual Preference Optimization for Safety and Helpfulness in Large Language Models via a Mixture of Experts Framework
di: Qi, Yupeng, et al.
Pubblicazione: (2025)
di: Qi, Yupeng, et al.
Pubblicazione: (2025)
Cal-DPO: Calibrated Direct Preference Optimization for Language Model Alignment
di: Xiao, Teng, et al.
Pubblicazione: (2024)
di: Xiao, Teng, et al.
Pubblicazione: (2024)
KnowPO: Knowledge-aware Preference Optimization for Controllable Knowledge Selection in Retrieval-Augmented Language Models
di: Zhang, Ruizhe, et al.
Pubblicazione: (2024)
di: Zhang, Ruizhe, et al.
Pubblicazione: (2024)
HiPO: Hybrid Policy Optimization for Dynamic Reasoning in LLMs
di: Deng, Ken, et al.
Pubblicazione: (2025)
di: Deng, Ken, et al.
Pubblicazione: (2025)
LongPO: Long Context Self-Evolution of Large Language Models through Short-to-Long Preference Optimization
di: Chen, Guanzheng, et al.
Pubblicazione: (2025)
di: Chen, Guanzheng, et al.
Pubblicazione: (2025)
Topology-Enhanced Alignment for Large Language Models: Trajectory Topology Loss and Topological Preference Optimization
di: Pan, Yurui, et al.
Pubblicazione: (2026)
di: Pan, Yurui, et al.
Pubblicazione: (2026)
Self-Augmented Preference Optimization: Off-Policy Paradigms for Language Model Alignment
di: Yin, Yueqin, et al.
Pubblicazione: (2024)
di: Yin, Yueqin, et al.
Pubblicazione: (2024)
$f$-PO: Generalizing Preference Optimization with $f$-divergence Minimization
di: Han, Jiaqi, et al.
Pubblicazione: (2024)
di: Han, Jiaqi, et al.
Pubblicazione: (2024)
LiPO: Listwise Preference Optimization through Learning-to-Rank
di: Liu, Tianqi, et al.
Pubblicazione: (2024)
di: Liu, Tianqi, et al.
Pubblicazione: (2024)
MMedPO: Aligning Medical Vision-Language Models with Clinical-Aware Multimodal Preference Optimization
di: Zhu, Kangyu, et al.
Pubblicazione: (2024)
di: Zhu, Kangyu, et al.
Pubblicazione: (2024)
Efficient Safety Alignment of Large Language Models via Preference Re-ranking and Representation-based Reward Modeling
di: Deng, Qiyuan, et al.
Pubblicazione: (2025)
di: Deng, Qiyuan, et al.
Pubblicazione: (2025)
Group Preference Optimization: Few-Shot Alignment of Large Language Models
di: Zhao, Siyan, et al.
Pubblicazione: (2023)
di: Zhao, Siyan, et al.
Pubblicazione: (2023)
Advantage-Guided Distillation for Preference Alignment in Small Language Models
di: Gao, Shiping, et al.
Pubblicazione: (2025)
di: Gao, Shiping, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Legend: Leveraging Representation Engineering to Annotate Safety Margin for Preference Datasets
di: Feng, Duanyu, et al.
Pubblicazione: (2024) -
Towards Understanding the Influence of Reward Margin on Preference Model Performance
di: Qin, Bowen, et al.
Pubblicazione: (2024) -
DREditor: An Time-efficient Approach for Building a Domain-specific Dense Retrieval Model
di: Huang, Chen, et al.
Pubblicazione: (2024) -
Cross-model Transferability among Large Language Models on the Platonic Representations of Concepts
di: Huang, Youcheng, et al.
Pubblicazione: (2025) -
Dishonesty in Helpful and Harmless Alignment
di: Huang, Youcheng, et al.
Pubblicazione: (2024)