Self-supervised Attribute-aware Dynamic Preference Ranking Alignment
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Hongyu, Zhao, Qi, hu, Zhenhua, Li, Rui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Preference Ranking Optimization for Human Alignment
di: Song, Feifan, et al.
Pubblicazione: (2023)
di: Song, Feifan, et al.
Pubblicazione: (2023)
Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
di: Li, Jian, et al.
Pubblicazione: (2024)
di: Li, Jian, et al.
Pubblicazione: (2024)
Aligning LLMs through Multi-perspective User Preference Ranking-based Feedback for Programming Question Answering
di: Yang, Hongyu, et al.
Pubblicazione: (2024)
di: Yang, Hongyu, et al.
Pubblicazione: (2024)
MiCRo: Mixture Modeling and Context-aware Routing for Personalized Preference Learning
di: Shen, Jingyan, et al.
Pubblicazione: (2025)
di: Shen, Jingyan, et al.
Pubblicazione: (2025)
Transitivity Meets Cyclicity: Explicit Preference Decomposition for Dynamic Large Language Model Alignment
di: Huang, Yucong, et al.
Pubblicazione: (2026)
di: Huang, Yucong, et al.
Pubblicazione: (2026)
Multi-Faceted Self-Consistent Preference Alignment for Query Rewriting in Conversational Search
di: Cao, Zhiyu, et al.
Pubblicazione: (2026)
di: Cao, Zhiyu, et al.
Pubblicazione: (2026)
Rewards-in-Context: Multi-objective Alignment of Foundation Models with Dynamic Preference Adjustment
di: Yang, Rui, et al.
Pubblicazione: (2024)
di: Yang, Rui, et al.
Pubblicazione: (2024)
Self-Play Preference Optimization for Language Model Alignment
di: Wu, Yue, et al.
Pubblicazione: (2024)
di: Wu, Yue, et al.
Pubblicazione: (2024)
Self-Supervised Visual Preference Alignment
di: Zhu, Ke, et al.
Pubblicazione: (2024)
di: Zhu, Ke, et al.
Pubblicazione: (2024)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
di: Wang, Haoxiang, et al.
Pubblicazione: (2024)
di: Wang, Haoxiang, et al.
Pubblicazione: (2024)
Curry-DPO: Enhancing Alignment using Curriculum Learning & Ranked Preferences
di: Pattnaik, Pulkit, et al.
Pubblicazione: (2024)
di: Pattnaik, Pulkit, et al.
Pubblicazione: (2024)
Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference
di: Gao, Mingqi, et al.
Pubblicazione: (2024)
di: Gao, Mingqi, et al.
Pubblicazione: (2024)
Disentangling Preference Representation and Text Generation for Efficient Individual Preference Alignment
di: Zhang, Jianfei, et al.
Pubblicazione: (2024)
di: Zhang, Jianfei, et al.
Pubblicazione: (2024)
SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
FocalPO: Enhancing Preference Optimizing by Focusing on Correct Preference Rankings
di: Liu, Tong, et al.
Pubblicazione: (2025)
di: Liu, Tong, et al.
Pubblicazione: (2025)
From 1,000,000 Users to Every User: Scaling Up Personalized Preference for User-level Alignment
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
Fennec: Fine-grained Language Model Evaluation and Correction Extended through Branching and Bridging
di: Liang, Xiaobo, et al.
Pubblicazione: (2024)
di: Liang, Xiaobo, et al.
Pubblicazione: (2024)
Word Alignment as Preference for Machine Translation
di: Wu, Qiyu, et al.
Pubblicazione: (2024)
di: Wu, Qiyu, et al.
Pubblicazione: (2024)
Implicit Cross-Lingual Rewarding for Efficient Multilingual Preference Alignment
di: Yang, Wen, et al.
Pubblicazione: (2025)
di: Yang, Wen, et al.
Pubblicazione: (2025)
A Systematic Evaluation of Preference Aggregation in Federated RLHF for Pluralistic Alignment of LLMs
di: Srewa, Mahmoud, et al.
Pubblicazione: (2025)
di: Srewa, Mahmoud, et al.
Pubblicazione: (2025)
Enhancing Multilingual Counterfactual Generation through Alignment-as-Preference Optimization
di: Wang, Yilong, et al.
Pubblicazione: (2026)
di: Wang, Yilong, et al.
Pubblicazione: (2026)
More RLHF, More Trust? On The Impact of Preference Alignment On Trustworthiness
di: Li, Aaron J., et al.
Pubblicazione: (2024)
di: Li, Aaron J., et al.
Pubblicazione: (2024)
Improving Attributed Text Generation of Large Language Models via Preference Learning
di: Li, Dongfang, et al.
Pubblicazione: (2024)
di: Li, Dongfang, et al.
Pubblicazione: (2024)
Advancing Large Language Model Attribution through Self-Improving
di: Huang, Lei, et al.
Pubblicazione: (2024)
di: Huang, Lei, et al.
Pubblicazione: (2024)
Uncovering Factor Level Preferences to Improve Human-Model Alignment
di: Oh, Juhyun, et al.
Pubblicazione: (2024)
di: Oh, Juhyun, et al.
Pubblicazione: (2024)
Revisiting Self-Consistency from Dynamic Distributional Alignment Perspective on Answer Aggregation
di: Li, Yiwei, et al.
Pubblicazione: (2025)
di: Li, Yiwei, et al.
Pubblicazione: (2025)
Knowledgeable Preference Alignment for LLMs in Domain-specific Question Answering
di: Zhang, Yichi, et al.
Pubblicazione: (2023)
di: Zhang, Yichi, et al.
Pubblicazione: (2023)
DSPA: Dynamic SAE Steering for Data-Efficient Preference Alignment
di: Wedgwood, James, et al.
Pubblicazione: (2026)
di: Wedgwood, James, et al.
Pubblicazione: (2026)
Preference Orchestrator: Prompt-Aware Multi-Objective Alignment for Large Language Models
di: Liu, Biao, et al.
Pubblicazione: (2025)
di: Liu, Biao, et al.
Pubblicazione: (2025)
Preference Learning Algorithms Do Not Learn Preference Rankings
di: Chen, Angelica, et al.
Pubblicazione: (2024)
di: Chen, Angelica, et al.
Pubblicazione: (2024)
Hit-RAG: Learning to Reason with Long Contexts via Preference Alignment
di: Liu, Junming, et al.
Pubblicazione: (2026)
di: Liu, Junming, et al.
Pubblicazione: (2026)
RPO-RAG: Aligning Small LLMs with Relation-aware Preference Optimization for Knowledge Graph Question Answering
di: Um, Kaehyun, et al.
Pubblicazione: (2026)
di: Um, Kaehyun, et al.
Pubblicazione: (2026)
On-the-fly Preference Alignment via Principle-Guided Decoding
di: Zhu, Mingye, et al.
Pubblicazione: (2025)
di: Zhu, Mingye, et al.
Pubblicazione: (2025)
Beyond Under-Alignment: Atomic Preference Enhanced Factuality Tuning for Large Language Models
di: Yuan, Hongbang, et al.
Pubblicazione: (2024)
di: Yuan, Hongbang, et al.
Pubblicazione: (2024)
Preference Alignment Improves Language Model-Based TTS
di: Tian, Jinchuan, et al.
Pubblicazione: (2024)
di: Tian, Jinchuan, et al.
Pubblicazione: (2024)
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
di: Wu, Jiayi, et al.
Pubblicazione: (2024)
di: Wu, Jiayi, et al.
Pubblicazione: (2024)
Not All Preferences are What You Need for Post-Training: Selective Alignment Strategy for Preference Optimization
di: Dong, Zhijin
Pubblicazione: (2025)
di: Dong, Zhijin
Pubblicazione: (2025)
SwiftMem: Fast Agentic Memory via Query-aware Indexing
di: Tian, Anxin, et al.
Pubblicazione: (2026)
di: Tian, Anxin, et al.
Pubblicazione: (2026)
Clean First, Align Later: Benchmarking Preference Data Cleaning for Reliable LLM Alignment
di: Yeh, Samuel, et al.
Pubblicazione: (2025)
di: Yeh, Samuel, et al.
Pubblicazione: (2025)
Ranking LLMs by compression
di: Guo, Peijia, et al.
Pubblicazione: (2024)
di: Guo, Peijia, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Preference Ranking Optimization for Human Alignment
di: Song, Feifan, et al.
Pubblicazione: (2023) -
Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
di: Li, Jian, et al.
Pubblicazione: (2024) -
Aligning LLMs through Multi-perspective User Preference Ranking-based Feedback for Programming Question Answering
di: Yang, Hongyu, et al.
Pubblicazione: (2024) -
MiCRo: Mixture Modeling and Context-aware Routing for Personalized Preference Learning
di: Shen, Jingyan, et al.
Pubblicazione: (2025) -
Transitivity Meets Cyclicity: Explicit Preference Decomposition for Dynamic Large Language Model Alignment
di: Huang, Yucong, et al.
Pubblicazione: (2026)