Enregistré dans:
| Auteurs principaux: | Yin, Junhao, Wang, Haolin, Bao, Peng, Xu, Ju, Wang, Yongliang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2508.15811 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Faceted Self-Consistent Preference Alignment for Query Rewriting in Conversational Search
par: Cao, Zhiyu, et autres
Publié: (2026)
par: Cao, Zhiyu, et autres
Publié: (2026)
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
par: Wu, Jiayi, et autres
Publié: (2024)
par: Wu, Jiayi, et autres
Publié: (2024)
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
par: Lyu, Yougang, et autres
Publié: (2024)
par: Lyu, Yougang, et autres
Publié: (2024)
ImageRef-VL: Enabling Contextual Image Referencing in Vision-Language Models
par: Yi, Jingwei, et autres
Publié: (2025)
par: Yi, Jingwei, et autres
Publié: (2025)
Disentangling Preference Representation and Text Generation for Efficient Individual Preference Alignment
par: Zhang, Jianfei, et autres
Publié: (2024)
par: Zhang, Jianfei, et autres
Publié: (2024)
Enhancing Multilingual Counterfactual Generation through Alignment-as-Preference Optimization
par: Wang, Yilong, et autres
Publié: (2026)
par: Wang, Yilong, et autres
Publié: (2026)
Mitigating the Negative Impact of Over-association for Conversational Query Production
par: Wang, Ante, et autres
Publié: (2024)
par: Wang, Ante, et autres
Publié: (2024)
Preference Orchestrator: Prompt-Aware Multi-Objective Alignment for Large Language Models
par: Liu, Biao, et autres
Publié: (2025)
par: Liu, Biao, et autres
Publié: (2025)
Think Twice, Click Once: Enhancing GUI Grounding via Fast and Slow Systems
par: Tang, Fei, et autres
Publié: (2025)
par: Tang, Fei, et autres
Publié: (2025)
Preference Ranking Optimization for Human Alignment
par: Song, Feifan, et autres
Publié: (2023)
par: Song, Feifan, et autres
Publié: (2023)
Uncovering Factor Level Preferences to Improve Human-Model Alignment
par: Oh, Juhyun, et autres
Publié: (2024)
par: Oh, Juhyun, et autres
Publié: (2024)
Generating Usage-related Questions for Preference Elicitation in Conversational Recommender Systems
par: Kostric, Ivica, et autres
Publié: (2021)
par: Kostric, Ivica, et autres
Publié: (2021)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
par: Wang, Haoxiang, et autres
Publié: (2024)
par: Wang, Haoxiang, et autres
Publié: (2024)
TODO: Enhancing LLM Alignment with Ternary Preferences
par: Guo, Yuxiang, et autres
Publié: (2024)
par: Guo, Yuxiang, et autres
Publié: (2024)
Knowledgeable Preference Alignment for LLMs in Domain-specific Question Answering
par: Zhang, Yichi, et autres
Publié: (2023)
par: Zhang, Yichi, et autres
Publié: (2023)
From Query to Logic: Ontology-Driven Multi-Hop Reasoning in LLMs
par: Bian, Haonan, et autres
Publié: (2025)
par: Bian, Haonan, et autres
Publié: (2025)
PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
par: Ji, Jiaming, et autres
Publié: (2024)
par: Ji, Jiaming, et autres
Publié: (2024)
StoryWriter: A Multi-Agent Framework for Long Story Generation
par: Xia, Haotian, et autres
Publié: (2025)
par: Xia, Haotian, et autres
Publié: (2025)
TPO: Aligning Large Language Models with Multi-branch & Multi-step Preference Trees
par: Liao, Weibin, et autres
Publié: (2024)
par: Liao, Weibin, et autres
Publié: (2024)
ComPO: Preference Alignment via Comparison Oracles
par: Chen, Peter, et autres
Publié: (2025)
par: Chen, Peter, et autres
Publié: (2025)
Implicit Cross-Lingual Rewarding for Efficient Multilingual Preference Alignment
par: Yang, Wen, et autres
Publié: (2025)
par: Yang, Wen, et autres
Publié: (2025)
From Query to Counsel: Structured Reasoning with a Multi-Agent Framework and Dataset for Legal Consultation
par: Lu, Mingfei, et autres
Publié: (2026)
par: Lu, Mingfei, et autres
Publié: (2026)
ICDPO: Effectively Borrowing Alignment Capability of Others via In-context Direct Preference Optimization
par: Song, Feifan, et autres
Publié: (2024)
par: Song, Feifan, et autres
Publié: (2024)
Northeastern Uni at Multilingual Counterspeech Generation: Enhancing Counter Speech Generation with LLM Alignment through Direct Preference Optimization
par: Wadhwa, Sahil, et autres
Publié: (2024)
par: Wadhwa, Sahil, et autres
Publié: (2024)
Agentic Reward Modeling: Integrating Human Preferences with Verifiable Correctness Signals for Reliable Reward Systems
par: Peng, Hao, et autres
Publié: (2025)
par: Peng, Hao, et autres
Publié: (2025)
Word Alignment as Preference for Machine Translation
par: Wu, Qiyu, et autres
Publié: (2024)
par: Wu, Qiyu, et autres
Publié: (2024)
RGD: Multi-LLM Based Agent Debugger via Refinement and Generation Guidance
par: Jin, Haolin, et autres
Publié: (2024)
par: Jin, Haolin, et autres
Publié: (2024)
Understand What LLM Needs: Dual Preference Alignment for Retrieval-Augmented Generation
par: Dong, Guanting, et autres
Publié: (2024)
par: Dong, Guanting, et autres
Publié: (2024)
Well Begun is Half Done: Low-resource Preference Alignment by Weak-to-Strong Decoding
par: Song, Feifan, et autres
Publié: (2025)
par: Song, Feifan, et autres
Publié: (2025)
OnePred: Next-Query Prediction via Recursive Intent Memory in Multi-Turn Conversations
par: Chen, Jiangwang, et autres
Publié: (2026)
par: Chen, Jiangwang, et autres
Publié: (2026)
AlpsBench: An LLM Personalization Benchmark for Real-Dialogue Memorization and Preference Alignment
par: Xiao, Jianfei, et autres
Publié: (2026)
par: Xiao, Jianfei, et autres
Publié: (2026)
FlipGuard: Defending Preference Alignment against Update Regression with Constrained Optimization
par: Zhu, Mingye, et autres
Publié: (2024)
par: Zhu, Mingye, et autres
Publié: (2024)
Relative Preference Optimization: Enhancing LLM Alignment through Contrasting Responses across Identical and Diverse Prompts
par: Yin, Yueqin, et autres
Publié: (2024)
par: Yin, Yueqin, et autres
Publié: (2024)
CriSPO: Multi-Aspect Critique-Suggestion-guided Automatic Prompt Optimization for Text Generation
par: He, Han, et autres
Publié: (2024)
par: He, Han, et autres
Publié: (2024)
Larger or Smaller Reward Margins to Select Preferences for Alignment?
par: Huang, Kexin, et autres
Publié: (2025)
par: Huang, Kexin, et autres
Publié: (2025)
From Events to Trending: A Multi-Stage Hotspots Detection Method Based on Generative Query Indexing
par: Wang, Kaichun, et autres
Publié: (2025)
par: Wang, Kaichun, et autres
Publié: (2025)
PRACTIQ: A Practical Conversational Text-to-SQL dataset with Ambiguous and Unanswerable Queries
par: Dong, Mingwen, et autres
Publié: (2024)
par: Dong, Mingwen, et autres
Publié: (2024)
From RLHF to Direct Alignment: A Theoretical Unification of Preference Learning for Large Language Models
par: Raheja, Tarun, et autres
Publié: (2026)
par: Raheja, Tarun, et autres
Publié: (2026)
Controllable Preference Optimization: Toward Controllable Multi-Objective Alignment
par: Guo, Yiju, et autres
Publié: (2024)
par: Guo, Yiju, et autres
Publié: (2024)
SafeCRS: Personalized Safety Alignment for LLM-Based Conversational Recommender Systems
par: Hao, Haochang, et autres
Publié: (2026)
par: Hao, Haochang, et autres
Publié: (2026)
Documents similaires
-
Multi-Faceted Self-Consistent Preference Alignment for Query Rewriting in Conversational Search
par: Cao, Zhiyu, et autres
Publié: (2026) -
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
par: Wu, Jiayi, et autres
Publié: (2024) -
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
par: Lyu, Yougang, et autres
Publié: (2024) -
ImageRef-VL: Enabling Contextual Image Referencing in Vision-Language Models
par: Yi, Jingwei, et autres
Publié: (2025) -
Disentangling Preference Representation and Text Generation for Efficient Individual Preference Alignment
par: Zhang, Jianfei, et autres
Publié: (2024)