User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiang, Xingyuan, Pan, Xiangchen, Wei, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Joint Behavior-guided and Modality-coherence Conditional Graph Diffusion Denoising for Multi Modal Recommendation
par: Pan, Xiangchen, et autres
Publié: (2026)
par: Pan, Xiangchen, et autres
Publié: (2026)
Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation
par: Pan, Xiangchen, et autres
Publié: (2026)
par: Pan, Xiangchen, et autres
Publié: (2026)
MMP-Refer: Multimodal Path Retrieval-augmented LLMs For Explainable Recommendation
par: Pan, Xiangchen, et autres
Publié: (2026)
par: Pan, Xiangchen, et autres
Publié: (2026)
Diagnostic-Guided Dynamic Profile Optimization for LLM-based User Simulators in Sequential Recommendation
par: Liu, Hongyang, et autres
Publié: (2025)
par: Liu, Hongyang, et autres
Publié: (2025)
Empowering Retrieval-based Conversational Recommendation with Contrasting User Preferences
par: Kook, Heejin, et autres
Publié: (2025)
par: Kook, Heejin, et autres
Publié: (2025)
Reasoning over User Preferences: Knowledge Graph-Augmented LLMs for Explainable Conversational Recommendations
par: Qiu, Zhangchi, et autres
Publié: (2024)
par: Qiu, Zhangchi, et autres
Publié: (2024)
Reinforced Preference Optimization for Reasoning-Augmented Recommendations
par: Gao, Jingtong, et autres
Publié: (2026)
par: Gao, Jingtong, et autres
Publié: (2026)
User Invariant Preference Learning for Multi-Behavior Recommendation
par: Yan, Mingshi, et autres
Publié: (2025)
par: Yan, Mingshi, et autres
Publié: (2025)
HARPO: Hierarchical Agentic Reasoning for User-Aligned Conversational Recommendation
par: Raj, Subham, et autres
Publié: (2026)
par: Raj, Subham, et autres
Publié: (2026)
Identifying Breakdowns in Conversational Recommender Systems using User Simulation
par: Bernard, Nolwenn, et autres
Publié: (2024)
par: Bernard, Nolwenn, et autres
Publié: (2024)
Multi-agents based User Values Mining for Recommendation
par: Chen, Lijian, et autres
Publié: (2025)
par: Chen, Lijian, et autres
Publié: (2025)
Reinforced Preference Optimization for Recommendation
par: Tan, Junfei, et autres
Publié: (2025)
par: Tan, Junfei, et autres
Publié: (2025)
Direct Preference Optimization for LLM-Enhanced Recommendation Systems
par: Sun, Chao, et autres
Publié: (2024)
par: Sun, Chao, et autres
Publié: (2024)
Mirroring Users: Towards Building Preference-aligned User Simulator with User Feedback in Recommendation
par: Wei, Tianjun, et autres
Publié: (2025)
par: Wei, Tianjun, et autres
Publié: (2025)
Multi-Domain Recommendation to Attract Users via Domain Preference Modeling
par: Ju, Hyunjun, et autres
Publié: (2024)
par: Ju, Hyunjun, et autres
Publié: (2024)
Limitations of Current Evaluation Practices for Conversational Recommender Systems and the Potential of User Simulation
par: Bernard, Nolwenn, et autres
Publié: (2025)
par: Bernard, Nolwenn, et autres
Publié: (2025)
Refining Text Generation for Realistic Conversational Recommendation via Direct Preference Optimization
par: Tajiri, Manato, et autres
Publié: (2025)
par: Tajiri, Manato, et autres
Publié: (2025)
Reason4Rec: Large Language Models for Recommendation with Deliberative User Preference Alignment
par: Fang, Yi, et autres
Publié: (2025)
par: Fang, Yi, et autres
Publié: (2025)
Heterogeneous User Modeling for LLM-based Recommendation
par: Bao, Honghui, et autres
Publié: (2025)
par: Bao, Honghui, et autres
Publié: (2025)
Minimizing Live Experiments in Recommender Systems: User Simulation to Evaluate Preference Elicitation Policies
par: Hsu, Chih-Wei, et autres
Publié: (2024)
par: Hsu, Chih-Wei, et autres
Publié: (2024)
Vague Preference Policy Learning for Conversational Recommendation
par: Zhang, Gangyi, et autres
Publié: (2023)
par: Zhang, Gangyi, et autres
Publié: (2023)
Selecting User Histories to Generate LLM Users for Cold-Start Item Recommendation
par: Subbaraman, Nachiket, et autres
Publié: (2025)
par: Subbaraman, Nachiket, et autres
Publié: (2025)
Internalizing Multi-Agent Reasoning for Accurate and Efficient LLM-based Recommendation
par: Wu, Yang, et autres
Publié: (2026)
par: Wu, Yang, et autres
Publié: (2026)
UserSimCRS v2: Simulation-Based Evaluation for Conversational Recommender Systems
par: Bernard, Nolwenn, et autres
Publié: (2025)
par: Bernard, Nolwenn, et autres
Publié: (2025)
LLM-Powered User Simulator for Recommender System
par: Zhang, Zijian, et autres
Publié: (2024)
par: Zhang, Zijian, et autres
Publié: (2024)
Preference-Consistent Knowledge Distillation for Recommender System
par: Zhu, Zhangchi, et autres
Publié: (2023)
par: Zhu, Zhangchi, et autres
Publié: (2023)
Generate and Instantiate What You Prefer: Text-Guided Diffusion for Sequential Recommendation
par: Hu, Guoqing, et autres
Publié: (2024)
par: Hu, Guoqing, et autres
Publié: (2024)
Improving Conversational Recommendation with Contextual Adaptation of External Recommenders and LLM-based Reranking
par: Li, Chuang, et autres
Publié: (2025)
par: Li, Chuang, et autres
Publié: (2025)
MLLMRec: A Preference Reasoning Paradigm with Graph Refinement for Multimodal Recommendation
par: Dang, Yuzhuo, et autres
Publié: (2025)
par: Dang, Yuzhuo, et autres
Publié: (2025)
Stop Playing the Guessing Game! Target-free User Simulation for Evaluating Conversational Recommender Systems
par: Kim, Sunghwan, et autres
Publié: (2024)
par: Kim, Sunghwan, et autres
Publié: (2024)
Verifiable Reasoning for LLM-based Generative Recommendation
par: Lin, Xinyu, et autres
Publié: (2026)
par: Lin, Xinyu, et autres
Publié: (2026)
Factorized Latent Reasoning for LLM-based Recommendation
par: Gao, Tianqi, et autres
Publié: (2026)
par: Gao, Tianqi, et autres
Publié: (2026)
LLM-based Bi-level Multi-interest Learning Framework for Sequential Recommendation
par: Qiao, Shutong, et autres
Publié: (2024)
par: Qiao, Shutong, et autres
Publié: (2024)
Multi-Grained Patch Training for Efficient LLM-based Recommendation
par: Liao, Jiayi, et autres
Publié: (2025)
par: Liao, Jiayi, et autres
Publié: (2025)
Decision-aware User Simulation Agent for Evaluating Conversational Recommender Systems
par: Li, Yuan-Chi, et autres
Publié: (2026)
par: Li, Yuan-Chi, et autres
Publié: (2026)
On the Reliability of User-Centric Evaluation of Conversational Recommender Systems
par: Müller, Michael, et autres
Publié: (2026)
par: Müller, Michael, et autres
Publié: (2026)
On Softmax Direct Preference Optimization for Recommendation
par: Chen, Yuxin, et autres
Publié: (2024)
par: Chen, Yuxin, et autres
Publié: (2024)
Oracle-guided Dynamic User Preference Modeling for Sequential Recommendation
par: Xia, Jiafeng, et autres
Publié: (2024)
par: Xia, Jiafeng, et autres
Publié: (2024)
Break the Optimization Barrier of LLM-Enhanced Recommenders: A Theoretical Analysis and Practical Framework
par: Zhu, Zhangchi, et autres
Publié: (2026)
par: Zhu, Zhangchi, et autres
Publié: (2026)
On Negative-aware Preference Optimization for Recommendation
par: Ding, Chenlu, et autres
Publié: (2025)
par: Ding, Chenlu, et autres
Publié: (2025)
Documents similaires
-
Joint Behavior-guided and Modality-coherence Conditional Graph Diffusion Denoising for Multi Modal Recommendation
par: Pan, Xiangchen, et autres
Publié: (2026) -
Curr-RLCER:Curriculum Reinforcement Learning For Coherence Explainable Recommendation
par: Pan, Xiangchen, et autres
Publié: (2026) -
MMP-Refer: Multimodal Path Retrieval-augmented LLMs For Explainable Recommendation
par: Pan, Xiangchen, et autres
Publié: (2026) -
Diagnostic-Guided Dynamic Profile Optimization for LLM-based User Simulators in Sequential Recommendation
par: Liu, Hongyang, et autres
Publié: (2025) -
Empowering Retrieval-based Conversational Recommendation with Contrasting User Preferences
par: Kook, Heejin, et autres
Publié: (2025)