Rank-GRPO: Training LLM-based Conversational Recommender Systems with Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Yaochen, Steck, Harald, Liang, Dawen, He, Yinhan, Ostuni, Vito, Li, Jundong, Kallus, Nathan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Collaborative Retrieval for Large Language Model-based Conversational Recommender Systems
di: Zhu, Yaochen, et al.
Pubblicazione: (2025)
di: Zhu, Yaochen, et al.
Pubblicazione: (2025)
Does Weighting Improve Matrix Factorization for Recommender Systems?
di: Ayoub, Alex, et al.
Pubblicazione: (2025)
di: Ayoub, Alex, et al.
Pubblicazione: (2025)
From Reviews to Dialogues: Active Synthesis for Zero-Shot LLM-based Conversational Recommender System
di: Surana, Rohan, et al.
Pubblicazione: (2025)
di: Surana, Rohan, et al.
Pubblicazione: (2025)
Reindex-Then-Adapt: Improving Large Language Models for Conversational Recommendation
di: He, Zhankui, et al.
Pubblicazione: (2024)
di: He, Zhankui, et al.
Pubblicazione: (2024)
Is Cosine-Similarity of Embeddings Really About Similarity?
di: Steck, Harald, et al.
Pubblicazione: (2024)
di: Steck, Harald, et al.
Pubblicazione: (2024)
Collaborative Large Language Model for Recommender Systems
di: Zhu, Yaochen, et al.
Pubblicazione: (2023)
di: Zhu, Yaochen, et al.
Pubblicazione: (2023)
Collaborative Diffusion Model for Recommender System
di: Lee, Gyuseok, et al.
Pubblicazione: (2025)
di: Lee, Gyuseok, et al.
Pubblicazione: (2025)
Joint Modeling of Search and Recommendations Via an Unified Contextual Recommender (UniCoRn)
di: Bhattacharya, Moumita, et al.
Pubblicazione: (2024)
di: Bhattacharya, Moumita, et al.
Pubblicazione: (2024)
Retrieval Augmented Conversational Recommendation with Reinforcement Learning
di: Yue, Zhenrui, et al.
Pubblicazione: (2026)
di: Yue, Zhenrui, et al.
Pubblicazione: (2026)
Improving Conversational Recommendation with Contextual Adaptation of External Recommenders and LLM-based Reranking
di: Li, Chuang, et al.
Pubblicazione: (2025)
di: Li, Chuang, et al.
Pubblicazione: (2025)
Towards Sample-Efficient and Stable Reinforcement Learning for LLM-based Recommendation
di: Ding, Hongxun, et al.
Pubblicazione: (2026)
di: Ding, Hongxun, et al.
Pubblicazione: (2026)
MiniRec: Data-Efficient Reinforcement Learning for LLM-based Recommendation
di: Wang, Lin, et al.
Pubblicazione: (2026)
di: Wang, Lin, et al.
Pubblicazione: (2026)
Federated Conversational Recommender System
di: Lin, Allen, et al.
Pubblicazione: (2025)
di: Lin, Allen, et al.
Pubblicazione: (2025)
Understanding and Modeling Job Marketplace with Pretrained Language Models
di: Zhu, Yaochen, et al.
Pubblicazione: (2024)
di: Zhu, Yaochen, et al.
Pubblicazione: (2024)
Snippet-based Conversational Recommender System
di: Sun, Haibo, et al.
Pubblicazione: (2024)
di: Sun, Haibo, et al.
Pubblicazione: (2024)
Multi-Grained Patch Training for Efficient LLM-based Recommendation
di: Liao, Jiayi, et al.
Pubblicazione: (2025)
di: Liao, Jiayi, et al.
Pubblicazione: (2025)
Preference and Concurrence Aware Bayesian Graph Neural Networks for Recommender Systems
di: Gu, Hongjian, et al.
Pubblicazione: (2023)
di: Gu, Hongjian, et al.
Pubblicazione: (2023)
Consistency and Discrepancy-Based Contrastive Tripartite Graph Learning for Recommendations
di: Guo, Linxin, et al.
Pubblicazione: (2024)
di: Guo, Linxin, et al.
Pubblicazione: (2024)
Continual Low-Rank Adapters for LLM-based Generative Recommender Systems
di: Yoo, Hyunsik, et al.
Pubblicazione: (2025)
di: Yoo, Hyunsik, et al.
Pubblicazione: (2025)
Sparser Training for On-Device Recommendation Systems
di: Qu, Yunke, et al.
Pubblicazione: (2024)
di: Qu, Yunke, et al.
Pubblicazione: (2024)
Generative Conversational Recommender System
di: Zhang, Sixiao, et al.
Pubblicazione: (2026)
di: Zhang, Sixiao, et al.
Pubblicazione: (2026)
Pairwise Ranking Loss for Multi-Task Learning in Recommender Systems
di: Durmus, Furkan, et al.
Pubblicazione: (2024)
di: Durmus, Furkan, et al.
Pubblicazione: (2024)
GraphRAG-IRL: Personalized Recommendation with Graph-Grounded Inverse Reinforcement Learning and LLM Re-ranking
di: Liang, Siqi, et al.
Pubblicazione: (2026)
di: Liang, Siqi, et al.
Pubblicazione: (2026)
Rethinking Multi-objective Ranking Ensemble in Recommender System: From Score Fusion to Rank Consistency
di: Xia, Boyang, et al.
Pubblicazione: (2026)
di: Xia, Boyang, et al.
Pubblicazione: (2026)
Optimizing Conversational Product Recommendation via Reinforcement Learning
di: Liu, Kang
Pubblicazione: (2025)
di: Liu, Kang
Pubblicazione: (2025)
OpenP5: An Open-Source Platform for Developing, Training, and Evaluating LLM-based Recommender Systems
di: Xu, Shuyuan, et al.
Pubblicazione: (2023)
di: Xu, Shuyuan, et al.
Pubblicazione: (2023)
Failure Prediction in Conversational Recommendation Systems
di: Vlachou, Maria
Pubblicazione: (2025)
di: Vlachou, Maria
Pubblicazione: (2025)
Real-Time Personalization for LLM-based Recommendation with Customized In-Context Learning
di: Bao, Keqin, et al.
Pubblicazione: (2024)
di: Bao, Keqin, et al.
Pubblicazione: (2024)
Behavior Alignment: A New Perspective of Evaluating LLM-based Conversational Recommender Systems
di: Yang, Dayu, et al.
Pubblicazione: (2024)
di: Yang, Dayu, et al.
Pubblicazione: (2024)
Reformulating Conversational Recommender Systems as Tri-Phase Offline Policy Learning
di: Zhang, Gangyi, et al.
Pubblicazione: (2024)
di: Zhang, Gangyi, et al.
Pubblicazione: (2024)
Beyond Static LLM Policies: Imitation-Enhanced Reinforcement Learning for Recommendation
di: Zhang, Yi, et al.
Pubblicazione: (2025)
di: Zhang, Yi, et al.
Pubblicazione: (2025)
Retrieval-GRPO: A Multi-Objective Reinforcement Learning Framework for Dense Retrieval in Taobao Search
di: Liu, Xingxian, et al.
Pubblicazione: (2025)
di: Liu, Xingxian, et al.
Pubblicazione: (2025)
GORACS: Group-level Optimal Transport-guided Coreset Selection for LLM-based Recommender Systems
di: Mei, Tiehua, et al.
Pubblicazione: (2025)
di: Mei, Tiehua, et al.
Pubblicazione: (2025)
User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation
di: Xiang, Xingyuan, et al.
Pubblicazione: (2026)
di: Xiang, Xingyuan, et al.
Pubblicazione: (2026)
Efficiency Unleashed: Inference Acceleration for LLM-based Recommender Systems with Speculative Decoding
di: Xi, Yunjia, et al.
Pubblicazione: (2024)
di: Xi, Yunjia, et al.
Pubblicazione: (2024)
On Mitigating Data Sparsity in Conversational Recommender Systems
di: Zhang, Sixiao, et al.
Pubblicazione: (2025)
di: Zhang, Sixiao, et al.
Pubblicazione: (2025)
Direct Preference Optimization for LLM-Enhanced Recommendation Systems
di: Sun, Chao, et al.
Pubblicazione: (2024)
di: Sun, Chao, et al.
Pubblicazione: (2024)
Zeroshot Listwise Learning to Rank Algorithm for Recommendation
di: Wang, Hao
Pubblicazione: (2024)
di: Wang, Hao
Pubblicazione: (2024)
RankMixer: Scaling Up Ranking Models in Industrial Recommenders
di: Zhu, Jie, et al.
Pubblicazione: (2025)
di: Zhu, Jie, et al.
Pubblicazione: (2025)
Reinforcement Learning-based Recommender Systems with Large Language Models for State Reward and Action Modeling
di: Wang, Jie, et al.
Pubblicazione: (2024)
di: Wang, Jie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Collaborative Retrieval for Large Language Model-based Conversational Recommender Systems
di: Zhu, Yaochen, et al.
Pubblicazione: (2025) -
Does Weighting Improve Matrix Factorization for Recommender Systems?
di: Ayoub, Alex, et al.
Pubblicazione: (2025) -
From Reviews to Dialogues: Active Synthesis for Zero-Shot LLM-based Conversational Recommender System
di: Surana, Rohan, et al.
Pubblicazione: (2025) -
Reindex-Then-Adapt: Improving Large Language Models for Conversational Recommendation
di: He, Zhankui, et al.
Pubblicazione: (2024) -
Is Cosine-Similarity of Embeddings Really About Similarity?
di: Steck, Harald, et al.
Pubblicazione: (2024)