Towards Sample-Efficient and Stable Reinforcement Learning for LLM-based Recommendation

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Ding, Hongxun, Bao, Keqin, Zhang, Jizhi, Fang, Yi, Xu, Wenxin, Feng, Fuli, He, Xiangnan
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!