Shop-R1: Rewarding LLMs to Simulate Human Behavior in Online Shopping via Reinforcement Learning

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Zhang, Yimeng, Wang, Tian, Gesi, Jiri, Wang, Ziyi, Lu, Yuxuan, Lin, Jiacheng, Zhan, Sinong, Gao, Vianne, Jiao, Ruochen, Liu, Junze, Qian, Kun, Tang, Yuxin, Xue, Ran, Zhang, Houyu, Cui, Qingjun, Guo, Yufan, Wang, Dakuo
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!