RecLLM-R1: A Two-Stage Training Paradigm with Reinforcement Learning and Chain-of-Thought v1

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Xie, Yu, Ren, Xingkai, Qi, Ying, Hu, Yao, Shan, Lianlei
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!