One Model, All Roles: Multi-Turn, Multi-Agent Self-Play Reinforcement Learning for Conversational Social Intelligence

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Jiang, Bowen, Shi, Taiwei, Kamoi, Ryo, Yuan, Yuan, Taylor, Camillo J., Yang, Longqi, Zhou, Pei, Chen, Sihao
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!