RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive Verifiable Environments

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Zeng, Zhiyuan, Ivison, Hamish, Wang, Yiping, Yuan, Lifan, Li, Shuyue Stella, Ye, Zhuorui, Li, Siting, He, Jacqueline, Zhou, Runlong, Chen, Tong, Zhao, Chenyang, Tsvetkov, Yulia, Du, Simon Shaolei, Jaques, Natasha, Peng, Hao, Koh, Pang Wei, Hajishirzi, Hannaneh
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi