History Rhymes: Accelerating LLM Reinforcement Learning with RhymeRL

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: He, Jingkai, Li, Tianjian, Feng, Erhu, Du, Dong, Liu, Qian, Liu, Tao, Xia, Yubin, Chen, Haibo
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!