Jet-RL: Enabling On-Policy FP8 Reinforcement Learning with Unified Training and Rollout Precision Flow

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Xi, Haocheng, Ruan, Charlie, Liao, Peiyuan, Lin, Yujun, Cai, Han, Zhao, Yilong, Yang, Shuo, Keutzer, Kurt, Han, Song, Zhu, Ligeng
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!