DORA: A Scalable Asynchronous Reinforcement Learning System for Language Model Training

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Hu, Tianhao, Liu, Xiangcheng, Xiao, Youshao, Zheng, Yang, Huang, Xuan, Ding, Jinrui, Zhang, Yufei, Liang, Tao, Zang, Hongyu, Chen, Quan, Sun, Yueqing, Shi, Wenjie, Zhang, Chao, Wang, Wei, Gu, Qi, Sun, Yerui, Xie, Yucheng, Cai, Xunliang
Format: Preprint
Published: 2026
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!

Similar Items