Each Prompt Matters: Scaling Reinforcement Learning Without Wasting Rollouts on Hundred-Billion-Scale MoE

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Zeng, Anxiang, Zhang, Haibo, Zhang, Hailing, Mo, Kaixiang, Yao, Liang, Hu, Ling, Zhang, Long, Liu, Shuman, Xie, Shuyi, Li, Yanshi, Chen, Yizhang, Sheng, Yuepeng, Huang, Yuwei, Xu, Zhaochen, Zhou, Zhiqiang, Liew, Ziqin
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!

Similar Items