UltraLogic: Enhancing LLM Reasoning through Large-Scale Data Synthesis and Bipolar Float Reward

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Liu, Yile, Liu, Yixian, Li, Zongwei, Huang, Yufei, Feng, Xinhua, Hu, Zhichao, Hu, Jinglu, Yan, Jianfeng, Lian, Fengzong, Liu, Yuhong
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!