UltraLogic: Enhancing LLM Reasoning through Large-Scale Data Synthesis and Bipolar Float Reward

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Liu, Yile, Liu, Yixian, Li, Zongwei, Huang, Yufei, Feng, Xinhua, Hu, Zhichao, Hu, Jinglu, Yan, Jianfeng, Lian, Fengzong, Liu, Yuhong
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!