UltraLogic: Enhancing LLM Reasoning through Large-Scale Data Synthesis and Bipolar Float Reward

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Liu, Yile, Liu, Yixian, Li, Zongwei, Huang, Yufei, Feng, Xinhua, Hu, Zhichao, Hu, Jinglu, Yan, Jianfeng, Lian, Fengzong, Liu, Yuhong
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!

Ähnliche Einträge