ReliableMath: Benchmark of Reliable Mathematical Reasoning on Large Language Models

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Xue, Boyang, Zhu, Qi, Wang, Rui, Wang, Sheng, Wang, Hongru, Hu, Minda, Mi, Fei, Wang, Yasheng, Shang, Lifeng, Liu, Qun, Wong, Kam-Fai
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires