MathSmith: Towards Extremely Hard Mathematical Reasoning by Forging Synthetic Problems with a Reinforced Policy
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhan, Shaoxiong, Lai, Yanlin, Lu, Ziyu, Lin, Dahua, Yang, Ziqing, Tan, Fei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
More Data or Better Data? A Critical Analysis of Data Selection and Synthesis for Mathematical Reasoning
di: Zhao, Yike, et al.
Pubblicazione: (2025)
di: Zhao, Yike, et al.
Pubblicazione: (2025)
MathGenie: Generating Synthetic Data with Question Back-translation for Enhancing Mathematical Reasoning of LLMs
di: Lu, Zimu, et al.
Pubblicazione: (2024)
di: Lu, Zimu, et al.
Pubblicazione: (2024)
Verifier-Backed Hard Problem Generation for Mathematical Reasoning
di: Lai, Yuhang, et al.
Pubblicazione: (2026)
di: Lai, Yuhang, et al.
Pubblicazione: (2026)
MathOdyssey: Benchmarking Mathematical Problem-Solving Skills in Large Language Models Using Odyssey Math Data
di: Fang, Meng, et al.
Pubblicazione: (2024)
di: Fang, Meng, et al.
Pubblicazione: (2024)
PolyMath: Evaluating Mathematical Reasoning in Multilingual Contexts
di: Wang, Yiming, et al.
Pubblicazione: (2025)
di: Wang, Yiming, et al.
Pubblicazione: (2025)
InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning
di: Ying, Huaiyuan, et al.
Pubblicazione: (2024)
di: Ying, Huaiyuan, et al.
Pubblicazione: (2024)
Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems
di: Wei, Chengwei, et al.
Pubblicazione: (2025)
di: Wei, Chengwei, et al.
Pubblicazione: (2025)
MathBench: Evaluating the Theory and Application Proficiency of LLMs with a Hierarchical Mathematics Benchmark
di: Liu, Hongwei, et al.
Pubblicazione: (2024)
di: Liu, Hongwei, et al.
Pubblicazione: (2024)
DeepSeekMath-V2: Towards Self-Verifiable Mathematical Reasoning
di: Shao, Zhihong, et al.
Pubblicazione: (2025)
di: Shao, Zhihong, et al.
Pubblicazione: (2025)
MathCoder2: Better Math Reasoning from Continued Pretraining on Model-translated Mathematical Code
di: Lu, Zimu, et al.
Pubblicazione: (2024)
di: Lu, Zimu, et al.
Pubblicazione: (2024)
3ViewSense: Spatial and Mental Perspective Reasoning from Orthographic Views in Vision-Language Models
di: Zhan, Shaoxiong, et al.
Pubblicazione: (2026)
di: Zhan, Shaoxiong, et al.
Pubblicazione: (2026)
MathMist: A Parallel Multilingual Benchmark Dataset for Mathematical Problem Solving and Reasoning
di: Sobhani, Mahbub E, et al.
Pubblicazione: (2025)
di: Sobhani, Mahbub E, et al.
Pubblicazione: (2025)
MathClean: A Benchmark for Synthetic Mathematical Data Cleaning
di: Liang, Hao, et al.
Pubblicazione: (2025)
di: Liang, Hao, et al.
Pubblicazione: (2025)
ReliableMath: Benchmark of Reliable Mathematical Reasoning on Large Language Models
di: Xue, Boyang, et al.
Pubblicazione: (2025)
di: Xue, Boyang, et al.
Pubblicazione: (2025)
WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct
di: Luo, Haipeng, et al.
Pubblicazione: (2023)
di: Luo, Haipeng, et al.
Pubblicazione: (2023)
VisAidMath: Benchmarking Visual-Aided Mathematical Reasoning
di: Ma, Jingkun, et al.
Pubblicazione: (2024)
di: Ma, Jingkun, et al.
Pubblicazione: (2024)
MLIR-Forge: A Modular Framework for Language Smiths
di: Ates, Berke, et al.
Pubblicazione: (2026)
di: Ates, Berke, et al.
Pubblicazione: (2026)
MathCoder-VL: Bridging Vision and Code for Enhanced Multimodal Mathematical Reasoning
di: Wang, Ke, et al.
Pubblicazione: (2025)
di: Wang, Ke, et al.
Pubblicazione: (2025)
RoMath: A Mathematical Reasoning Benchmark in Romanian
di: Cosma, Adrian, et al.
Pubblicazione: (2024)
di: Cosma, Adrian, et al.
Pubblicazione: (2024)
VerityMath: Advancing Mathematical Reasoning by Self-Verification Through Unit Consistency
di: Han, Vernon Toh Yan, et al.
Pubblicazione: (2023)
di: Han, Vernon Toh Yan, et al.
Pubblicazione: (2023)
From Large to Tiny: Distilling and Refining Mathematical Expertise for Math Word Problems with Weakly Supervision
di: Lin, Qingwen, et al.
Pubblicazione: (2024)
di: Lin, Qingwen, et al.
Pubblicazione: (2024)
ReverseMath: Answer Inversion for Scalable and Verifiable Mathematical Problem Generation
di: Zhao, Raoyuan, et al.
Pubblicazione: (2026)
di: Zhao, Raoyuan, et al.
Pubblicazione: (2026)
TAPO: Translation Augmented Policy Optimization for Multilingual Mathematical Reasoning
di: Huang, Xu, et al.
Pubblicazione: (2026)
di: Huang, Xu, et al.
Pubblicazione: (2026)
MathFusion: Enhancing Mathematical Problem-solving of LLM through Instruction Fusion
di: Pei, Qizhi, et al.
Pubblicazione: (2025)
di: Pei, Qizhi, et al.
Pubblicazione: (2025)
Consultant Decoding: Yet Another Synergistic Mechanism
di: Ding, Chuanghao, et al.
Pubblicazione: (2025)
di: Ding, Chuanghao, et al.
Pubblicazione: (2025)
MathVC: An LLM-Simulated Multi-Character Virtual Classroom for Mathematics Education
di: Yue, Murong, et al.
Pubblicazione: (2024)
di: Yue, Murong, et al.
Pubblicazione: (2024)
GeoMathCode: Understanding Interleaved Math-Code Reasoning for Geometry Problem Solving
di: Zhang, Yingji, et al.
Pubblicazione: (2026)
di: Zhang, Yingji, et al.
Pubblicazione: (2026)
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
di: Tang, Zhengyang, et al.
Pubblicazione: (2024)
di: Tang, Zhengyang, et al.
Pubblicazione: (2024)
Is Your Model Really A Good Math Reasoner? Evaluating Mathematical Reasoning with Checklist
di: Zhou, Zihao, et al.
Pubblicazione: (2024)
di: Zhou, Zihao, et al.
Pubblicazione: (2024)
MathHay: An Automated Benchmark for Long-Context Mathematical Reasoning in LLMs
di: Wang, Lei, et al.
Pubblicazione: (2024)
di: Wang, Lei, et al.
Pubblicazione: (2024)
Math-PUMA: Progressive Upward Multimodal Alignment to Enhance Mathematical Reasoning
di: Zhuang, Wenwen, et al.
Pubblicazione: (2024)
di: Zhuang, Wenwen, et al.
Pubblicazione: (2024)
CMM-Math: A Chinese Multimodal Math Dataset To Evaluate and Enhance the Mathematics Reasoning of Large Multimodal Models
di: Liu, Wentao, et al.
Pubblicazione: (2024)
di: Liu, Wentao, et al.
Pubblicazione: (2024)
Self-consistent Reasoning For Solving Math Word Problems
di: Xiong, Jing, et al.
Pubblicazione: (2022)
di: Xiong, Jing, et al.
Pubblicazione: (2022)
MathCanvas: Intrinsic Visual Chain-of-Thought for Multimodal Mathematical Reasoning
di: Shi, Weikang, et al.
Pubblicazione: (2025)
di: Shi, Weikang, et al.
Pubblicazione: (2025)
Future Policy Approximation for Offline Reinforcement Learning Improves Mathematical Reasoning
di: Oh, Minjae, et al.
Pubblicazione: (2025)
di: Oh, Minjae, et al.
Pubblicazione: (2025)
MathEDU: Feedback Generation on Problem-Solving Processes for Mathematical Learning Support
di: Hsu, Wei-Ling, et al.
Pubblicazione: (2025)
di: Hsu, Wei-Ling, et al.
Pubblicazione: (2025)
WarriorMath: Enhancing the Mathematical Ability of Large Language Models with a Defect-aware Framework
di: Chen, Yue, et al.
Pubblicazione: (2025)
di: Chen, Yue, et al.
Pubblicazione: (2025)
DART-Math: Difficulty-Aware Rejection Tuning for Mathematical Problem-Solving
di: Tong, Yuxuan, et al.
Pubblicazione: (2024)
di: Tong, Yuxuan, et al.
Pubblicazione: (2024)
Solving Math Word Problems via Cooperative Reasoning induced Language Models
di: Zhu, Xinyu, et al.
Pubblicazione: (2022)
di: Zhu, Xinyu, et al.
Pubblicazione: (2022)
MuggleMath: Assessing the Impact of Query and Response Augmentation on Math Reasoning
di: Li, Chengpeng, et al.
Pubblicazione: (2023)
di: Li, Chengpeng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
More Data or Better Data? A Critical Analysis of Data Selection and Synthesis for Mathematical Reasoning
di: Zhao, Yike, et al.
Pubblicazione: (2025) -
MathGenie: Generating Synthetic Data with Question Back-translation for Enhancing Mathematical Reasoning of LLMs
di: Lu, Zimu, et al.
Pubblicazione: (2024) -
Verifier-Backed Hard Problem Generation for Mathematical Reasoning
di: Lai, Yuhang, et al.
Pubblicazione: (2026) -
MathOdyssey: Benchmarking Mathematical Problem-Solving Skills in Large Language Models Using Odyssey Math Data
di: Fang, Meng, et al.
Pubblicazione: (2024) -
PolyMath: Evaluating Mathematical Reasoning in Multilingual Contexts
di: Wang, Yiming, et al.
Pubblicazione: (2025)