JiuZhang3.0: Efficiently Improving Mathematical Reasoning by Training Small Data Synthesis Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Kun, Zhang, Beichen, Wang, Jiapeng, Chen, Zhipeng, Zhao, Wayne Xin, Sha, Jing, Sheng, Zhichao, Wang, Shijin, Wen, Ji-Rong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MMATH: A Multilingual Benchmark for Mathematical Reasoning
par: Luo, Wenyang, et autres
Publié: (2025)
par: Luo, Wenyang, et autres
Publié: (2025)
RV-Syn: Rational and Verifiable Mathematical Reasoning Data Synthesis based on Structured Function Library
par: Wang, Jiapeng, et autres
Publié: (2025)
par: Wang, Jiapeng, et autres
Publié: (2025)
Towards Effective Code-Integrated Reasoning
par: Bai, Fei, et autres
Publié: (2025)
par: Bai, Fei, et autres
Publié: (2025)
An Empirical Study on Eliciting and Improving R1-like Reasoning Models
par: Chen, Zhipeng, et autres
Publié: (2025)
par: Chen, Zhipeng, et autres
Publié: (2025)
Not Everything is All You Need: Toward Low-Redundant Optimization for Large Language Model Alignment
par: Chen, Zhipeng, et autres
Publié: (2024)
par: Chen, Zhipeng, et autres
Publié: (2024)
Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems
par: Min, Yingqian, et autres
Publié: (2024)
par: Min, Yingqian, et autres
Publié: (2024)
Challenging the Boundaries of Reasoning: An Olympiad-Level Math Benchmark for Large Language Models
par: Sun, Haoxiang, et autres
Publié: (2025)
par: Sun, Haoxiang, et autres
Publié: (2025)
Adaptive Ability Decomposing for Unlocking Large Reasoning Model Effective Reinforcement Learning
par: Chen, Zhipeng, et autres
Publié: (2026)
par: Chen, Zhipeng, et autres
Publié: (2026)
Improving Large Language Models via Fine-grained Reinforcement Learning with Minimum Editing Constraint
par: Chen, Zhipeng, et autres
Publié: (2024)
par: Chen, Zhipeng, et autres
Publié: (2024)
ReasoningLM: Enabling Structural Subgraph Reasoning in Pre-trained Language Models for Question Answering over Knowledge Graph
par: Jiang, Jinhao, et autres
Publié: (2023)
par: Jiang, Jinhao, et autres
Publié: (2023)
LARES: Latent Reasoning for Sequential Recommendation
par: Liu, Enze, et autres
Publié: (2025)
par: Liu, Enze, et autres
Publié: (2025)
ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests
par: Xu, Shiyi, et autres
Publié: (2025)
par: Xu, Shiyi, et autres
Publié: (2025)
Analyzing and Mitigating Object Hallucination: A Training Bias Perspective
par: Li, Yifan, et autres
Publié: (2025)
par: Li, Yifan, et autres
Publié: (2025)
Investigating the Pre-Training Dynamics of In-Context Learning: Task Recognition vs. Task Learning
par: Wang, Xiaolei, et autres
Publié: (2024)
par: Wang, Xiaolei, et autres
Publié: (2024)
Learning to Solve Geometry Problems via Simulating Human Dual-Reasoning Process
par: Xiao, Tong, et autres
Publié: (2024)
par: Xiao, Tong, et autres
Publié: (2024)
Low-rank Optimization Trajectories Modeling for LLM RLVR Acceleration
par: Chen, Zhipeng, et autres
Publié: (2026)
par: Chen, Zhipeng, et autres
Publié: (2026)
Extracting and Combining Abilities For Building Multi-lingual Ability-enhanced Large Language Models
par: Chen, Zhipeng, et autres
Publié: (2024)
par: Chen, Zhipeng, et autres
Publié: (2024)
Masked Thought: Simply Masking Partial Reasoning Steps Can Improve Mathematical Reasoning Learning of Language Models
par: Chen, Changyu, et autres
Publié: (2024)
par: Chen, Changyu, et autres
Publié: (2024)
Improving Conversational Recommendation Systems via Counterfactual Data Simulation
par: Wang, Xiaolei, et autres
Publié: (2023)
par: Wang, Xiaolei, et autres
Publié: (2023)
Enhancing LLM Reasoning with Reward-guided Tree Search
par: Jiang, Jinhao, et autres
Publié: (2024)
par: Jiang, Jinhao, et autres
Publié: (2024)
Small Agent Can Also Rock! Empowering Small Language Models as Hallucination Detector
par: Cheng, Xiaoxue, et autres
Publié: (2024)
par: Cheng, Xiaoxue, et autres
Publié: (2024)
Slow Thinking for Sequential Recommendation
par: Zhang, Junjie, et autres
Publié: (2025)
par: Zhang, Junjie, et autres
Publié: (2025)
From Trial-and-Error to Improvement: A Systematic Analysis of LLM Exploration Mechanisms in RLVR
par: Deng, Jia, et autres
Publié: (2025)
par: Deng, Jia, et autres
Publié: (2025)
Improving Mathematical Reasoning Capabilities of Small Language Models via Feedback-Driven Distillation
par: Zhu, Xunyu, et autres
Publié: (2024)
par: Zhu, Xunyu, et autres
Publié: (2024)
Decomposing the Entropy-Performance Exchange: The Missing Keys to Unlocking Effective Reinforcement Learning
par: Deng, Jia, et autres
Publié: (2025)
par: Deng, Jia, et autres
Publié: (2025)
CogMath: Assessing LLMs' Authentic Mathematical Ability from a Human Cognitive Perspective
par: Liu, Jiayu, et autres
Publié: (2025)
par: Liu, Jiayu, et autres
Publié: (2025)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
par: Cheng, Xiaoxue, et autres
Publié: (2024)
par: Cheng, Xiaoxue, et autres
Publié: (2024)
What Makes for Good Visual Instructions? Synthesizing Complex Visual Reasoning Instructions for Visual Instruction Tuning
par: Du, Yifan, et autres
Publié: (2023)
par: Du, Yifan, et autres
Publié: (2023)
AI Mathematician as a Partner in Advancing Mathematical Discovery -- A Case Study in Homogenization Theory
par: Liu, Yuanhang, et autres
Publié: (2025)
par: Liu, Yuanhang, et autres
Publié: (2025)
KG-Agent: An Efficient Autonomous Agent Framework for Complex Reasoning over Knowledge Graph
par: Jiang, Jinhao, et autres
Publié: (2024)
par: Jiang, Jinhao, et autres
Publié: (2024)
Describe-then-Reason: Improving Multimodal Mathematical Reasoning through Visual Comprehension Training
par: Jia, Mengzhao, et autres
Publié: (2024)
par: Jia, Mengzhao, et autres
Publié: (2024)
Weather Jiu-Jitsu: Climate Adaptation for the 21st Century
par: Huang, Qin, et autres
Publié: (2025)
par: Huang, Qin, et autres
Publié: (2025)
Distilling Mathematical Reasoning Capabilities into Small Language Models
par: Zhu, Xunyu, et autres
Publié: (2024)
par: Zhu, Xunyu, et autres
Publié: (2024)
Bit-mask Robust Contrastive Knowledge Distillation for Unsupervised Semantic Hashing
par: He, Liyang, et autres
Publié: (2024)
par: He, Liyang, et autres
Publié: (2024)
ProcessBench: Identifying Process Errors in Mathematical Reasoning
par: Zheng, Chujie, et autres
Publié: (2024)
par: Zheng, Chujie, et autres
Publié: (2024)
The Lessons of Developing Process Reward Models in Mathematical Reasoning
par: Zhang, Zhenru, et autres
Publié: (2025)
par: Zhang, Zhenru, et autres
Publié: (2025)
X-Intelligence 3.0: Training and Evaluating Reasoning LLM for Semiconductor Display
par: Yan, Xiaolin, et autres
Publié: (2025)
par: Yan, Xiaolin, et autres
Publié: (2025)
Admissible Reconstruction of Reaction-Channel Levels on Fixed Subgroup Support for Cross-Section-Space Probability Table Constructions
par: Zheng, Beichen, et autres
Publié: (2026)
par: Zheng, Beichen, et autres
Publié: (2026)
Continuous Output Personality Detection Models via Mixed Strategy Training
par: Wang, Rong, et autres
Publié: (2024)
par: Wang, Rong, et autres
Publié: (2024)
Self-Calibrated Listwise Reranking with Large Language Models
par: Ren, Ruiyang, et autres
Publié: (2024)
par: Ren, Ruiyang, et autres
Publié: (2024)
Documents similaires
-
MMATH: A Multilingual Benchmark for Mathematical Reasoning
par: Luo, Wenyang, et autres
Publié: (2025) -
RV-Syn: Rational and Verifiable Mathematical Reasoning Data Synthesis based on Structured Function Library
par: Wang, Jiapeng, et autres
Publié: (2025) -
Towards Effective Code-Integrated Reasoning
par: Bai, Fei, et autres
Publié: (2025) -
An Empirical Study on Eliciting and Improving R1-like Reasoning Models
par: Chen, Zhipeng, et autres
Publié: (2025) -
Not Everything is All You Need: Toward Low-Redundant Optimization for Large Language Model Alignment
par: Chen, Zhipeng, et autres
Publié: (2024)