Physics of Language Models: Part 2.2, How to Learn From Mistakes on Grade-School Math Problems
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ye, Tian, Xu, Zicheng, Li, Yuanzhi, Allen-Zhu, Zeyuan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Physics of Language Models: Part 2.1, Grade-School Math and the Hidden Reasoning Process
von: Ye, Tian, et al.
Veröffentlicht: (2024)
von: Ye, Tian, et al.
Veröffentlicht: (2024)
Physics of Language Models: Part 3.2, Knowledge Manipulation
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2023)
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2023)
Physics of Language Models: Part 1, Learning Hierarchical Language Structures
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2023)
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2023)
Physics of Language Models: Part 3.1, Knowledge Storage and Extraction
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2023)
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2023)
Physics of Language Models: Part 3.3, Knowledge Capacity Scaling Laws
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2024)
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2024)
Orca-Math: Unlocking the potential of SLMs in Grade School Math
von: Mitra, Arindam, et al.
Veröffentlicht: (2024)
von: Mitra, Arindam, et al.
Veröffentlicht: (2024)
SuperCLUE-Math6: Graded Multi-Step Math Reasoning Benchmark for LLMs in Chinese
von: Xu, Liang, et al.
Veröffentlicht: (2024)
von: Xu, Liang, et al.
Veröffentlicht: (2024)
GSM8K-V: Can Vision Language Models Solve Grade School Math Word Problems in Visual Contexts
von: Yuan, Fan, et al.
Veröffentlicht: (2025)
von: Yuan, Fan, et al.
Veröffentlicht: (2025)
Bridging the Novice-Expert Gap via Models of Decision-Making: A Case Study on Remediating Math Mistakes
von: Wang, Rose E., et al.
Veröffentlicht: (2023)
von: Wang, Rose E., et al.
Veröffentlicht: (2023)
Learning From Mistakes Makes LLM Better Reasoner
von: An, Shengnan, et al.
Veröffentlicht: (2023)
von: An, Shengnan, et al.
Veröffentlicht: (2023)
MathMistake Checker: A Comprehensive Demonstration for Step-by-Step Math Problem Mistake Finding by Prompt-Guided LLMs
von: Zhang, Tianyang, et al.
Veröffentlicht: (2025)
von: Zhang, Tianyang, et al.
Veröffentlicht: (2025)
MathOdyssey: Benchmarking Mathematical Problem-Solving Skills in Large Language Models Using Odyssey Math Data
von: Fang, Meng, et al.
Veröffentlicht: (2024)
von: Fang, Meng, et al.
Veröffentlicht: (2024)
TabularMath: Understanding Math Reasoning over Tables with Large Language Models
von: Tian, Shi-Yu, et al.
Veröffentlicht: (2025)
von: Tian, Shi-Yu, et al.
Veröffentlicht: (2025)
MathGLM-Vision: Solving Mathematical Problems with Multi-Modal Large Language Model
von: Yang, Zhen, et al.
Veröffentlicht: (2024)
von: Yang, Zhen, et al.
Veröffentlicht: (2024)
In-Context Principle Learning from Mistakes
von: Zhang, Tianjun, et al.
Veröffentlicht: (2024)
von: Zhang, Tianjun, et al.
Veröffentlicht: (2024)
On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes
von: Agarwal, Rishabh, et al.
Veröffentlicht: (2023)
von: Agarwal, Rishabh, et al.
Veröffentlicht: (2023)
Logic Contrastive Reasoning with Lightweight Large Language Model for Math Word Problems
von: Kai, Ding, et al.
Veröffentlicht: (2024)
von: Kai, Ding, et al.
Veröffentlicht: (2024)
AMO-Bench: Large Language Models Still Struggle in High School Math Competitions
von: An, Shengnan, et al.
Veröffentlicht: (2025)
von: An, Shengnan, et al.
Veröffentlicht: (2025)
Physics of Language Models: Part 4.1, Architecture Design and the Magic of Canon Layers
von: Allen-Zhu, Zeyuan
Veröffentlicht: (2025)
von: Allen-Zhu, Zeyuan
Veröffentlicht: (2025)
TeleMath: A Benchmark for Large Language Models in Telecom Mathematical Problem Solving
von: Colle, Vincenzo, et al.
Veröffentlicht: (2025)
von: Colle, Vincenzo, et al.
Veröffentlicht: (2025)
CEM: A Data-Efficient Method for Large Language Models to Continue Evolving From Mistakes
von: Zhao, Haokun, et al.
Veröffentlicht: (2024)
von: Zhao, Haokun, et al.
Veröffentlicht: (2024)
Adversarial Math Word Problem Generation
von: Xie, Roy, et al.
Veröffentlicht: (2024)
von: Xie, Roy, et al.
Veröffentlicht: (2024)
DeepSeekMath-V2: Towards Self-Verifiable Mathematical Reasoning
von: Shao, Zhihong, et al.
Veröffentlicht: (2025)
von: Shao, Zhihong, et al.
Veröffentlicht: (2025)
How Far Are Vision-Language Models from Constructing the Real World? A Benchmark for Physical Generative Reasoning
von: Yang, Luyu, et al.
Veröffentlicht: (2026)
von: Yang, Luyu, et al.
Veröffentlicht: (2026)
Math Neurosurgery: Isolating Language Models' Math Reasoning Abilities Using Only Forward Passes
von: Christ, Bryan R., et al.
Veröffentlicht: (2024)
von: Christ, Bryan R., et al.
Veröffentlicht: (2024)
Reverse Training to Nurse the Reversal Curse
von: Golovneva, Olga, et al.
Veröffentlicht: (2024)
von: Golovneva, Olga, et al.
Veröffentlicht: (2024)
Gaining Wisdom from Setbacks: Aligning Large Language Models via Mistake Analysis
von: Chen, Kai, et al.
Veröffentlicht: (2023)
von: Chen, Kai, et al.
Veröffentlicht: (2023)
Self-Consistency Boosts Calibration for Math Reasoning
von: Wang, Ante, et al.
Veröffentlicht: (2024)
von: Wang, Ante, et al.
Veröffentlicht: (2024)
Transparent and Coherent Procedural Mistake Detection
von: Storks, Shane, et al.
Veröffentlicht: (2024)
von: Storks, Shane, et al.
Veröffentlicht: (2024)
Big-Math: A Large-Scale, High-Quality Math Dataset for Reinforcement Learning in Language Models
von: Albalak, Alon, et al.
Veröffentlicht: (2025)
von: Albalak, Alon, et al.
Veröffentlicht: (2025)
Reasoning, Code, or Both? How Large Language Models Handle Variations in Math Questions
von: Kutakh, Matthew
Veröffentlicht: (2026)
von: Kutakh, Matthew
Veröffentlicht: (2026)
LLM The Genius Paradox: A Linguistic and Math Expert's Struggle with Simple Word-based Counting Problems
von: Xu, Nan, et al.
Veröffentlicht: (2024)
von: Xu, Nan, et al.
Veröffentlicht: (2024)
A Diversity-Enhanced Knowledge Distillation Model for Practical Math Word Problem Solving
von: Zhang, Yi, et al.
Veröffentlicht: (2025)
von: Zhang, Yi, et al.
Veröffentlicht: (2025)
Modular Arithmetic: Language Models Solve Math Digit by Digit
von: Baeumel, Tanja, et al.
Veröffentlicht: (2025)
von: Baeumel, Tanja, et al.
Veröffentlicht: (2025)
Achieving >97% on GSM8K: Deeply Understanding the Problems Makes LLMs Better Solvers for Math Word Problems
von: Zhong, Qihuang, et al.
Veröffentlicht: (2024)
von: Zhong, Qihuang, et al.
Veröffentlicht: (2024)
To Code or not to Code? Adaptive Tool Integration for Math Language Models via Expectation-Maximization
von: Wang, Haozhe, et al.
Veröffentlicht: (2025)
von: Wang, Haozhe, et al.
Veröffentlicht: (2025)
Recitation over Reasoning: How Cutting-Edge Language Models Can Fail on Elementary School-Level Reasoning Problems?
von: Yan, Kai, et al.
Veröffentlicht: (2025)
von: Yan, Kai, et al.
Veröffentlicht: (2025)
EDUMATH: Generating Standards-aligned Educational Math Word Problems
von: Christ, Bryan R., et al.
Veröffentlicht: (2025)
von: Christ, Bryan R., et al.
Veröffentlicht: (2025)
A Careful Examination of Large Language Model Performance on Grade School Arithmetic
von: Zhang, Hugh, et al.
Veröffentlicht: (2024)
von: Zhang, Hugh, et al.
Veröffentlicht: (2024)
Can LLMs Master Math? Investigating Large Language Models on Math Stack Exchange
von: Satpute, Ankit, et al.
Veröffentlicht: (2024)
von: Satpute, Ankit, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Physics of Language Models: Part 2.1, Grade-School Math and the Hidden Reasoning Process
von: Ye, Tian, et al.
Veröffentlicht: (2024) -
Physics of Language Models: Part 3.2, Knowledge Manipulation
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2023) -
Physics of Language Models: Part 1, Learning Hierarchical Language Structures
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2023) -
Physics of Language Models: Part 3.1, Knowledge Storage and Extraction
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2023) -
Physics of Language Models: Part 3.3, Knowledge Capacity Scaling Laws
von: Allen-Zhu, Zeyuan, et al.
Veröffentlicht: (2024)