To Code or not to Code? Adaptive Tool Integration for Math Language Models via Expectation-Maximization
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Haozhe, Li, Long, Qu, Chao, Zhu, Fengming, Xu, Weidi, Chu, Wei, Lin, Fangzhen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Computing Universal Plans for Partially Observable Multi-Agent Routing Using Answer Set Programming
di: Zhu, Fengming, et al.
Pubblicazione: (2023)
di: Zhu, Fengming, et al.
Pubblicazione: (2023)
VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
di: Ding, Ning, et al.
Pubblicazione: (2024)
di: Ding, Ning, et al.
Pubblicazione: (2024)
MuMath-Code: Combining Tool-Use Large Language Models with Multi-perspective Data Augmentation for Mathematical Reasoning
di: Yin, Shuo, et al.
Pubblicazione: (2024)
di: Yin, Shuo, et al.
Pubblicazione: (2024)
How Do Humans Write Code? Large Models Do It the Same Way Too
di: Li, Long, et al.
Pubblicazione: (2024)
di: Li, Long, et al.
Pubblicazione: (2024)
Emergent Hierarchical Reasoning in LLMs through Reinforcement Learning
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
Thought-Like-Pro: Enhancing Reasoning of Large Language Models through Self-Driven Prolog-based Chain-of-Thought
di: Tan, Xiaoyu, et al.
Pubblicazione: (2024)
di: Tan, Xiaoyu, et al.
Pubblicazione: (2024)
UTMath: Math Evaluation with Unit Test via Reasoning-to-Coding Thoughts
di: Yang, Bo, et al.
Pubblicazione: (2024)
di: Yang, Bo, et al.
Pubblicazione: (2024)
TopoAlign: A Framework for Aligning Code to Math via Topological Decomposition
di: Li, Yupei, et al.
Pubblicazione: (2025)
di: Li, Yupei, et al.
Pubblicazione: (2025)
DynaCode: A Dynamic Complexity-Aware Code Benchmark for Evaluating Large Language Models in Code Generation
di: Hu, Wenhao, et al.
Pubblicazione: (2025)
di: Hu, Wenhao, et al.
Pubblicazione: (2025)
Detecting Training Data of Large Language Models via Expectation Maximization
di: Kim, Gyuwan, et al.
Pubblicazione: (2024)
di: Kim, Gyuwan, et al.
Pubblicazione: (2024)
Reasoning, Code, or Both? How Large Language Models Handle Variations in Math Questions
di: Kutakh, Matthew
Pubblicazione: (2026)
di: Kutakh, Matthew
Pubblicazione: (2026)
Interpretable Mnemonic Generation for Kanji Learning via Expectation-Maximization
di: Lee, Jaewook, et al.
Pubblicazione: (2025)
di: Lee, Jaewook, et al.
Pubblicazione: (2025)
AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
AceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement Learning
di: Chen, Yang, et al.
Pubblicazione: (2025)
di: Chen, Yang, et al.
Pubblicazione: (2025)
Code over Words: Overcoming Semantic Inertia via Code-Grounded Reasoning
di: Xu, Manjie, et al.
Pubblicazione: (2026)
di: Xu, Manjie, et al.
Pubblicazione: (2026)
Pixel Reasoner: Incentivizing Pixel-Space Reasoning with Curiosity-Driven Reinforcement Learning
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
TabularMath: Understanding Math Reasoning over Tables with Large Language Models
di: Tian, Shi-Yu, et al.
Pubblicazione: (2025)
di: Tian, Shi-Yu, et al.
Pubblicazione: (2025)
RefineCoder: Iterative Improving of Large Language Models via Adaptive Critique Refinement for Code Generation
di: Zhou, Changzhi, et al.
Pubblicazione: (2025)
di: Zhou, Changzhi, et al.
Pubblicazione: (2025)
Mitigating Gender Bias in Code Large Language Models via Model Editing
di: Qin, Zhanyue, et al.
Pubblicazione: (2024)
di: Qin, Zhanyue, et al.
Pubblicazione: (2024)
CodeS: Natural Language to Code Repository via Multi-Layer Sketch
di: Zan, Daoguang, et al.
Pubblicazione: (2024)
di: Zan, Daoguang, et al.
Pubblicazione: (2024)
DA-Code: Agent Data Science Code Generation Benchmark for Large Language Models
di: Huang, Yiming, et al.
Pubblicazione: (2024)
di: Huang, Yiming, et al.
Pubblicazione: (2024)
Distilling LLM Agent into Small Models with Retrieval and Code Tools
di: Kang, Minki, et al.
Pubblicazione: (2025)
di: Kang, Minki, et al.
Pubblicazione: (2025)
MathCoder2: Better Math Reasoning from Continued Pretraining on Model-translated Mathematical Code
di: Lu, Zimu, et al.
Pubblicazione: (2024)
di: Lu, Zimu, et al.
Pubblicazione: (2024)
Tool Learning with Large Language Models: A Survey
di: Qu, Changle, et al.
Pubblicazione: (2024)
di: Qu, Changle, et al.
Pubblicazione: (2024)
Coding Triangle: How Does Large Language Model Understand Code?
di: Zhang, Taolin, et al.
Pubblicazione: (2025)
di: Zhang, Taolin, et al.
Pubblicazione: (2025)
A Computable Game-Theoretic Framework for Multi-Agent Theory of Mind
di: Zhu, Fengming, et al.
Pubblicazione: (2025)
di: Zhu, Fengming, et al.
Pubblicazione: (2025)
WizardCoder: Empowering Code Large Language Models with Evol-Instruct
di: Luo, Ziyang, et al.
Pubblicazione: (2023)
di: Luo, Ziyang, et al.
Pubblicazione: (2023)
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
di: Qu, Changle, et al.
Pubblicazione: (2026)
di: Qu, Changle, et al.
Pubblicazione: (2026)
OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement
di: Zheng, Tianyu, et al.
Pubblicazione: (2024)
di: Zheng, Tianyu, et al.
Pubblicazione: (2024)
CodeMind: Evaluating Large Language Models for Code Reasoning
di: Liu, Changshu, et al.
Pubblicazione: (2024)
di: Liu, Changshu, et al.
Pubblicazione: (2024)
Code Simulation Challenges for Large Language Models
di: La Malfa, Emanuele, et al.
Pubblicazione: (2024)
di: La Malfa, Emanuele, et al.
Pubblicazione: (2024)
TraceCoder: Towards Traceable ICD Coding via Multi-Source Knowledge Integration
di: Ren, Mucheng, et al.
Pubblicazione: (2025)
di: Ren, Mucheng, et al.
Pubblicazione: (2025)
Refine Knowledge of Large Language Models via Adaptive Contrastive Learning
di: Li, Yinghui, et al.
Pubblicazione: (2025)
di: Li, Yinghui, et al.
Pubblicazione: (2025)
ToolNet: Connecting Large Language Models with Massive Tools via Tool Graph
di: Liu, Xukun, et al.
Pubblicazione: (2024)
di: Liu, Xukun, et al.
Pubblicazione: (2024)
SuperCLUE-Math6: Graded Multi-Step Math Reasoning Benchmark for LLMs in Chinese
di: Xu, Liang, et al.
Pubblicazione: (2024)
di: Xu, Liang, et al.
Pubblicazione: (2024)
Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL
di: Liu, Che, et al.
Pubblicazione: (2025)
di: Liu, Che, et al.
Pubblicazione: (2025)
CodePMP: Scalable Preference Model Pretraining for Large Language Model Reasoning
di: Yu, Huimu, et al.
Pubblicazione: (2024)
di: Yu, Huimu, et al.
Pubblicazione: (2024)
DotaMath: Decomposition of Thought with Code Assistance and Self-correction for Mathematical Reasoning
di: Li, Chengpeng, et al.
Pubblicazione: (2024)
di: Li, Chengpeng, et al.
Pubblicazione: (2024)
CodexGraph: Bridging Large Language Models and Code Repositories via Code Graph Databases
di: Liu, Xiangyan, et al.
Pubblicazione: (2024)
di: Liu, Xiangyan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Computing Universal Plans for Partially Observable Multi-Agent Routing Using Answer Set Programming
di: Zhu, Fengming, et al.
Pubblicazione: (2023) -
VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning
di: Wang, Haozhe, et al.
Pubblicazione: (2025) -
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
di: Ding, Ning, et al.
Pubblicazione: (2024) -
MuMath-Code: Combining Tool-Use Large Language Models with Multi-perspective Data Augmentation for Mathematical Reasoning
di: Yin, Shuo, et al.
Pubblicazione: (2024) -
How Do Humans Write Code? Large Models Do It the Same Way Too
di: Li, Long, et al.
Pubblicazione: (2024)