AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Luo, Haipeng, Feng, Huawen, Sun, Qingfeng, Xu, Can, Zheng, Kai, Wang, Yufei, Yang, Tao, Hu, Han, Tang, Yansong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct
par: Luo, Haipeng, et autres
Publié: (2023)
par: Luo, Haipeng, et autres
Publié: (2023)
D$^2$Plan: Dual-Agent Dynamic Global Planning for Complex Retrieval-Augmented Reasoning
par: Luo, Kangcheng, et autres
Publié: (2026)
par: Luo, Kangcheng, et autres
Publié: (2026)
AgentGen: Enhancing Planning Abilities for Large Language Model based Agent via Environment and Task Generation
par: Hu, Mengkang, et autres
Publié: (2024)
par: Hu, Mengkang, et autres
Publié: (2024)
MuMath-Code: Combining Tool-Use Large Language Models with Multi-perspective Data Augmentation for Mathematical Reasoning
par: Yin, Shuo, et autres
Publié: (2024)
par: Yin, Shuo, et autres
Publié: (2024)
WizardCoder: Empowering Code Large Language Models with Evol-Instruct
par: Luo, Ziyang, et autres
Publié: (2023)
par: Luo, Ziyang, et autres
Publié: (2023)
WarriorCoder: Learning from Expert Battles to Augment Code Large Language Models
par: Feng, Huawen, et autres
Publié: (2024)
par: Feng, Huawen, et autres
Publié: (2024)
MultiMath: Bridging Visual and Mathematical Reasoning for Large Language Models
par: Peng, Shuai, et autres
Publié: (2024)
par: Peng, Shuai, et autres
Publié: (2024)
MathAgent: Leveraging a Mixture-of-Math-Agent Framework for Real-World Multimodal Mathematical Error Detection
par: Yan, Yibo, et autres
Publié: (2025)
par: Yan, Yibo, et autres
Publié: (2025)
ReliableMath: Benchmark of Reliable Mathematical Reasoning on Large Language Models
par: Xue, Boyang, et autres
Publié: (2025)
par: Xue, Boyang, et autres
Publié: (2025)
MATHSENSEI: A Tool-Augmented Large Language Model for Mathematical Reasoning
par: Das, Debrup, et autres
Publié: (2024)
par: Das, Debrup, et autres
Publié: (2024)
ELLA: Empowering LLMs for Interpretable, Accurate and Informative Legal Advice
par: Hu, Yutong, et autres
Publié: (2024)
par: Hu, Yutong, et autres
Publié: (2024)
OffSeeker: Online Reinforcement Learning Is Not All You Need for Deep Research Agents
par: Zhou, Yuhang, et autres
Publié: (2026)
par: Zhou, Yuhang, et autres
Publié: (2026)
Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents
par: Shi, Zhengliang, et autres
Publié: (2024)
par: Shi, Zhengliang, et autres
Publié: (2024)
MathAgent: Adversarial Evolution of Constraint Graphs for Mathematical Reasoning Data Synthesis
par: Yu, Zixiong, et autres
Publié: (2026)
par: Yu, Zixiong, et autres
Publié: (2026)
Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models
par: Shi, Wenhao, et autres
Publié: (2024)
par: Shi, Wenhao, et autres
Publié: (2024)
Towards a Unified Paradigm: Integrating Recommendation Systems as a New Language in Large Models
par: Zheng, Kai, et autres
Publié: (2024)
par: Zheng, Kai, et autres
Publié: (2024)
Arena Learning: Build Data Flywheel for LLMs Post-training via Simulated Chatbot Arena
par: Luo, Haipeng, et autres
Publié: (2024)
par: Luo, Haipeng, et autres
Publié: (2024)
PersonaMath: Boosting Mathematical Reasoning via Persona-Driven Data Augmentation
par: Luo, Jing, et autres
Publié: (2024)
par: Luo, Jing, et autres
Publié: (2024)
MathLearner: A Large Language Model Agent Framework for Learning to Solve Mathematical Problems
par: Xie, Wenbei, et autres
Publié: (2024)
par: Xie, Wenbei, et autres
Publié: (2024)
AgentMD: Empowering Language Agents for Risk Prediction with Large-Scale Clinical Tool Learning
par: Jin, Qiao, et autres
Publié: (2024)
par: Jin, Qiao, et autres
Publié: (2024)
Skywork-Math: Data Scaling Laws for Mathematical Reasoning in Large Language Models -- The Story Goes On
par: Zeng, Liang, et autres
Publié: (2024)
par: Zeng, Liang, et autres
Publié: (2024)
WizardLM: Empowering large pre-trained language models to follow complex instructions
par: Xu, Can, et autres
Publié: (2023)
par: Xu, Can, et autres
Publié: (2023)
VisioMath: Benchmarking Figure-based Mathematical Reasoning in LMMs
par: Li, Can, et autres
Publié: (2025)
par: Li, Can, et autres
Publié: (2025)
StepMathAgent: A Step-Wise Agent for Evaluating Mathematical Processes through Tree-of-Error
par: Yang, Shu-Xun, et autres
Publié: (2025)
par: Yang, Shu-Xun, et autres
Publié: (2025)
Profile-Then-Reason: Bounded Semantic Complexity for Tool-Augmented Language Agents
par: Enabe, Paulo Akira F.
Publié: (2026)
par: Enabe, Paulo Akira F.
Publié: (2026)
TableMind: An Autonomous Programmatic Agent for Tool-Augmented Table Reasoning
par: Jiang, Chuang, et autres
Publié: (2025)
par: Jiang, Chuang, et autres
Publié: (2025)
JT-Math: A Multi-Stage Framework for Advanced Mathematical Reasoning in Large Language Models
par: Hao, Yifan, et autres
Publié: (2025)
par: Hao, Yifan, et autres
Publié: (2025)
PolyMath: Evaluating Mathematical Reasoning in Multilingual Contexts
par: Wang, Yiming, et autres
Publié: (2025)
par: Wang, Yiming, et autres
Publié: (2025)
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
par: Tang, Zhengyang, et autres
Publié: (2024)
par: Tang, Zhengyang, et autres
Publié: (2024)
Empowering Working Memory for Large Language Model Agents
par: Guo, Jing, et autres
Publié: (2023)
par: Guo, Jing, et autres
Publié: (2023)
Agent0-VL: Exploring Self-Evolving Agent for Tool-Integrated Vision-Language Reasoning
par: Liu, Jiaqi, et autres
Publié: (2025)
par: Liu, Jiaqi, et autres
Publié: (2025)
MathOdyssey: Benchmarking Mathematical Problem-Solving Skills in Large Language Models Using Odyssey Math Data
par: Fang, Meng, et autres
Publié: (2024)
par: Fang, Meng, et autres
Publié: (2024)
AgentThink: A Unified Framework for Tool-Augmented Chain-of-Thought Reasoning in Vision-Language Models for Autonomous Driving
par: Qian, Kangan, et autres
Publié: (2025)
par: Qian, Kangan, et autres
Publié: (2025)
TableMind++: An Uncertainty-Aware Programmatic Agent for Tool-Augmented Table Reasoning
par: Cheng, Mingyue, et autres
Publié: (2026)
par: Cheng, Mingyue, et autres
Publié: (2026)
ConceptMath: A Bilingual Concept-wise Benchmark for Measuring Mathematical Reasoning of Large Language Models
par: Wu, Yanan, et autres
Publié: (2024)
par: Wu, Yanan, et autres
Publié: (2024)
TabularMath: Understanding Math Reasoning over Tables with Large Language Models
par: Tian, Shi-Yu, et autres
Publié: (2025)
par: Tian, Shi-Yu, et autres
Publié: (2025)
MuggleMath: Assessing the Impact of Query and Response Augmentation on Math Reasoning
par: Li, Chengpeng, et autres
Publié: (2023)
par: Li, Chengpeng, et autres
Publié: (2023)
MorphAgent: Empowering Agents through Self-Evolving Profiles and Decentralized Collaboration
par: Lu, Siyuan, et autres
Publié: (2024)
par: Lu, Siyuan, et autres
Publié: (2024)
PARAMANU-GANITA: Can Small Math Language Models Rival with Large Language Models on Mathematical Reasoning?
par: Niyogi, Mitodru, et autres
Publié: (2024)
par: Niyogi, Mitodru, et autres
Publié: (2024)
RefTool: Reference-Guided Tool Creation for Knowledge-Intensive Reasoning
par: Liu, Xiao, et autres
Publié: (2025)
par: Liu, Xiao, et autres
Publié: (2025)
Documents similaires
-
WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct
par: Luo, Haipeng, et autres
Publié: (2023) -
D$^2$Plan: Dual-Agent Dynamic Global Planning for Complex Retrieval-Augmented Reasoning
par: Luo, Kangcheng, et autres
Publié: (2026) -
AgentGen: Enhancing Planning Abilities for Large Language Model based Agent via Environment and Task Generation
par: Hu, Mengkang, et autres
Publié: (2024) -
MuMath-Code: Combining Tool-Use Large Language Models with Multi-perspective Data Augmentation for Mathematical Reasoning
par: Yin, Shuo, et autres
Publié: (2024) -
WizardCoder: Empowering Code Large Language Models with Evol-Instruct
par: Luo, Ziyang, et autres
Publié: (2023)