InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Ying, Huaiyuan, Zhang, Shuo, Li, Linyang, Zhou, Zhejian, Shao, Yunfan, Fei, Zhaoye, Ma, Yichuan, Hong, Jiawei, Liu, Kuikun, Wang, Ziyi, Wang, Yudong, Wu, Zijian, Li, Shuaibin, Zhou, Fengzhe, Liu, Hongwei, Zhang, Songyang, Zhang, Wenwei, Yan, Hang, Qiu, Xipeng, Wang, Jiayu, Chen, Kai, Lin, Dahua |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
InternLM2.5-StepProver: Advancing Automated Theorem Proving via Critic-Guided Search
por: Wu, Zijian, et al.
Publicado: (2024)
por: Wu, Zijian, et al.
Publicado: (2024)
InternLM-Law: An Open Source Chinese Legal Large Language Model
por: Fei, Zhiwei, et al.
Publicado: (2024)
por: Fei, Zhiwei, et al.
Publicado: (2024)
InternLM2 Technical Report
por: Cai, Zheng, et al.
Publicado: (2024)
por: Cai, Zheng, et al.
Publicado: (2024)
MathBench: Evaluating the Theory and Application Proficiency of LLMs with a Hierarchical Mathematics Benchmark
por: Liu, Hongwei, et al.
Publicado: (2024)
por: Liu, Hongwei, et al.
Publicado: (2024)
InternLM-XComposer2.5-Reward: A Simple Yet Effective Multi-Modal Reward Model
por: Zang, Yuhang, et al.
Publicado: (2025)
por: Zang, Yuhang, et al.
Publicado: (2025)
InternLM-XComposer2: Mastering Free-form Text-Image Composition and Comprehension in Vision-Language Large Model
por: Dong, Xiaoyi, et al.
Publicado: (2024)
por: Dong, Xiaoyi, et al.
Publicado: (2024)
InternLM-XComposer-2.5: A Versatile Large Vision Language Model Supporting Long-Contextual Input and Output
por: Zhang, Pan, et al.
Publicado: (2024)
por: Zhang, Pan, et al.
Publicado: (2024)
InternLM-XComposer2-4KHD: A Pioneering Large Vision-Language Model Handling Resolutions from 336 Pixels to 4K HD
por: Dong, Xiaoyi, et al.
Publicado: (2024)
por: Dong, Xiaoyi, et al.
Publicado: (2024)
Balanced Data Sampling for Language Model Training with Clustering
por: Shao, Yunfan, et al.
Publicado: (2024)
por: Shao, Yunfan, et al.
Publicado: (2024)
InternLM-XComposer2.5-OmniLive: A Comprehensive Multimodal System for Long-term Streaming Video and Audio Interactions
por: Zhang, Pan, et al.
Publicado: (2024)
por: Zhang, Pan, et al.
Publicado: (2024)
CIBench: Evaluating Your LLMs with a Code Interpreter Plugin
por: Zhang, Chuyu, et al.
Publicado: (2024)
por: Zhang, Chuyu, et al.
Publicado: (2024)
InternBootcamp Technical Report: Boosting LLM Reasoning with Verifiable Task Scaling
por: Li, Peiji, et al.
Publicado: (2025)
por: Li, Peiji, et al.
Publicado: (2025)
Scaling Behavior for Large Language Models regarding Numeral Systems: An Example using Pythia
por: Zhou, Zhejian, et al.
Publicado: (2024)
por: Zhou, Zhejian, et al.
Publicado: (2024)
Are Your LLMs Capable of Stable Reasoning?
por: Liu, Junnan, et al.
Publicado: (2024)
por: Liu, Junnan, et al.
Publicado: (2024)
The Imitation Game: Turing Machine Imitator is Length Generalizable Reasoner
por: Hua, Zhouqi, et al.
Publicado: (2025)
por: Hua, Zhouqi, et al.
Publicado: (2025)
Exploring the Limit of Outcome Reward for Learning Mathematical Reasoning
por: Lyu, Chengqi, et al.
Publicado: (2025)
por: Lyu, Chengqi, et al.
Publicado: (2025)
Unearthing Large Scale Domain-Specific Knowledge from Public Corpora
por: Fei, Zhaoye, et al.
Publicado: (2024)
por: Fei, Zhaoye, et al.
Publicado: (2024)
MegaMath: Pushing the Limits of Open Math Corpora
por: Zhou, Fan, et al.
Publicado: (2025)
por: Zhou, Fan, et al.
Publicado: (2025)
Achieving Olympia-Level Geometry Large Language Model Agent via Complexity Boosting Reinforcement Learning
por: Zhao, Haiteng, et al.
Publicado: (2025)
por: Zhao, Haiteng, et al.
Publicado: (2025)
Agent-FLAN: Designing Data and Methods of Effective Agent Tuning for Large Language Models
por: Chen, Zehui, et al.
Publicado: (2024)
por: Chen, Zehui, et al.
Publicado: (2024)
T-Eval: Evaluating the Tool Utilization Capability of Large Language Models Step by Step
por: Chen, Zehui, et al.
Publicado: (2023)
por: Chen, Zehui, et al.
Publicado: (2023)
Let's Verify Math Questions Step by Step
por: Shen, Chengyu, et al.
Publicado: (2025)
por: Shen, Chengyu, et al.
Publicado: (2025)
CompassVerifier: A Unified and Robust Verifier for LLMs Evaluation and Outcome Reward
por: Liu, Shudong, et al.
Publicado: (2025)
por: Liu, Shudong, et al.
Publicado: (2025)
Semi-off-Policy Reinforcement Learning for Vision-Language Slow-Thinking Reasoning
por: Shen, Junhao, et al.
Publicado: (2025)
por: Shen, Junhao, et al.
Publicado: (2025)
WirelessMathLM: Teaching Mathematical Reasoning for LLMs in Wireless Communications with Reinforcement Learning
por: Li, Xin, et al.
Publicado: (2025)
por: Li, Xin, et al.
Publicado: (2025)
CMM-Math: A Chinese Multimodal Math Dataset To Evaluate and Enhance the Mathematics Reasoning of Large Multimodal Models
por: Liu, Wentao, et al.
Publicado: (2024)
por: Liu, Wentao, et al.
Publicado: (2024)
MathPile: A Billion-Token-Scale Pretraining Corpus for Math
por: Wang, Zengzhi, et al.
Publicado: (2023)
por: Wang, Zengzhi, et al.
Publicado: (2023)
FinanceMath: Knowledge-Intensive Math Reasoning in Finance Domains
por: Zhao, Yilun, et al.
Publicado: (2023)
por: Zhao, Yilun, et al.
Publicado: (2023)
CoinMath: Harnessing the Power of Coding Instruction for Math LLMs
por: Wei, Chengwei, et al.
Publicado: (2024)
por: Wei, Chengwei, et al.
Publicado: (2024)
Code2Math: Can Your Code Agent Effectively Evolve Math Problems Through Exploration?
por: Guo, Dadi, et al.
Publicado: (2026)
por: Guo, Dadi, et al.
Publicado: (2026)
AlchemistCoder: Harmonizing and Eliciting Code Capability by Hindsight Tuning on Multi-source Data
por: Song, Zifan, et al.
Publicado: (2024)
por: Song, Zifan, et al.
Publicado: (2024)
MathChat: Converse to Tackle Challenging Math Problems with LLM Agents
por: Wu, Yiran, et al.
Publicado: (2023)
por: Wu, Yiran, et al.
Publicado: (2023)
We-Math 2.0: A Versatile MathBook System for Incentivizing Visual Mathematical Reasoning
por: Qiao, Runqi, et al.
Publicado: (2025)
por: Qiao, Runqi, et al.
Publicado: (2025)
OPV: Outcome-based Process Verifier for Efficient Long Chain-of-Thought Verification
por: Wu, Zijian, et al.
Publicado: (2025)
por: Wu, Zijian, et al.
Publicado: (2025)
MuggleMath: Assessing the Impact of Query and Response Augmentation on Math Reasoning
por: Li, Chengpeng, et al.
Publicado: (2023)
por: Li, Chengpeng, et al.
Publicado: (2023)
Parental Anxiety and Math Engagement: A Moderated Mediation Model of Math Anxiety and Perceived Teacher Support
por: Yu Zhou, et al.
Publicado: (2025)
por: Yu Zhou, et al.
Publicado: (2025)
TabularMath: Evaluating Computational Extrapolation in Tabular Learning via Program-Verified Synthesis
por: Cheng, Zerui, et al.
Publicado: (2026)
por: Cheng, Zerui, et al.
Publicado: (2026)
Turn Waste into Worth: Rectifying Top-$k$ Router of MoE
por: Zeng, Zhiyuan, et al.
Publicado: (2024)
por: Zeng, Zhiyuan, et al.
Publicado: (2024)
Solving Formal Math Problems by Decomposition and Iterative Reflection
por: Zhou, Yichi, et al.
Publicado: (2025)
por: Zhou, Yichi, et al.
Publicado: (2025)
MathReal: We Keep It Real! A Real Scene Benchmark for Evaluating Math Reasoning in Multimodal Large Language Models
por: Feng, Jun, et al.
Publicado: (2025)
por: Feng, Jun, et al.
Publicado: (2025)
Ejemplares similares
-
InternLM2.5-StepProver: Advancing Automated Theorem Proving via Critic-Guided Search
por: Wu, Zijian, et al.
Publicado: (2024) -
InternLM-Law: An Open Source Chinese Legal Large Language Model
por: Fei, Zhiwei, et al.
Publicado: (2024) -
InternLM2 Technical Report
por: Cai, Zheng, et al.
Publicado: (2024) -
MathBench: Evaluating the Theory and Application Proficiency of LLMs with a Hierarchical Mathematics Benchmark
por: Liu, Hongwei, et al.
Publicado: (2024) -
InternLM-XComposer2.5-Reward: A Simple Yet Effective Multi-Modal Reward Model
por: Zang, Yuhang, et al.
Publicado: (2025)