PARAMANU-GANITA: Can Small Math Language Models Rival with Large Language Models on Mathematical Reasoning?
Fuente:
arXiv
Salvato in:
| Autori principali: | Niyogi, Mitodru, Bhattacharya, Arnab |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ayn: A Tiny yet Competitive Indian Legal Language Model Pretrained from Scratch
di: Niyogi, Mitodru, et al.
Pubblicazione: (2024)
di: Niyogi, Mitodru, et al.
Pubblicazione: (2024)
Paramanu: Compact and Competitive Monolingual Language Models for Low-Resource Morphologically Rich Indian Languages
di: Niyogi, Mitodru, et al.
Pubblicazione: (2024)
di: Niyogi, Mitodru, et al.
Pubblicazione: (2024)
Neural Models for Source Code Synthesis and Completion
di: Niyogi, Mitodru
Pubblicazione: (2024)
di: Niyogi, Mitodru
Pubblicazione: (2024)
Skywork-Math: Data Scaling Laws for Mathematical Reasoning in Large Language Models -- The Story Goes On
di: Zeng, Liang, et al.
Pubblicazione: (2024)
di: Zeng, Liang, et al.
Pubblicazione: (2024)
WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct
di: Luo, Haipeng, et al.
Pubblicazione: (2023)
di: Luo, Haipeng, et al.
Pubblicazione: (2023)
AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
di: Shao, Zhihong, et al.
Pubblicazione: (2024)
di: Shao, Zhihong, et al.
Pubblicazione: (2024)
Small Encoders Can Rival Large Decoders in Detecting Groundedness
di: Abbes, Istabrak, et al.
Pubblicazione: (2025)
di: Abbes, Istabrak, et al.
Pubblicazione: (2025)
Can Large Language Models Reason and Plan?
di: Kambhampati, Subbarao
Pubblicazione: (2024)
di: Kambhampati, Subbarao
Pubblicazione: (2024)
Self-Evolved Preference Optimization for Enhancing Mathematical Reasoning in Small Language Models
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
Reasoning, Code, or Both? How Large Language Models Handle Variations in Math Questions
di: Kutakh, Matthew
Pubblicazione: (2026)
di: Kutakh, Matthew
Pubblicazione: (2026)
Stepwise Self-Consistent Mathematical Reasoning with Large Language Models
di: Zhao, Zilong, et al.
Pubblicazione: (2024)
di: Zhao, Zilong, et al.
Pubblicazione: (2024)
Forward-Backward Reasoning in Large Language Models for Mathematical Verification
di: Jiang, Weisen, et al.
Pubblicazione: (2023)
di: Jiang, Weisen, et al.
Pubblicazione: (2023)
BhashaSetu: Cross-Lingual Knowledge Transfer from High-Resource to Extreme Low-Resource Languages
di: Maji, Subhadip, et al.
Pubblicazione: (2026)
di: Maji, Subhadip, et al.
Pubblicazione: (2026)
Schoenfeld's Anatomy of Mathematical Reasoning by Language Models
di: Li, Ming, et al.
Pubblicazione: (2025)
di: Li, Ming, et al.
Pubblicazione: (2025)
Masked Thought: Simply Masking Partial Reasoning Steps Can Improve Mathematical Reasoning Learning of Language Models
di: Chen, Changyu, et al.
Pubblicazione: (2024)
di: Chen, Changyu, et al.
Pubblicazione: (2024)
Big-Math: A Large-Scale, High-Quality Math Dataset for Reinforcement Learning in Language Models
di: Albalak, Alon, et al.
Pubblicazione: (2025)
di: Albalak, Alon, et al.
Pubblicazione: (2025)
Rethinking Legal Judgement Prediction in a Realistic Scenario in the Era of Large Language Models
di: Nigam, Shubham Kumar, et al.
Pubblicazione: (2024)
di: Nigam, Shubham Kumar, et al.
Pubblicazione: (2024)
Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?
di: Kao, Kuei-Chun, et al.
Pubblicazione: (2024)
di: Kao, Kuei-Chun, et al.
Pubblicazione: (2024)
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
di: Tang, Zhengyang, et al.
Pubblicazione: (2024)
di: Tang, Zhengyang, et al.
Pubblicazione: (2024)
Evaluating Mathematical Reasoning of Large Language Models: A Focus on Error Identification and Correction
di: Li, Xiaoyuan, et al.
Pubblicazione: (2024)
di: Li, Xiaoyuan, et al.
Pubblicazione: (2024)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
Learning Mathematical Rules with Large Language Models
di: Gorceix, Antoine, et al.
Pubblicazione: (2024)
di: Gorceix, Antoine, et al.
Pubblicazione: (2024)
Towards Reasoning Ability of Small Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
AIMO-2 Winning Solution: Building State-of-the-Art Mathematical Reasoning Models with OpenMathReasoning dataset
di: Moshkov, Ivan, et al.
Pubblicazione: (2025)
di: Moshkov, Ivan, et al.
Pubblicazione: (2025)
All Language Models Large and Small
di: Chen, Zhixun, et al.
Pubblicazione: (2024)
di: Chen, Zhixun, et al.
Pubblicazione: (2024)
DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning
di: Karaman, Batuhan K., et al.
Pubblicazione: (2026)
di: Karaman, Batuhan K., et al.
Pubblicazione: (2026)
CogAtom: From Cognitive Atoms to Olympiad-level Mathematical Reasoning in Large Language Models
di: Chen, Zhuofan, et al.
Pubblicazione: (2025)
di: Chen, Zhuofan, et al.
Pubblicazione: (2025)
Physics of Language Models: Part 2.1, Grade-School Math and the Hidden Reasoning Process
di: Ye, Tian, et al.
Pubblicazione: (2024)
di: Ye, Tian, et al.
Pubblicazione: (2024)
Can Small-Scale Data Poisoning Exacerbate Dialect-Linked Biases in Large Language Models?
di: Abbas, Chaymaa, et al.
Pubblicazione: (2025)
di: Abbas, Chaymaa, et al.
Pubblicazione: (2025)
Can A Gamer Train A Mathematical Reasoning Model?
di: Shin, Andrew
Pubblicazione: (2025)
di: Shin, Andrew
Pubblicazione: (2025)
Are Small Language Models Ready to Compete with Large Language Models for Practical Applications?
di: Sinha, Neelabh, et al.
Pubblicazione: (2024)
di: Sinha, Neelabh, et al.
Pubblicazione: (2024)
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
di: Liu, Chengwu, et al.
Pubblicazione: (2025)
di: Liu, Chengwu, et al.
Pubblicazione: (2025)
Mathematical Reasoning in Large Language Models: Assessing Logical and Arithmetic Errors across Wide Numerical Ranges
di: Shrestha, Safal, et al.
Pubblicazione: (2025)
di: Shrestha, Safal, et al.
Pubblicazione: (2025)
Large Language Model Reasoning Failures
di: Song, Peiyang, et al.
Pubblicazione: (2026)
di: Song, Peiyang, et al.
Pubblicazione: (2026)
AceMath: Advancing Frontier Math Reasoning with Post-Training and Reward Modeling
di: Liu, Zihan, et al.
Pubblicazione: (2024)
di: Liu, Zihan, et al.
Pubblicazione: (2024)
Large Language and Reasoning Models are Shallow Disjunctive Reasoners
di: Khalid, Irtaza, et al.
Pubblicazione: (2025)
di: Khalid, Irtaza, et al.
Pubblicazione: (2025)
MultiMath: Bridging Visual and Mathematical Reasoning for Large Language Models
di: Peng, Shuai, et al.
Pubblicazione: (2024)
di: Peng, Shuai, et al.
Pubblicazione: (2024)
MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts
di: Lu, Pan, et al.
Pubblicazione: (2023)
di: Lu, Pan, et al.
Pubblicazione: (2023)
DotaMath: Decomposition of Thought with Code Assistance and Self-correction for Mathematical Reasoning
di: Li, Chengpeng, et al.
Pubblicazione: (2024)
di: Li, Chengpeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Ayn: A Tiny yet Competitive Indian Legal Language Model Pretrained from Scratch
di: Niyogi, Mitodru, et al.
Pubblicazione: (2024) -
Paramanu: Compact and Competitive Monolingual Language Models for Low-Resource Morphologically Rich Indian Languages
di: Niyogi, Mitodru, et al.
Pubblicazione: (2024) -
Neural Models for Source Code Synthesis and Completion
di: Niyogi, Mitodru
Pubblicazione: (2024) -
Skywork-Math: Data Scaling Laws for Mathematical Reasoning in Large Language Models -- The Story Goes On
di: Zeng, Liang, et al.
Pubblicazione: (2024) -
WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct
di: Luo, Haipeng, et al.
Pubblicazione: (2023)