Mathify: Evaluating Large Language Models on Mathematical Problem Solving Tasks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Anand, Avinash, Gupta, Mohit, Prasad, Kritarth, Singla, Navya, Sanjeev, Sanjana, Kumar, Jatin, Shivam, Adarsh Raj, Shah, Rajiv Ratn |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
KG-CTG: Citation Generation through Knowledge Graph-guided Large Language Models
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
Enhancing LLMs for Physics Problem-Solving using Reinforcement Learning with Human-AI Feedback
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
Context-Enhanced Language Models for Generating Multi-Paper Citations
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
Improving Multimodal LLMs Ability In Geometry Problem Solving, Reasoning, And Multistep Scoring
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
MM-PhyRLHF: Reinforcement Learning Framework for Multimodal Physics Question-Answering
par: Kapuriya, Janak, et autres
Publié: (2024)
par: Kapuriya, Janak, et autres
Publié: (2024)
Med-CoDE: Medical Critique based Disagreement Evaluation Framework
par: Gupta, Mohit, et autres
Publié: (2025)
par: Gupta, Mohit, et autres
Publié: (2025)
Steps are all you need: Rethinking STEM Education with Prompt Engineering
par: Addala, Krishnasai, et autres
Publié: (2024)
par: Addala, Krishnasai, et autres
Publié: (2024)
TC-OCR: TableCraft OCR for Efficient Detection & Recognition of Table Structure & Content
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
IRIS: Interleaved Reinforcement with Incremental Staged Curriculum for Cross-Lingual Mathematical Reasoning
par: Gupta, Navya, et autres
Publié: (2026)
par: Gupta, Navya, et autres
Publié: (2026)
Improving Physics Reasoning in Large Language Models Using Mixture of Refinement Agents
par: Jaiswal, Raj, et autres
Publié: (2024)
par: Jaiswal, Raj, et autres
Publié: (2024)
Advancements in Scientific Controllable Text Generation Methods
par: Goel, Arnav, et autres
Publié: (2023)
par: Goel, Arnav, et autres
Publié: (2023)
Depression Detection and Analysis using Large Language Models on Textual and Audio-Visual Modalities
par: Tank, Chayan, et autres
Publié: (2024)
par: Tank, Chayan, et autres
Publié: (2024)
Knowledge Graphs are all you need: Leveraging KGs in Physics Question Answering
par: Addala, Krishnasai, et autres
Publié: (2024)
par: Addala, Krishnasai, et autres
Publié: (2024)
Detecting LLM-Assisted Academic Dishonesty using Keystroke Dynamics
par: Mehta, Atharva, et autres
Publié: (2025)
par: Mehta, Atharva, et autres
Publié: (2025)
Su-RoBERTa: A Semi-supervised Approach to Predicting Suicide Risk through Social Media using Base Language Models
par: Tank, Chayan, et autres
Publié: (2024)
par: Tank, Chayan, et autres
Publié: (2024)
RanLayNet: A Dataset for Document Layout Detection used for Domain Adaptation and Generalization
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
Keystroke Dynamics Against Academic Dishonesty in the Age of LLMs
par: Kundu, Debnath, et autres
Publié: (2024)
par: Kundu, Debnath, et autres
Publié: (2024)
On Optimal Steering to Achieve Exact Fairness
par: Sharma, Mohit, et autres
Publié: (2025)
par: Sharma, Mohit, et autres
Publié: (2025)
Better and Worse with Scale: How Contextual Entrainment Diverges with Model Size
par: Kukreja, Dikshant, et autres
Publié: (2026)
par: Kukreja, Dikshant, et autres
Publié: (2026)
Enhancing Scientific Visual Question Answering via Vision-Caption aware Supervised Fine-Tuning
par: Kapuriya, Janak, et autres
Publié: (2025)
par: Kapuriya, Janak, et autres
Publié: (2025)
Speech Representation Learning Revisited: The Necessity of Separate Learnable Parameters and Robust Data Augmentation
par: Yadav, Hemant, et autres
Publié: (2024)
par: Yadav, Hemant, et autres
Publié: (2024)
LittiChoQA: Literary Texts in Indic Languages Chosen for Question Answering
par: Khandelwal, Aarya, et autres
Publié: (2026)
par: Khandelwal, Aarya, et autres
Publié: (2026)
RConE: Rough Cone Embedding for Multi-Hop Logical Query Answering on Multi-Modal Knowledge Graphs
par: Kharbanda, Mayank, et autres
Publié: (2024)
par: Kharbanda, Mayank, et autres
Publié: (2024)
Analysing the Masked predictive coding training criterion for pre-training a Speech Representation Model
par: Yadav, Hemant, et autres
Publié: (2023)
par: Yadav, Hemant, et autres
Publié: (2023)
Long-context Non-factoid Question Answering in Indic Languages
par: Mishra, Ritwik, et autres
Publié: (2025)
par: Mishra, Ritwik, et autres
Publié: (2025)
MS-HuBERT: Mitigating Pre-training and Inference Mismatch in Masked Language Modelling methods for learning Speech Representations
par: Yadav, Hemant, et autres
Publié: (2024)
par: Yadav, Hemant, et autres
Publié: (2024)
JOOCI: a Framework for Learning Comprehensive Speech Representations
par: Yadav, Hemant, et autres
Publié: (2024)
par: Yadav, Hemant, et autres
Publié: (2024)
Accelerating Social Science Research via Agentic Hypothesization and Experimentation
par: Gupta, Jishu Sen, et autres
Publié: (2026)
par: Gupta, Jishu Sen, et autres
Publié: (2026)
Indian Sign Language Detection for Real-Time Translation using Machine Learning
par: Singhal, Rajat, et autres
Publié: (2025)
par: Singhal, Rajat, et autres
Publié: (2025)
Isometric Neural Machine Translation using Phoneme Count Ratio Reward-based Reinforcement Learning
par: Mhaskar, Shivam Ratnakant, et autres
Publié: (2024)
par: Mhaskar, Shivam Ratnakant, et autres
Publié: (2024)
Psychologically-Grounded Graph Modeling for Interpretable Depression Detection
par: Vyalla, Rishitej Reddy, et autres
Publié: (2026)
par: Vyalla, Rishitej Reddy, et autres
Publié: (2026)
Ruxolitinib in Pediatric Steroid‐Refractory Graft‐Versus‐Host Disease: An Experience From a Tertiary Center in India
par: Sanjana Sarangarajan, et autres
Publié: (2026)
par: Sanjana Sarangarajan, et autres
Publié: (2026)
Structured Definitions and Segmentations for Legal Reasoning in LLMs: A Study on Indian Legal Data
par: Khatri, Mann, et autres
Publié: (2025)
par: Khatri, Mann, et autres
Publié: (2025)
Multilingual Coreference Resolution in Low-resource South Asian Languages
par: Mishra, Ritwik, et autres
Publié: (2024)
par: Mishra, Ritwik, et autres
Publié: (2024)
Spiritual-LLM : Gita Inspired Mental Health Therapy In the Era of LLMs
par: Kapuriya, Janak, et autres
Publié: (2025)
par: Kapuriya, Janak, et autres
Publié: (2025)
Multilingual Non-Factoid Question Answering with Answer Paragraph Selection
par: Mishra, Ritwik, et autres
Publié: (2024)
par: Mishra, Ritwik, et autres
Publié: (2024)
Teaching Human Behavior Improves Content Understanding Abilities Of LLMs
par: Singh, Somesh, et autres
Publié: (2024)
par: Singh, Somesh, et autres
Publié: (2024)
DubWise: Video-Guided Speech Duration Control in Multimodal LLM-based Text-to-Speech for Dubbing
par: Sahipjohn, Neha, et autres
Publié: (2024)
par: Sahipjohn, Neha, et autres
Publié: (2024)
VECL-TTS: Voice identity and Emotional style controllable Cross-Lingual Text-to-Speech
par: Gudmalwar, Ashishkumar, et autres
Publié: (2024)
par: Gudmalwar, Ashishkumar, et autres
Publié: (2024)
Documents similaires
-
KG-CTG: Citation Generation through Knowledge Graph-guided Large Language Models
par: Anand, Avinash, et autres
Publié: (2024) -
Enhancing LLMs for Physics Problem-Solving using Reinforcement Learning with Human-AI Feedback
par: Anand, Avinash, et autres
Publié: (2024) -
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
par: Anand, Avinash, et autres
Publié: (2024) -
Context-Enhanced Language Models for Generating Multi-Paper Citations
par: Anand, Avinash, et autres
Publié: (2024) -
Improving Multimodal LLMs Ability In Geometry Problem Solving, Reasoning, And Multistep Scoring
par: Anand, Avinash, et autres
Publié: (2024)