InfinityMATH: A Scalable Instruction Tuning Dataset in Programmatic Mathematical Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Bo-Wen, Yan, Yan, Li, Lin, Liu, Guang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
KisMATH: Do LLMs Have Knowledge of Implicit Structures in Mathematical Reasoning?
di: Saha, Soumadeep, et al.
Pubblicazione: (2025)
di: Saha, Soumadeep, et al.
Pubblicazione: (2025)
Quantized Side Tuning: Fast and Memory-Efficient Tuning of Quantized Large Language Models
di: Zhang, Zhengxin, et al.
Pubblicazione: (2024)
di: Zhang, Zhengxin, et al.
Pubblicazione: (2024)
On Semantic Loss Fine-Tuning Approach for Preventing Model Collapse in Causal Reasoning
di: Deshmukh, Pratik, et al.
Pubblicazione: (2026)
di: Deshmukh, Pratik, et al.
Pubblicazione: (2026)
External Hippocampus: Topological Cognitive Maps for Guiding Large Language Model Reasoning
di: Yan, Jian
Pubblicazione: (2025)
di: Yan, Jian
Pubblicazione: (2025)
Improving Influence-based Instruction Tuning Data Selection for Balanced Learning of Diverse Capabilities
di: Dai, Qirun, et al.
Pubblicazione: (2025)
di: Dai, Qirun, et al.
Pubblicazione: (2025)
SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning
di: Fang, Qitong, et al.
Pubblicazione: (2026)
di: Fang, Qitong, et al.
Pubblicazione: (2026)
Mathador-LM: A Dynamic Benchmark for Mathematical Reasoning on Large Language Models
di: Kurtic, Eldar, et al.
Pubblicazione: (2024)
di: Kurtic, Eldar, et al.
Pubblicazione: (2024)
A Scalable Communication Protocol for Networks of Large Language Models
di: Marro, Samuele, et al.
Pubblicazione: (2024)
di: Marro, Samuele, et al.
Pubblicazione: (2024)
Beyond the Black Box: A Statistical Model for LLM Reasoning and Inference
di: Dalal, Siddhartha, et al.
Pubblicazione: (2024)
di: Dalal, Siddhartha, et al.
Pubblicazione: (2024)
FediLoRA: Practical Federated Fine-Tuning of Foundation Models Under Missing-Modality Constraints
di: Yang, Lishan, et al.
Pubblicazione: (2025)
di: Yang, Lishan, et al.
Pubblicazione: (2025)
RAVR: Reference-Answer-guided Variational Reasoning for Large Language Models
di: Lin, Tianqianjin, et al.
Pubblicazione: (2025)
di: Lin, Tianqianjin, et al.
Pubblicazione: (2025)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
Balancing Efficiency and Effectiveness: An LLM-Infused Approach for Optimized CTR Prediction
di: Zhang, Guoxiao, et al.
Pubblicazione: (2024)
di: Zhang, Guoxiao, et al.
Pubblicazione: (2024)
CoDA: Coding LM via Diffusion Adaptation
di: Chen, Haolin, et al.
Pubblicazione: (2025)
di: Chen, Haolin, et al.
Pubblicazione: (2025)
EnergyMamba: An Uncertainty-Aware Graph-Enhanced Selective State Space Model for Energy Consumption Prediction
di: Yu, Dahai, et al.
Pubblicazione: (2026)
di: Yu, Dahai, et al.
Pubblicazione: (2026)
Overclocking LLM Reasoning: Monitoring and Controlling Thinking Path Lengths in LLMs
di: Eisenstadt, Roy, et al.
Pubblicazione: (2025)
di: Eisenstadt, Roy, et al.
Pubblicazione: (2025)
The Geometry of Thought: How Scale Restructures Reasoning In Large Language Models
di: Anderson, Samuel Cyrenius
Pubblicazione: (2026)
di: Anderson, Samuel Cyrenius
Pubblicazione: (2026)
CircuitProbe: Predicting Reasoning Circuits in Transformers via Stability Zone Detection
di: Panuganti, Rajkiran
Pubblicazione: (2026)
di: Panuganti, Rajkiran
Pubblicazione: (2026)
Reasoning Large Language Model Errors Arise from Hallucinating Critical Problem Features
di: Heyman, Alex, et al.
Pubblicazione: (2025)
di: Heyman, Alex, et al.
Pubblicazione: (2025)
GNN for Structural Displacement Prediction
di: Chang, Hung-Fu, et al.
Pubblicazione: (2026)
di: Chang, Hung-Fu, et al.
Pubblicazione: (2026)
How Does Unfaithful Reasoning Emerge from Autoregressive Training? A Study of Synthetic Experiments
di: Wang, Fuxin, et al.
Pubblicazione: (2026)
di: Wang, Fuxin, et al.
Pubblicazione: (2026)
A Llama walks into the 'Bar': Efficient Supervised Fine-Tuning for Legal Reasoning in the Multi-state Bar Exam
di: Fernandes, Rean, et al.
Pubblicazione: (2025)
di: Fernandes, Rean, et al.
Pubblicazione: (2025)
KACE: Knowledge-Adaptive Context Engineering for Mathematical Reasoning
di: Parashar, Jayant, et al.
Pubblicazione: (2026)
di: Parashar, Jayant, et al.
Pubblicazione: (2026)
Exploring the Effectiveness of Instruction Tuning in Biomedical Language Processing
di: Rohanian, Omid, et al.
Pubblicazione: (2023)
di: Rohanian, Omid, et al.
Pubblicazione: (2023)
Meta-Learning at Scale for Large Language Models via Low-Rank Amortized Bayesian Meta-Learning
di: Zhang, Liyi, et al.
Pubblicazione: (2025)
di: Zhang, Liyi, et al.
Pubblicazione: (2025)
End-to-End Optimization of LLM-Driven Multi-Agent Search Systems via Heterogeneous-Group-Based Reinforcement Learning
di: Chen, Guanzhong, et al.
Pubblicazione: (2025)
di: Chen, Guanzhong, et al.
Pubblicazione: (2025)
SSSD: Simply-Scalable Speculative Decoding
di: Marzollo, Michele, et al.
Pubblicazione: (2024)
di: Marzollo, Michele, et al.
Pubblicazione: (2024)
Attention Drift: What Autoregressive Speculative Decoding Models Learn
di: Eldenk, Doğaç, et al.
Pubblicazione: (2026)
di: Eldenk, Doğaç, et al.
Pubblicazione: (2026)
Robust Tool Use via Fission-GRPO: Learning to Recover from Execution Errors
di: Zhang, Zhiwei, et al.
Pubblicazione: (2026)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2026)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
di: Chen, Haolin, et al.
Pubblicazione: (2024)
di: Chen, Haolin, et al.
Pubblicazione: (2024)
Does LLM Alignment Really Need Diversity? An Empirical Study of Adapting RLVR Methods for Moral Reasoning
di: Zhang, Zhaowei, et al.
Pubblicazione: (2026)
di: Zhang, Zhaowei, et al.
Pubblicazione: (2026)
R2R: Efficiently Navigating Divergent Reasoning Paths with Small-Large Model Token Routing
di: Fu, Tianyu, et al.
Pubblicazione: (2025)
di: Fu, Tianyu, et al.
Pubblicazione: (2025)
Positional Failures in Long-Context LLMs: A Blind Spot in Reasoning Benchmarks
di: Zhang, Chuyifei, et al.
Pubblicazione: (2026)
di: Zhang, Chuyifei, et al.
Pubblicazione: (2026)
Training Dynamics Underlying Language Model Scaling Laws: Loss Deceleration and Zero-Sum Learning
di: Mircea, Andrei, et al.
Pubblicazione: (2025)
di: Mircea, Andrei, et al.
Pubblicazione: (2025)
Behavioural Analysis of Alignment Faking
di: Hadida, Nathaniel Mitrani, et al.
Pubblicazione: (2026)
di: Hadida, Nathaniel Mitrani, et al.
Pubblicazione: (2026)
REAP the Experts: Why Pruning Prevails for One-Shot MoE compression
di: Lasby, Mike, et al.
Pubblicazione: (2025)
di: Lasby, Mike, et al.
Pubblicazione: (2025)
Random Rule Forest (RRF): Interpretable Ensembles of LLM-Generated Questions for Predicting Startup Success
di: Griffin, Ben, et al.
Pubblicazione: (2025)
di: Griffin, Ben, et al.
Pubblicazione: (2025)
Beyond Memorization: Violating Privacy Via Inference with Large Language Models
di: Staab, Robin, et al.
Pubblicazione: (2023)
di: Staab, Robin, et al.
Pubblicazione: (2023)
Disposition Distillation at Small Scale: A Three-Arc Negative Result
di: Sadasivan, Hari
Pubblicazione: (2026)
di: Sadasivan, Hari
Pubblicazione: (2026)
Identity as Attractor: Geometric Evidence for Persistent Agent Architecture in LLM Activation Space
di: Vasilenko, Vladimir
Pubblicazione: (2026)
di: Vasilenko, Vladimir
Pubblicazione: (2026)
Documenti analoghi
-
KisMATH: Do LLMs Have Knowledge of Implicit Structures in Mathematical Reasoning?
di: Saha, Soumadeep, et al.
Pubblicazione: (2025) -
Quantized Side Tuning: Fast and Memory-Efficient Tuning of Quantized Large Language Models
di: Zhang, Zhengxin, et al.
Pubblicazione: (2024) -
On Semantic Loss Fine-Tuning Approach for Preventing Model Collapse in Causal Reasoning
di: Deshmukh, Pratik, et al.
Pubblicazione: (2026) -
External Hippocampus: Topological Cognitive Maps for Guiding Large Language Model Reasoning
di: Yan, Jian
Pubblicazione: (2025) -
Improving Influence-based Instruction Tuning Data Selection for Balanced Learning of Diverse Capabilities
di: Dai, Qirun, et al.
Pubblicazione: (2025)