Exploring the Mystery of Influential Data for Mathematical Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Ni, Xinzhe, Gong, Yeyun, Gou, Zhibin, Shen, Yelong, Yang, Yujiu, Duan, Nan, Chen, Weizhu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving
por: Gou, Zhibin, et al.
Publicado: (2023)
por: Gou, Zhibin, et al.
Publicado: (2023)
Key-Point-Driven Data Synthesis with its Enhancement on Mathematical Reasoning
por: Huang, Yiming, et al.
Publicado: (2024)
por: Huang, Yiming, et al.
Publicado: (2024)
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
por: Gou, Zhibin, et al.
Publicado: (2023)
por: Gou, Zhibin, et al.
Publicado: (2023)
Rho-1: Not All Tokens Are What You Need
por: Lin, Zhenghao, et al.
Publicado: (2024)
por: Lin, Zhenghao, et al.
Publicado: (2024)
SwS: Self-aware Weakness-driven Problem Synthesis in Reinforcement Learning for LLM Reasoning
por: Liang, Xiao, et al.
Publicado: (2025)
por: Liang, Xiao, et al.
Publicado: (2025)
Beyond Pass@1: Self-Play with Variational Problem Synthesis Sustains RLVR
por: Liang, Xiao, et al.
Publicado: (2025)
por: Liang, Xiao, et al.
Publicado: (2025)
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
por: Sun, Jiashuo, et al.
Publicado: (2023)
por: Sun, Jiashuo, et al.
Publicado: (2023)
Competition-Level Problems are Effective LLM Evaluators
por: Huang, Yiming, et al.
Publicado: (2023)
por: Huang, Yiming, et al.
Publicado: (2023)
Mixture of Neuron Experts
por: Cheng, Runxi, et al.
Publicado: (2025)
por: Cheng, Runxi, et al.
Publicado: (2025)
Training LLMs for Divide-and-Conquer Reasoning Elevates Test-Time Scalability
por: Liang, Xiao, et al.
Publicado: (2026)
por: Liang, Xiao, et al.
Publicado: (2026)
SciAgent: Tool-augmented Language Models for Scientific Reasoning
por: Ma, Yubo, et al.
Publicado: (2024)
por: Ma, Yubo, et al.
Publicado: (2024)
CriticBench: Benchmarking LLMs for Critique-Correct Reasoning
por: Lin, Zicheng, et al.
Publicado: (2024)
por: Lin, Zicheng, et al.
Publicado: (2024)
Adapting LLM Agents with Universal Feedback in Communication
por: Wang, Kuan, et al.
Publicado: (2023)
por: Wang, Kuan, et al.
Publicado: (2023)
Samba: Simple Hybrid State Space Models for Efficient Unlimited Context Language Modeling
por: Ren, Liliang, et al.
Publicado: (2024)
por: Ren, Liliang, et al.
Publicado: (2024)
Shuffle the Context: RoPE-Perturbed Self-Distillation for Long-Context Adaptation
por: Li, Zichong, et al.
Publicado: (2026)
por: Li, Zichong, et al.
Publicado: (2026)
Phi-4-Mini-Reasoning: Exploring the Limits of Small Reasoning Language Models in Math
por: Xu, Haoran, et al.
Publicado: (2025)
por: Xu, Haoran, et al.
Publicado: (2025)
Unlocking Multimodal Mathematical Reasoning via Process Reward Model
por: Luo, Ruilin, et al.
Publicado: (2025)
por: Luo, Ruilin, et al.
Publicado: (2025)
PROM: A Phrase-level Copying Mechanism with Pre-training for Abstractive Summarization
por: Ma, Xinbei, et al.
Publicado: (2023)
por: Ma, Xinbei, et al.
Publicado: (2023)
AnnoLLM: Making Large Language Models to Be Better Crowdsourced Annotators
por: He, Xingwei, et al.
Publicado: (2023)
por: He, Xingwei, et al.
Publicado: (2023)
Improving Data and Reward Design for Scientific Reasoning in Large Language Models
por: Chen, Zijie, et al.
Publicado: (2026)
por: Chen, Zijie, et al.
Publicado: (2026)
Hint-enhanced In-Context Learning wakes Large Language Models up for knowledge-intensive tasks
por: Wang, Yifan, et al.
Publicado: (2023)
por: Wang, Yifan, et al.
Publicado: (2023)
Training Matryoshka Mixture-of-Experts for Elastic Inference-Time Expert Utilization
por: Wang, Yaoxiang, et al.
Publicado: (2025)
por: Wang, Yaoxiang, et al.
Publicado: (2025)
Test-time Recursive Thinking: Self-Improvement without External Feedback
por: Zhuang, Yufan, et al.
Publicado: (2026)
por: Zhuang, Yufan, et al.
Publicado: (2026)
Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning
por: Park, Sungjin, et al.
Publicado: (2024)
por: Park, Sungjin, et al.
Publicado: (2024)
Ensuring Safe and High-Quality Outputs: A Guideline Library Approach for Language Models
por: Luo, Yi, et al.
Publicado: (2024)
por: Luo, Yi, et al.
Publicado: (2024)
CMMLU: Measuring massive multitask language understanding in Chinese
por: Li, Haonan, et al.
Publicado: (2023)
por: Li, Haonan, et al.
Publicado: (2023)
DeepSeekMath-V2: Towards Self-Verifiable Mathematical Reasoning
por: Shao, Zhihong, et al.
Publicado: (2025)
por: Shao, Zhihong, et al.
Publicado: (2025)
Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge Graph
por: Sun, Jiashuo, et al.
Publicado: (2023)
por: Sun, Jiashuo, et al.
Publicado: (2023)
Enhancing Large Language Models in Coding Through Multi-Perspective Self-Consistency
por: Huang, Baizhou, et al.
Publicado: (2023)
por: Huang, Baizhou, et al.
Publicado: (2023)
HiCaM: A Hierarchical-Causal Modification Framework for Long-Form Text Modification
por: Shi, Yuntao, et al.
Publicado: (2025)
por: Shi, Yuntao, et al.
Publicado: (2025)
APOLLO: An Optimized Training Approach for Long-form Numerical Reasoning
por: Sun, Jiashuo, et al.
Publicado: (2022)
por: Sun, Jiashuo, et al.
Publicado: (2022)
Chain-of-Reasoning: Towards Unified Mathematical Reasoning in Large Language Models via a Multi-Paradigm Perspective
por: Yu, Yiyao, et al.
Publicado: (2025)
por: Yu, Yiyao, et al.
Publicado: (2025)
PersonaMath: Boosting Mathematical Reasoning via Persona-Driven Data Augmentation
por: Luo, Jing, et al.
Publicado: (2024)
por: Luo, Jing, et al.
Publicado: (2024)
Decoder-Hybrid-Decoder Architecture for Efficient Reasoning with Long Generation
por: Ren, Liliang, et al.
Publicado: (2025)
por: Ren, Liliang, et al.
Publicado: (2025)
Atomic Thinking of LLMs: Decoupling and Exploring Mathematical Reasoning Abilities
por: Kuang, Jiayi, et al.
Publicado: (2025)
por: Kuang, Jiayi, et al.
Publicado: (2025)
Gold-Medal-Level Olympiad Geometry Solving with Efficient Heuristic Auxiliary Constructions
por: Duan, Boyan, et al.
Publicado: (2025)
por: Duan, Boyan, et al.
Publicado: (2025)
Think-with-Rubrics: From External Evaluator to Internal Reasoning Guidance
por: Yu, Jiachen, et al.
Publicado: (2026)
por: Yu, Jiachen, et al.
Publicado: (2026)
Influential Training Data Retrieval for Explaining Verbalized Confidence of LLMs
por: Xia, Yuxi, et al.
Publicado: (2026)
por: Xia, Yuxi, et al.
Publicado: (2026)
The Mystery of Compositional Generalization in Graph-based Generative Commonsense Reasoning
por: Fu, Xiyan, et al.
Publicado: (2024)
por: Fu, Xiyan, et al.
Publicado: (2024)
Reinforcement Learning for Reasoning in Large Language Models with One Training Example
por: Wang, Yiping, et al.
Publicado: (2025)
por: Wang, Yiping, et al.
Publicado: (2025)
Ejemplares similares
-
ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving
por: Gou, Zhibin, et al.
Publicado: (2023) -
Key-Point-Driven Data Synthesis with its Enhancement on Mathematical Reasoning
por: Huang, Yiming, et al.
Publicado: (2024) -
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
por: Gou, Zhibin, et al.
Publicado: (2023) -
Rho-1: Not All Tokens Are What You Need
por: Lin, Zhenghao, et al.
Publicado: (2024) -
SwS: Self-aware Weakness-driven Problem Synthesis in Reinforcement Learning for LLM Reasoning
por: Liang, Xiao, et al.
Publicado: (2025)