Improving Mathematical Reasoning Capabilities of Small Language Models via Feedback-Driven Distillation
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhu, Xunyu, Li, Jian, Ma, Can, Wang, Weiping |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Distilling Mathematical Reasoning Capabilities into Small Language Models
por: Zhu, Xunyu, et al.
Publicado: (2024)
por: Zhu, Xunyu, et al.
Publicado: (2024)
Key-Point-Driven Mathematical Reasoning Distillation of Large Language Model
por: Zhu, Xunyu, et al.
Publicado: (2024)
por: Zhu, Xunyu, et al.
Publicado: (2024)
A Survey on Model Compression for Large Language Models
por: Zhu, Xunyu, et al.
Publicado: (2023)
por: Zhu, Xunyu, et al.
Publicado: (2023)
Mitigating Overthinking in Large Reasoning Language Models via Reasoning Path Deviation Monitoring
por: Guan, Weixin, et al.
Publicado: (2026)
por: Guan, Weixin, et al.
Publicado: (2026)
Small But Funny: A Feedback-Driven Approach to Humor Distillation
por: Ravi, Sahithya, et al.
Publicado: (2024)
por: Ravi, Sahithya, et al.
Publicado: (2024)
HintMR: Eliciting Stronger Mathematical Reasoning in Small Language Models
por: Hossain, Jawad, et al.
Publicado: (2026)
por: Hossain, Jawad, et al.
Publicado: (2026)
Olapa-MCoT: Enhancing the Chinese Mathematical Reasoning Capability of LLMs
por: Zhu, Shaojie, et al.
Publicado: (2023)
por: Zhu, Shaojie, et al.
Publicado: (2023)
JiuZhang3.0: Efficiently Improving Mathematical Reasoning by Training Small Data Synthesis Models
por: Zhou, Kun, et al.
Publicado: (2024)
por: Zhou, Kun, et al.
Publicado: (2024)
A Survey on Feedback-based Multi-step Reasoning for Large Language Models on Mathematics
por: Wei, Ting-Ruen, et al.
Publicado: (2025)
por: Wei, Ting-Ruen, et al.
Publicado: (2025)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
por: Wang, Jingyuan, et al.
Publicado: (2025)
por: Wang, Jingyuan, et al.
Publicado: (2025)
Efficient Mathematical Reasoning Models via Dynamic Pruning and Knowledge Distillation
por: Yu, Fengming, et al.
Publicado: (2025)
por: Yu, Fengming, et al.
Publicado: (2025)
A Survey on Large Language Models for Mathematical Reasoning
por: Wang, Peng-Yuan, et al.
Publicado: (2025)
por: Wang, Peng-Yuan, et al.
Publicado: (2025)
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
por: Dong, Guanting, et al.
Publicado: (2024)
por: Dong, Guanting, et al.
Publicado: (2024)
MedCritical: Enhancing Medical Reasoning in Small Language Models via Self-Collaborative Correction
por: Su, Xinchun, et al.
Publicado: (2025)
por: Su, Xinchun, et al.
Publicado: (2025)
Mixed Distillation Helps Smaller Language Model Better Reasoning
por: Li, Chenglin, et al.
Publicado: (2023)
por: Li, Chenglin, et al.
Publicado: (2023)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
por: Xie, Congkai, et al.
Publicado: (2025)
por: Xie, Congkai, et al.
Publicado: (2025)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
por: Wang, Danqing, et al.
Publicado: (2024)
por: Wang, Danqing, et al.
Publicado: (2024)
AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent
por: Luo, Haipeng, et al.
Publicado: (2025)
por: Luo, Haipeng, et al.
Publicado: (2025)
PDDL-Mind: Large Language Models are Capable on Belief Reasoning with Reliable State Tracking
por: Zhu, Wang Bill, et al.
Publicado: (2026)
por: Zhu, Wang Bill, et al.
Publicado: (2026)
UGMathBench: A Diverse and Dynamic Benchmark for Undergraduate-Level Mathematical Reasoning with Large Language Models
por: Xu, Xin, et al.
Publicado: (2025)
por: Xu, Xin, et al.
Publicado: (2025)
Can Large Models Teach Student Models to Solve Mathematical Problems Like Human Beings? A Reasoning Distillation Method via Multi-LoRA Interaction
por: Li, Xinhe, et al.
Publicado: (2025)
por: Li, Xinhe, et al.
Publicado: (2025)
Knowledge Graph Structure as Prompt: Improving Small Language Models Capabilities for Knowledge-based Causal Discovery
por: Susanti, Yuni, et al.
Publicado: (2024)
por: Susanti, Yuni, et al.
Publicado: (2024)
Capturing Nuanced Preferences: Preference-Aligned Distillation for Small Language Models
por: Gu, Yanggan, et al.
Publicado: (2025)
por: Gu, Yanggan, et al.
Publicado: (2025)
Matrix as Plan: Structured Logical Reasoning with Feedback-Driven Replanning
por: Chen, Ke, et al.
Publicado: (2026)
por: Chen, Ke, et al.
Publicado: (2026)
Self-Evolved Preference Optimization for Enhancing Mathematical Reasoning in Small Language Models
por: Singh, Joykirat, et al.
Publicado: (2025)
por: Singh, Joykirat, et al.
Publicado: (2025)
ReAD: Reinforcement-Guided Capability Distillation for Large Language Models
por: Cheng, Xueqi, et al.
Publicado: (2026)
por: Cheng, Xueqi, et al.
Publicado: (2026)
Mem$^2$Evolve: Towards Self-Evolving Agents via Co-Evolutionary Capability Expansion and Experience Distillation
por: Cheng, Zihao, et al.
Publicado: (2026)
por: Cheng, Zihao, et al.
Publicado: (2026)
Dynamic Early Exit in Reasoning Models
por: Yang, Chenxu, et al.
Publicado: (2025)
por: Yang, Chenxu, et al.
Publicado: (2025)
Evaluating Consistency and Reasoning Capabilities of Large Language Models
por: Saxena, Yash, et al.
Publicado: (2024)
por: Saxena, Yash, et al.
Publicado: (2024)
PARAMANU-GANITA: Can Small Math Language Models Rival with Large Language Models on Mathematical Reasoning?
por: Niyogi, Mitodru, et al.
Publicado: (2024)
por: Niyogi, Mitodru, et al.
Publicado: (2024)
Reasoning Capabilities of Large Language Models on Dynamic Tasks
por: Wong, Annie, et al.
Publicado: (2025)
por: Wong, Annie, et al.
Publicado: (2025)
Reinforcement Learning vs. Distillation: Understanding Accuracy and Capability in LLM Reasoning
por: Kim, Minwu, et al.
Publicado: (2025)
por: Kim, Minwu, et al.
Publicado: (2025)
From Next-Token to Mathematics: The Learning Dynamics of Mathematical Reasoning in Language Models
por: Mishra, Shubhra, et al.
Publicado: (2024)
por: Mishra, Shubhra, et al.
Publicado: (2024)
Masked Thought: Simply Masking Partial Reasoning Steps Can Improve Mathematical Reasoning Learning of Language Models
por: Chen, Changyu, et al.
Publicado: (2024)
por: Chen, Changyu, et al.
Publicado: (2024)
Look Before You Leap: Problem Elaboration Prompting Improves Mathematical Reasoning in Large Language Models
por: Liao, Haoran, et al.
Publicado: (2024)
por: Liao, Haoran, et al.
Publicado: (2024)
SOD: Step-wise On-policy Distillation for Small Language Model Agents
por: Zhong, Qiyong, et al.
Publicado: (2026)
por: Zhong, Qiyong, et al.
Publicado: (2026)
Confidence-Calibrated Small-Large Language Model Collaboration for Cost-Efficient Reasoning
por: Zhang, Chuang, et al.
Publicado: (2026)
por: Zhang, Chuang, et al.
Publicado: (2026)
Disentangling Logic: The Role of Context in Large Language Model Reasoning Capabilities
por: Hua, Wenyue, et al.
Publicado: (2024)
por: Hua, Wenyue, et al.
Publicado: (2024)
WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct
por: Luo, Haipeng, et al.
Publicado: (2023)
por: Luo, Haipeng, et al.
Publicado: (2023)
Just Go Parallel: Improving the Multilingual Capabilities of Large Language Models
por: Qorib, Muhammad Reza, et al.
Publicado: (2025)
por: Qorib, Muhammad Reza, et al.
Publicado: (2025)
Ejemplares similares
-
Distilling Mathematical Reasoning Capabilities into Small Language Models
por: Zhu, Xunyu, et al.
Publicado: (2024) -
Key-Point-Driven Mathematical Reasoning Distillation of Large Language Model
por: Zhu, Xunyu, et al.
Publicado: (2024) -
A Survey on Model Compression for Large Language Models
por: Zhu, Xunyu, et al.
Publicado: (2023) -
Mitigating Overthinking in Large Reasoning Language Models via Reasoning Path Deviation Monitoring
por: Guan, Weixin, et al.
Publicado: (2026) -
Small But Funny: A Feedback-Driven Approach to Humor Distillation
por: Ravi, Sahithya, et al.
Publicado: (2024)