AdaptMI: Adaptive Skill-based In-context Math Instruction for Small Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Yinghui, Panigrahi, Abhishek, Lin, Yong, Arora, Sanjeev |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Skill-Targeted Adaptive Training
di: He, Yinghui, et al.
Pubblicazione: (2025)
di: He, Yinghui, et al.
Pubblicazione: (2025)
Trainable Transformer in Transformer
di: Panigrahi, Abhishek, et al.
Pubblicazione: (2023)
di: Panigrahi, Abhishek, et al.
Pubblicazione: (2023)
Instruct-SkillMix: A Powerful Pipeline for LLM Instruction Tuning
di: Kaur, Simran, et al.
Pubblicazione: (2024)
di: Kaur, Simran, et al.
Pubblicazione: (2024)
Self-Distillation Zero: Self-Revision Turns Binary Rewards into Dense Supervision
di: He, Yinghui, et al.
Pubblicazione: (2026)
di: He, Yinghui, et al.
Pubblicazione: (2026)
Why is Your Language Model a Poor Implicit Reward Model?
di: Razin, Noam, et al.
Pubblicazione: (2025)
di: Razin, Noam, et al.
Pubblicazione: (2025)
Generalizing from SIMPLE to HARD Visual Reasoning: Can We Mitigate Modality Imbalance in VLMs?
di: Park, Simon, et al.
Pubblicazione: (2025)
di: Park, Simon, et al.
Pubblicazione: (2025)
In-context Learning vs. Instruction Tuning: The Case of Small and Multilingual Language Models
di: Ponce, David, et al.
Pubblicazione: (2025)
di: Ponce, David, et al.
Pubblicazione: (2025)
LinkTransformer: A Unified Package for Record Linkage with Transformer Language Models
di: Arora, Abhishek, et al.
Pubblicazione: (2023)
di: Arora, Abhishek, et al.
Pubblicazione: (2023)
Don't Adapt Small Language Models for Tools; Adapt Tool Schemas to the Models
di: Lee, Jonggeun, et al.
Pubblicazione: (2025)
di: Lee, Jonggeun, et al.
Pubblicazione: (2025)
Can Models Learn Skill Composition from Examples?
di: Zhao, Haoyu, et al.
Pubblicazione: (2024)
di: Zhao, Haoyu, et al.
Pubblicazione: (2024)
RAISE: Reinforced Adaptive Instruction Selection For Large Language Models
di: Lv, Qingsong, et al.
Pubblicazione: (2025)
di: Lv, Qingsong, et al.
Pubblicazione: (2025)
MathOdyssey: Benchmarking Mathematical Problem-Solving Skills in Large Language Models Using Odyssey Math Data
di: Fang, Meng, et al.
Pubblicazione: (2024)
di: Fang, Meng, et al.
Pubblicazione: (2024)
CoinMath: Harnessing the Power of Coding Instruction for Math LLMs
di: Wei, Chengwei, et al.
Pubblicazione: (2024)
di: Wei, Chengwei, et al.
Pubblicazione: (2024)
Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
di: Pan, Rui, et al.
Pubblicazione: (2025)
di: Pan, Rui, et al.
Pubblicazione: (2025)
An Incomplete Loop: Instruction Inference, Instruction Following, and In-context Learning in Language Models
di: Liu, Emmy, et al.
Pubblicazione: (2024)
di: Liu, Emmy, et al.
Pubblicazione: (2024)
Representing Rule-based Chatbots with Transformers
di: Friedman, Dan, et al.
Pubblicazione: (2024)
di: Friedman, Dan, et al.
Pubblicazione: (2024)
Phi-4-Mini-Reasoning: Exploring the Limits of Small Reasoning Language Models in Math
di: Xu, Haoran, et al.
Pubblicazione: (2025)
di: Xu, Haoran, et al.
Pubblicazione: (2025)
LESS: Selecting Influential Data for Targeted Instruction Tuning
di: Xia, Mengzhou, et al.
Pubblicazione: (2024)
di: Xia, Mengzhou, et al.
Pubblicazione: (2024)
On the SDEs and Scaling Rules for Adaptive Gradient Algorithms
di: Malladi, Sadhika, et al.
Pubblicazione: (2022)
di: Malladi, Sadhika, et al.
Pubblicazione: (2022)
Large Language Models Approach Expert Pedagogical Quality in Math Tutoring but Differ in Instructional and Linguistic Profiles
di: Abdulsalam, Ramatu Oiza, et al.
Pubblicazione: (2025)
di: Abdulsalam, Ramatu Oiza, et al.
Pubblicazione: (2025)
InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning
di: Ying, Huaiyuan, et al.
Pubblicazione: (2024)
di: Ying, Huaiyuan, et al.
Pubblicazione: (2024)
Fusion of Domain-Adapted Vision and Language Models for Medical Visual Question Answering
di: Ha, Cuong Nhat, et al.
Pubblicazione: (2024)
di: Ha, Cuong Nhat, et al.
Pubblicazione: (2024)
MI-PRUN: Optimize Large Language Model Pruning via Mutual Information
di: Zhang, Hao, et al.
Pubblicazione: (2026)
di: Zhang, Hao, et al.
Pubblicazione: (2026)
MathFusion: Enhancing Mathematical Problem-solving of LLM through Instruction Fusion
di: Pei, Qizhi, et al.
Pubblicazione: (2025)
di: Pei, Qizhi, et al.
Pubblicazione: (2025)
Error Classification of Large Language Models on Math Word Problems: A Dynamically Adaptive Framework
di: Sun, Yuhong, et al.
Pubblicazione: (2025)
di: Sun, Yuhong, et al.
Pubblicazione: (2025)
To Code or not to Code? Adaptive Tool Integration for Math Language Models via Expectation-Maximization
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
On the Power of Context-Enhanced Learning in LLMs
di: Zhu, Xingyu, et al.
Pubblicazione: (2025)
di: Zhu, Xingyu, et al.
Pubblicazione: (2025)
Benchmarking Hallucination in Large Language Models based on Unanswerable Math Word Problem
di: Sun, Yuhong, et al.
Pubblicazione: (2024)
di: Sun, Yuhong, et al.
Pubblicazione: (2024)
Domain-Adapted Small Language Models for Reliable Clinical Triage
di: Aljohani, Manar, et al.
Pubblicazione: (2026)
di: Aljohani, Manar, et al.
Pubblicazione: (2026)
GeoMathCode: Understanding Interleaved Math-Code Reasoning for Geometry Problem Solving
di: Zhang, Yingji, et al.
Pubblicazione: (2026)
di: Zhang, Yingji, et al.
Pubblicazione: (2026)
rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking
di: Guan, Xinyu, et al.
Pubblicazione: (2025)
di: Guan, Xinyu, et al.
Pubblicazione: (2025)
Family Matters: Language Transfer and Merging for Adapting Small LLMs to Faroese
di: Kunz, Jenny, et al.
Pubblicazione: (2025)
di: Kunz, Jenny, et al.
Pubblicazione: (2025)
CMAT: A Multi-Agent Collaboration Tuning Framework for Enhancing Small Language Models
di: Liang, Xuechen, et al.
Pubblicazione: (2024)
di: Liang, Xuechen, et al.
Pubblicazione: (2024)
Improving Multilingual Math Reasoning for African Languages
di: Ogundepo, Odunayo, et al.
Pubblicazione: (2025)
di: Ogundepo, Odunayo, et al.
Pubblicazione: (2025)
PARAMANU-GANITA: Can Small Math Language Models Rival with Large Language Models on Mathematical Reasoning?
di: Niyogi, Mitodru, et al.
Pubblicazione: (2024)
di: Niyogi, Mitodru, et al.
Pubblicazione: (2024)
Small Language Models Learn Enhanced Reasoning Skills from Medical Textbooks
di: Kim, Hyunjae, et al.
Pubblicazione: (2024)
di: Kim, Hyunjae, et al.
Pubblicazione: (2024)
CMMaTH: A Chinese Multi-modal Math Skill Evaluation Benchmark for Foundation Models
di: Li, Zhong-Zhi, et al.
Pubblicazione: (2024)
di: Li, Zhong-Zhi, et al.
Pubblicazione: (2024)
Solving Math Word Problems via Cooperative Reasoning induced Language Models
di: Zhu, Xinyu, et al.
Pubblicazione: (2022)
di: Zhu, Xinyu, et al.
Pubblicazione: (2022)
WarriorMath: Enhancing the Mathematical Ability of Large Language Models with a Defect-aware Framework
di: Chen, Yue, et al.
Pubblicazione: (2025)
di: Chen, Yue, et al.
Pubblicazione: (2025)
AdaptVision: Efficient Vision-Language Models via Adaptive Visual Acquisition
di: Lin, Zichuan, et al.
Pubblicazione: (2025)
di: Lin, Zichuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Skill-Targeted Adaptive Training
di: He, Yinghui, et al.
Pubblicazione: (2025) -
Trainable Transformer in Transformer
di: Panigrahi, Abhishek, et al.
Pubblicazione: (2023) -
Instruct-SkillMix: A Powerful Pipeline for LLM Instruction Tuning
di: Kaur, Simran, et al.
Pubblicazione: (2024) -
Self-Distillation Zero: Self-Revision Turns Binary Rewards into Dense Supervision
di: He, Yinghui, et al.
Pubblicazione: (2026) -
Why is Your Language Model a Poor Implicit Reward Model?
di: Razin, Noam, et al.
Pubblicazione: (2025)