Distilling Algorithmic Reasoning from LLMs via Explaining Solution Programs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Jierui, Mooney, Raymond |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AlgoSimBench: Identifying Algorithmically Similar Problems for Competitive Programming
par: Li, Jierui, et autres
Publié: (2025)
par: Li, Jierui, et autres
Publié: (2025)
MET-Bench: Multimodal Entity Tracking for Evaluating the Limitations of Vision-Language and Reasoning Models
par: Cohen, Vanya, et autres
Publié: (2025)
par: Cohen, Vanya, et autres
Publié: (2025)
RLKD: Distilling LLMs' Reasoning via Reinforcement Learning
par: Xu, Shicheng, et autres
Publié: (2025)
par: Xu, Shicheng, et autres
Publié: (2025)
Distill Visual Chart Reasoning Ability from LLMs to MLLMs
par: He, Wei, et autres
Publié: (2024)
par: He, Wei, et autres
Publié: (2024)
Effective Distillation of Table-based Reasoning Ability from LLMs
par: Yang, Bohao, et autres
Publié: (2023)
par: Yang, Bohao, et autres
Publié: (2023)
ContraDoc: Understanding Self-Contradictions in Documents with Large Language Models
par: Li, Jierui, et autres
Publié: (2023)
par: Li, Jierui, et autres
Publié: (2023)
Explain in Your Own Words: Improving Reasoning via Token-Selective Dual Knowledge Distillation
par: Kim, Minsang, et autres
Publié: (2026)
par: Kim, Minsang, et autres
Publié: (2026)
Can LLMs Reason in the Wild with Programs?
par: Yang, Yuan, et autres
Publié: (2024)
par: Yang, Yuan, et autres
Publié: (2024)
Visual Program Distillation: Distilling Tools and Programmatic Reasoning into Vision-Language Models
par: Hu, Yushi, et autres
Publié: (2023)
par: Hu, Yushi, et autres
Publié: (2023)
NeuronMLP: Efficient LLM Inference via Singular Value Decomposition Compression and Tiling on AWS Trainium
par: Song, Dinghong, et autres
Publié: (2025)
par: Song, Dinghong, et autres
Publié: (2025)
Short-Path Prompting in LLMs: Analyzing Reasoning Instability and Solutions for Robust Performance
par: Tang, Zuoli, et autres
Publié: (2025)
par: Tang, Zuoli, et autres
Publié: (2025)
Why Does Self-Distillation (Sometimes) Degrade the Reasoning Capability of LLMs?
par: Kim, Jeonghye, et autres
Publié: (2026)
par: Kim, Jeonghye, et autres
Publié: (2026)
KDRL: Post-Training Reasoning LLMs via Unified Knowledge Distillation and Reinforcement Learning
par: Xu, Hongling, et autres
Publié: (2025)
par: Xu, Hongling, et autres
Publié: (2025)
Distillation Contrastive Decoding: Improving LLMs Reasoning with Contrastive Decoding and Distillation
par: Phan, Phuc, et autres
Publié: (2024)
par: Phan, Phuc, et autres
Publié: (2024)
AnimatedLLM: Explaining LLMs with Interactive Visualizations
par: Kasner, Zdeněk, et autres
Publié: (2025)
par: Kasner, Zdeněk, et autres
Publié: (2025)
Continual Dialogue State Tracking via Reason-of-Select Distillation
par: Feng, Yujie, et autres
Publié: (2024)
par: Feng, Yujie, et autres
Publié: (2024)
Long-Chain Reasoning Distillation via Adaptive Prefix Alignment
par: Liu, Zhenghao, et autres
Publié: (2026)
par: Liu, Zhenghao, et autres
Publié: (2026)
BitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation
par: Du, Dayou, et autres
Publié: (2024)
par: Du, Dayou, et autres
Publié: (2024)
Multimodal Contextualized Semantic Parsing from Speech
par: Voas, Jordan, et autres
Publié: (2024)
par: Voas, Jordan, et autres
Publié: (2024)
Distilling the Essence: Efficient Reasoning Distillation via Sequence Truncation
par: Chen, Wei-Rui, et autres
Publié: (2025)
par: Chen, Wei-Rui, et autres
Publié: (2025)
LLMs versus the Halting Problem: Characterizing Program Termination Reasoning
par: Sultan, Oren, et autres
Publié: (2026)
par: Sultan, Oren, et autres
Publié: (2026)
Distill-C: Enhanced NL2SQL via Distilled Customization with LLMs
par: Hoang, Cong Duy Vu, et autres
Publié: (2025)
par: Hoang, Cong Duy Vu, et autres
Publié: (2025)
Reasoning LLMs are Wandering Solution Explorers
par: Lu, Jiahao, et autres
Publié: (2025)
par: Lu, Jiahao, et autres
Publié: (2025)
Native Parallel Reasoner: Reasoning in Parallelism via Self-Distilled Reinforcement Learning
par: Wu, Tong, et autres
Publié: (2025)
par: Wu, Tong, et autres
Publié: (2025)
Can LLMs Explain Themselves Counterfactually?
par: Dehghanighobadi, Zahra, et autres
Publié: (2025)
par: Dehghanighobadi, Zahra, et autres
Publié: (2025)
MoL-RL: Distilling Multi-Step Environmental Feedback into LLMs for Feedback-Independent Reasoning
par: Yang, Kang, et autres
Publié: (2025)
par: Yang, Kang, et autres
Publié: (2025)
Efficient and Stealthy Jailbreak Attacks via Adversarial Prompt Distillation from LLMs to SLMs
par: Li, Xiang, et autres
Publié: (2025)
par: Li, Xiang, et autres
Publié: (2025)
Reasoning Beyond Literal: Cross-style Multimodal Reasoning for Figurative Language Understanding
par: Cheshmi, Seyyed Saeid, et autres
Publié: (2026)
par: Cheshmi, Seyyed Saeid, et autres
Publié: (2026)
NaturalThoughts: Selecting and Distilling Reasoning Traces for General Reasoning Tasks
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
Are Today's LLMs Ready to Explain Well-Being Concepts?
par: Jiang, Bohan, et autres
Publié: (2025)
par: Jiang, Bohan, et autres
Publié: (2025)
Influential Training Data Retrieval for Explaining Verbalized Confidence of LLMs
par: Xia, Yuxi, et autres
Publié: (2026)
par: Xia, Yuxi, et autres
Publié: (2026)
Distilling Reasoning Without Knowledge: A Framework for Reliable LLMs
par: Kietkajornrit, Auksarapak, et autres
Publié: (2026)
par: Kietkajornrit, Auksarapak, et autres
Publié: (2026)
CaT-BENCH: Benchmarking Language Model Understanding of Causal and Temporal Dependencies in Plans
par: Lal, Yash Kumar, et autres
Publié: (2024)
par: Lal, Yash Kumar, et autres
Publié: (2024)
Can Input Attributions Explain Inductive Reasoning in In-Context Learning?
par: Ye, Mengyu, et autres
Publié: (2024)
par: Ye, Mengyu, et autres
Publié: (2024)
Detecting Distillation Data from Reasoning Models
par: Zhang, Hengxiang, et autres
Publié: (2025)
par: Zhang, Hengxiang, et autres
Publié: (2025)
Self-Enhanced Reasoning Training: Activating Latent Reasoning in Small Models for Enhanced Reasoning Distillation
par: Zhang, Yong, et autres
Publié: (2025)
par: Zhang, Yong, et autres
Publié: (2025)
Efficient Knowledge Injection in LLMs via Self-Distillation
par: Kujanpää, Kalle, et autres
Publié: (2024)
par: Kujanpää, Kalle, et autres
Publié: (2024)
TriEx: A Game-based Tri-View Framework for Explaining Internal Reasoning in Multi-Agent LLMs
par: Wang, Ziyi, et autres
Publié: (2026)
par: Wang, Ziyi, et autres
Publié: (2026)
Towards Cross-Tokenizer Distillation: the Universal Logit Distillation Loss for LLMs
par: Boizard, Nicolas, et autres
Publié: (2024)
par: Boizard, Nicolas, et autres
Publié: (2024)
Keypoint-based Progressive Chain-of-Thought Distillation for LLMs
par: Feng, Kaituo, et autres
Publié: (2024)
par: Feng, Kaituo, et autres
Publié: (2024)
Documents similaires
-
AlgoSimBench: Identifying Algorithmically Similar Problems for Competitive Programming
par: Li, Jierui, et autres
Publié: (2025) -
MET-Bench: Multimodal Entity Tracking for Evaluating the Limitations of Vision-Language and Reasoning Models
par: Cohen, Vanya, et autres
Publié: (2025) -
RLKD: Distilling LLMs' Reasoning via Reinforcement Learning
par: Xu, Shicheng, et autres
Publié: (2025) -
Distill Visual Chart Reasoning Ability from LLMs to MLLMs
par: He, Wei, et autres
Publié: (2024) -
Effective Distillation of Table-based Reasoning Ability from LLMs
par: Yang, Bohao, et autres
Publié: (2023)