Less is More Tokens: Efficient Math Reasoning via Difficulty-Aware Chain-of-Thought Distillation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Waheed, Abdul, Mitra, Chancharik, Wang, Laurie Z., Ramanan, Deva, Raj, Bhiksha |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
uDistil-Whisper: Label-Free Data Filtering for Knowledge Distillation in Low-Data Regimes
par: Waheed, Abdul, et autres
Publié: (2024)
par: Waheed, Abdul, et autres
Publié: (2024)
Compositional Chain-of-Thought Prompting for Large Multimodal Models
par: Mitra, Chancharik, et autres
Publié: (2023)
par: Mitra, Chancharik, et autres
Publié: (2023)
On the Robust Approximation of ASR Metrics
par: Waheed, Abdul, et autres
Publié: (2025)
par: Waheed, Abdul, et autres
Publié: (2025)
Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework
par: Zhang, Chenyuan, et autres
Publié: (2026)
par: Zhang, Chenyuan, et autres
Publié: (2026)
Mechanistic Finetuning of Vision-Language-Action Models via Few-Shot Demonstrations
par: Mitra, Chancharik, et autres
Publié: (2025)
par: Mitra, Chancharik, et autres
Publié: (2025)
What Do Speech Foundation Models Not Learn About Speech?
par: Waheed, Abdul, et autres
Publié: (2024)
par: Waheed, Abdul, et autres
Publié: (2024)
Lost in Transcription, Found in Distribution Shift: Demystifying Hallucination in Speech Foundation Models
par: Atwany, Hanin, et autres
Publié: (2025)
par: Atwany, Hanin, et autres
Publié: (2025)
VideoJudge: Bootstrapping Enables Scalable Supervision of MLLM-as-a-Judge for Video Understanding
par: Waheed, Abdul, et autres
Publié: (2025)
par: Waheed, Abdul, et autres
Publié: (2025)
Scheherazade: Evaluating Chain-of-Thought Math Reasoning in LLMs with Chain-of-Problems
par: Miner, Stephen, et autres
Publié: (2024)
par: Miner, Stephen, et autres
Publié: (2024)
When More is Less: Understanding Chain-of-Thought Length in LLMs
par: Wu, Yuyang, et autres
Publié: (2025)
par: Wu, Yuyang, et autres
Publié: (2025)
Efficient Reasoning via Chain of Unconscious Thought
par: Gong, Ruihan, et autres
Publié: (2025)
par: Gong, Ruihan, et autres
Publié: (2025)
MathCanvas: Intrinsic Visual Chain-of-Thought for Multimodal Mathematical Reasoning
par: Shi, Weikang, et autres
Publié: (2025)
par: Shi, Weikang, et autres
Publié: (2025)
On the Diversity of Synthetic Data and its Impact on Training Large Language Models
par: Chen, Hao, et autres
Publié: (2024)
par: Chen, Hao, et autres
Publié: (2024)
To Distill or Not to Distill? On the Robustness of Robust Knowledge Distillation
par: Waheed, Abdul, et autres
Publié: (2024)
par: Waheed, Abdul, et autres
Publié: (2024)
Structured Reasoning with Tree-of-Thoughts for Bengali Math Word Problems
par: Mahmood, Aurprita, et autres
Publié: (2025)
par: Mahmood, Aurprita, et autres
Publié: (2025)
Think Less, Know More: State-Aware Reasoning Compression with Knowledge Guidance for Efficient Reasoning
par: Sui, Yi, et autres
Publié: (2026)
par: Sui, Yi, et autres
Publié: (2026)
Enhancing Few-Shot Vision-Language Classification with Large Multimodal Model Features
par: Mitra, Chancharik, et autres
Publié: (2024)
par: Mitra, Chancharik, et autres
Publié: (2024)
Unveiling the Key Factors for Distilling Chain-of-Thought Reasoning
par: Chen, Xinghao, et autres
Publié: (2025)
par: Chen, Xinghao, et autres
Publié: (2025)
ARES: Multimodal Adaptive Reasoning via Difficulty-Aware Token-Level Entropy Shaping
par: Chen, Shuang, et autres
Publié: (2025)
par: Chen, Shuang, et autres
Publié: (2025)
LLMSR@XLLM25: Less is More: Enhancing Structured Multi-Agent Reasoning via Quality-Guided Distillation
par: Yuan, Jiahao, et autres
Publié: (2025)
par: Yuan, Jiahao, et autres
Publié: (2025)
Tailored Teaching with Balanced Difficulty: Elevating Reasoning in Multimodal Chain-of-Thought via Prompt Curriculum
par: Yang, Xinglong, et autres
Publié: (2025)
par: Yang, Xinglong, et autres
Publié: (2025)
CoT-Evo: Evolutionary Distillation of Chain-of-Thought for Scientific Reasoning
par: Feng, Kehua, et autres
Publié: (2025)
par: Feng, Kehua, et autres
Publié: (2025)
DiffAdapt: Difficulty-Adaptive Reasoning for Token-Efficient LLM Inference
par: Liu, Xiang, et autres
Publié: (2025)
par: Liu, Xiang, et autres
Publié: (2025)
Acting Less is Reasoning More! Teaching Model to Act Efficiently
par: Wang, Hongru, et autres
Publié: (2025)
par: Wang, Hongru, et autres
Publié: (2025)
PACE: Prefix-Protected and Difficulty-Aware Compression for Efficient Reasoning
par: Feng, Ruixiang, et autres
Publié: (2026)
par: Feng, Ruixiang, et autres
Publié: (2026)
Efficient Reasoning for LLMs through Speculative Chain-of-Thought
par: Wang, Jikai, et autres
Publié: (2025)
par: Wang, Jikai, et autres
Publié: (2025)
CIRF: Tokenizing Chain-of-Thoughts into Reusable Functional Units for Efficient Latent Reasoning in Large Language Models
par: Lee, Yukyung, et autres
Publié: (2026)
par: Lee, Yukyung, et autres
Publié: (2026)
DELULU: Discriminative Embedding Learning Using Latent Units for Speaker-Aware Self-Trained Speech Foundational Model
par: Baali, Massa, et autres
Publié: (2025)
par: Baali, Massa, et autres
Publié: (2025)
DART-Math: Difficulty-Aware Rejection Tuning for Mathematical Problem-Solving
par: Tong, Yuxuan, et autres
Publié: (2024)
par: Tong, Yuxuan, et autres
Publié: (2024)
Diagnosing Memorization in Chain-of-Thought Reasoning, One Token at a Time
par: Li, Huihan, et autres
Publié: (2025)
par: Li, Huihan, et autres
Publié: (2025)
Less Data Less Tokens: Multilingual Unification Learning for Efficient Test-Time Reasoning in LLMs
par: Chen, Kang, et autres
Publié: (2025)
par: Chen, Kang, et autres
Publié: (2025)
RefAV: Towards Planning-Centric Scenario Mining
par: Davidson, Cainan, et autres
Publié: (2025)
par: Davidson, Cainan, et autres
Publié: (2025)
Resource-Limited Joint Multimodal Sentiment Reasoning and Classification via Chain-of-Thought Enhancement and Distillation
par: Shangguan, Haonan, et autres
Publié: (2025)
par: Shangguan, Haonan, et autres
Publié: (2025)
LIMO: Less is More for Reasoning
par: Ye, Yixin, et autres
Publié: (2025)
par: Ye, Yixin, et autres
Publié: (2025)
Leveraging Large Language Models for Bengali Math Word Problem Solving with Chain of Thought Reasoning
par: Paul, Bidyarthi, et autres
Publié: (2025)
par: Paul, Bidyarthi, et autres
Publié: (2025)
CoT2Align: Cross-Chain of Thought Distillation via Optimal Transport Alignment for Language Models with Different Tokenizers
par: Le, Anh Duc, et autres
Publié: (2025)
par: Le, Anh Duc, et autres
Publié: (2025)
Effectiveness of Chain-of-Thought in Distilling Reasoning Capability from Large Language Models
par: Do, Cong-Thanh, et autres
Publié: (2025)
par: Do, Cong-Thanh, et autres
Publié: (2025)
Recall with Reasoning: Chain-of-Thought Distillation for Mamba's Long-Context Memory and Extrapolation
par: Ma, Junyu, et autres
Publié: (2025)
par: Ma, Junyu, et autres
Publié: (2025)
ReasonFlux-PRM: Trajectory-Aware PRMs for Long Chain-of-Thought Reasoning in LLMs
par: Zou, Jiaru, et autres
Publié: (2025)
par: Zou, Jiaru, et autres
Publié: (2025)
Learning When to Sample: Confidence-Aware Self-Consistency for Efficient LLM Chain-of-Thought Reasoning
par: Xiong, Juming, et autres
Publié: (2026)
par: Xiong, Juming, et autres
Publié: (2026)
Documents similaires
-
uDistil-Whisper: Label-Free Data Filtering for Knowledge Distillation in Low-Data Regimes
par: Waheed, Abdul, et autres
Publié: (2024) -
Compositional Chain-of-Thought Prompting for Large Multimodal Models
par: Mitra, Chancharik, et autres
Publié: (2023) -
On the Robust Approximation of ASR Metrics
par: Waheed, Abdul, et autres
Publié: (2025) -
Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework
par: Zhang, Chenyuan, et autres
Publié: (2026) -
Mechanistic Finetuning of Vision-Language-Action Models via Few-Shot Demonstrations
par: Mitra, Chancharik, et autres
Publié: (2025)