Nice Fold or Hero Call: Learning Budget-Efficient Thinking for Adaptive Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhou, Zhaomeng, Zhang, Lan, Wang, Junyang, Yuan, Mu, Lin, Junda |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
IoT-Brain: Grounding LLMs for Semantic-Spatial Sensor Scheduling
di: Zhou, Zhaomeng, et al.
Pubblicazione: (2026)
di: Zhou, Zhaomeng, et al.
Pubblicazione: (2026)
Not All Turns Are Equally Hard: Adaptive Thinking Budgets For Efficient Multi-Turn Reasoning
di: Jali, Neharika, et al.
Pubblicazione: (2026)
di: Jali, Neharika, et al.
Pubblicazione: (2026)
Adaptive Dual Reasoner: Large Reasoning Models Can Think Efficiently by Hybrid Reasoning
di: Zhang, Yujian, et al.
Pubblicazione: (2025)
di: Zhang, Yujian, et al.
Pubblicazione: (2025)
SelfBudgeter: Adaptive Token Allocation for Efficient LLM Reasoning
di: Li, Zheng, et al.
Pubblicazione: (2025)
di: Li, Zheng, et al.
Pubblicazione: (2025)
When to Continue Thinking: Adaptive Thinking Mode Switching for Efficient Reasoning
di: Zhang, Xiaoyun, et al.
Pubblicazione: (2025)
di: Zhang, Xiaoyun, et al.
Pubblicazione: (2025)
Conformal Thinking: Risk Control for Reasoning on a Compute Budget
di: Wang, Xi, et al.
Pubblicazione: (2026)
di: Wang, Xi, et al.
Pubblicazione: (2026)
VIGIL: Defending LLM Agents Against Tool Stream Injection via Verify-Before-Commit
di: Lin, Junda, et al.
Pubblicazione: (2026)
di: Lin, Junda, et al.
Pubblicazione: (2026)
Draft-Thinking: Learning Efficient Reasoning in Long Chain-of-Thought LLMs
di: Cao, Jie, et al.
Pubblicazione: (2026)
di: Cao, Jie, et al.
Pubblicazione: (2026)
Just Enough Thinking: Efficient Reasoning with Adaptive Length Penalties Reinforcement Learning
di: Xiang, Violet, et al.
Pubblicazione: (2025)
di: Xiang, Violet, et al.
Pubblicazione: (2025)
Efficient Reasoning with Hidden Thinking
di: Shen, Xuan, et al.
Pubblicazione: (2025)
di: Shen, Xuan, et al.
Pubblicazione: (2025)
AdaReasoner: Adaptive Reasoning Enables More Flexible Thinking in Large Language Models
di: Wang, Xiangqi, et al.
Pubblicazione: (2025)
di: Wang, Xiangqi, et al.
Pubblicazione: (2025)
ESTAR: Early-Stopping Token-Aware Reasoning For Efficient Inference
di: Wang, Junda, et al.
Pubblicazione: (2026)
di: Wang, Junda, et al.
Pubblicazione: (2026)
Omni-AutoThink: Adaptive Multimodal Reasoning via Reinforcement Learning
di: Yang, Dongchao, et al.
Pubblicazione: (2025)
di: Yang, Dongchao, et al.
Pubblicazione: (2025)
HeroFilter: Adaptive Spectral Graph Filter for Varying Heterophilic Relations
di: Zhang, Shuaicheng, et al.
Pubblicazione: (2025)
di: Zhang, Shuaicheng, et al.
Pubblicazione: (2025)
Reasoning with Autoregressive-Diffusion Collaborative Thoughts
di: Yuan, Mu, et al.
Pubblicazione: (2026)
di: Yuan, Mu, et al.
Pubblicazione: (2026)
Think Smarter not Harder: Adaptive Reasoning with Inference Aware Optimization
di: Yu, Zishun, et al.
Pubblicazione: (2025)
di: Yu, Zishun, et al.
Pubblicazione: (2025)
Steering LLM Thinking with Budget Guidance
di: Li, Junyan, et al.
Pubblicazione: (2025)
di: Li, Junyan, et al.
Pubblicazione: (2025)
SOPRAG: Multi-view Graph Experts Retrieval for Industrial Standard Operating Procedures
di: Lin, Liangtao, et al.
Pubblicazione: (2026)
di: Lin, Liangtao, et al.
Pubblicazione: (2026)
Hierarchical Budget Policy Optimization for Adaptive Reasoning
di: Lyu, Shangke, et al.
Pubblicazione: (2025)
di: Lyu, Shangke, et al.
Pubblicazione: (2025)
Ada-KV: Optimizing KV Cache Eviction by Adaptive Budget Allocation for Efficient LLM Inference
di: Feng, Yuan, et al.
Pubblicazione: (2024)
di: Feng, Yuan, et al.
Pubblicazione: (2024)
Don't Think Longer, Think Wisely: Optimizing Thinking Dynamics for Large Reasoning Models
di: An, Sohyun, et al.
Pubblicazione: (2025)
di: An, Sohyun, et al.
Pubblicazione: (2025)
CoRT: Code-integrated Reasoning within Thinking
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
DAST: Difficulty-Adaptive Slow-Thinking for Large Reasoning Models
di: Shen, Yi, et al.
Pubblicazione: (2025)
di: Shen, Yi, et al.
Pubblicazione: (2025)
Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL
di: Tu, Songjun, et al.
Pubblicazione: (2025)
di: Tu, Songjun, et al.
Pubblicazione: (2025)
AdaptThink: Reasoning Models Can Learn When to Think
di: Zhang, Jiajie, et al.
Pubblicazione: (2025)
di: Zhang, Jiajie, et al.
Pubblicazione: (2025)
InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
di: Yan, Yuchen, et al.
Pubblicazione: (2026)
di: Yan, Yuchen, et al.
Pubblicazione: (2026)
On Generalization in Agentic Tool Calling: CoreThink Agentic Reasoner and MAVEN Dataset
di: Bhat, Vishvesh, et al.
Pubblicazione: (2025)
di: Bhat, Vishvesh, et al.
Pubblicazione: (2025)
Mid-Think: Training-Free Intermediate-Budget Reasoning via Token-Level Triggers
di: Yang, Wang, et al.
Pubblicazione: (2026)
di: Yang, Wang, et al.
Pubblicazione: (2026)
Adaptive Reasoning Executor: A Collaborative Agent System for Efficient Reasoning
di: Ling, Zehui, et al.
Pubblicazione: (2025)
di: Ling, Zehui, et al.
Pubblicazione: (2025)
DERMARK: A Dynamic, Efficient and Robust Multi-bit Watermark for Large Language Models
di: Lin, Qihao, et al.
Pubblicazione: (2025)
di: Lin, Qihao, et al.
Pubblicazione: (2025)
AdapThink: Adaptive Thinking Preferences for Reasoning Language Model
di: Wan, Xu, et al.
Pubblicazione: (2025)
di: Wan, Xu, et al.
Pubblicazione: (2025)
Certainty-Guided Reasoning in Large Language Models: A Dynamic Thinking Budget Approach
di: Nogueira, João Paulo, et al.
Pubblicazione: (2025)
di: Nogueira, João Paulo, et al.
Pubblicazione: (2025)
InfraMind: A Novel Exploration-based GUI Agentic Framework for Mission-critical Industrial Management
di: Lin, Liangtao, et al.
Pubblicazione: (2025)
di: Lin, Liangtao, et al.
Pubblicazione: (2025)
Efficient Reasoning with Balanced Thinking
di: Li, Yulin, et al.
Pubblicazione: (2026)
di: Li, Yulin, et al.
Pubblicazione: (2026)
Think-Augmented Function Calling: Improving LLM Parameter Accuracy Through Embedded Reasoning
di: Wei, Lei, et al.
Pubblicazione: (2026)
di: Wei, Lei, et al.
Pubblicazione: (2026)
Adaptive Overclocking: Dynamic Control of Thinking Path Length via Real-Time Reasoning Signals
di: Jiang, Shuhao, et al.
Pubblicazione: (2025)
di: Jiang, Shuhao, et al.
Pubblicazione: (2025)
Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs
di: Alomrani, Mohammad Ali, et al.
Pubblicazione: (2025)
di: Alomrani, Mohammad Ali, et al.
Pubblicazione: (2025)
BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens
di: Wen, Hao, et al.
Pubblicazione: (2025)
di: Wen, Hao, et al.
Pubblicazione: (2025)
MedScope: Incentivizing "Think with Videos" for Clinical Reasoning via Coarse-to-Fine Tool Calling
di: Li, Wenjie, et al.
Pubblicazione: (2026)
di: Li, Wenjie, et al.
Pubblicazione: (2026)
Human-Inspired Continuous Learning of Internal Reasoning Processes: Learning How to Think for Adaptive AI Systems
di: Su, Hong
Pubblicazione: (2026)
di: Su, Hong
Pubblicazione: (2026)
Documenti analoghi
-
IoT-Brain: Grounding LLMs for Semantic-Spatial Sensor Scheduling
di: Zhou, Zhaomeng, et al.
Pubblicazione: (2026) -
Not All Turns Are Equally Hard: Adaptive Thinking Budgets For Efficient Multi-Turn Reasoning
di: Jali, Neharika, et al.
Pubblicazione: (2026) -
Adaptive Dual Reasoner: Large Reasoning Models Can Think Efficiently by Hybrid Reasoning
di: Zhang, Yujian, et al.
Pubblicazione: (2025) -
SelfBudgeter: Adaptive Token Allocation for Efficient LLM Reasoning
di: Li, Zheng, et al.
Pubblicazione: (2025) -
When to Continue Thinking: Adaptive Thinking Mode Switching for Efficient Reasoning
di: Zhang, Xiaoyun, et al.
Pubblicazione: (2025)