From "Aha Moments" to Controllable Thinking: Toward Meta-Cognitive Reasoning in Large Reasoning Models via Decoupled Reasoning and Control
Fuente:
arXiv
Salvato in:
| Autori principali: | Ha, Rui, Li, Chaozhuo, Pu, Rui, Su, Sen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Surface-Level Detection: Towards Cognitive-Driven Defense Against Jailbreak Attacks via Meta-Operations Reasoning
di: Pu, Rui, et al.
Pubblicazione: (2025)
di: Pu, Rui, et al.
Pubblicazione: (2025)
ReasoningGuard: Safeguarding Large Reasoning Models with Inference-time Safety Aha Moments
di: Wang, Yuquan, et al.
Pubblicazione: (2025)
di: Wang, Yuquan, et al.
Pubblicazione: (2025)
SafeKey: Amplifying Aha-Moment Insights for Safety Reasoning
di: Zhou, Kaiwen, et al.
Pubblicazione: (2025)
di: Zhou, Kaiwen, et al.
Pubblicazione: (2025)
MirrorShield: Towards Universal Defense Against Jailbreaks via Entropy-Guided Mirror Crafting
di: Pu, Rui, et al.
Pubblicazione: (2025)
di: Pu, Rui, et al.
Pubblicazione: (2025)
R1-Zero's "Aha Moment" in Visual Reasoning on a 2B Non-SFT Model
di: Zhou, Hengguang, et al.
Pubblicazione: (2025)
di: Zhou, Hengguang, et al.
Pubblicazione: (2025)
Controlling Thinking Speed in Reasoning Models
di: Lin, Zhengkai, et al.
Pubblicazione: (2025)
di: Lin, Zhengkai, et al.
Pubblicazione: (2025)
Conflict-Resilient Multi-Agent Reasoning via Signed Graph Modeling
di: He, Longgang, et al.
Pubblicazione: (2026)
di: He, Longgang, et al.
Pubblicazione: (2026)
Think How to Think: Mitigating Overthinking with Autonomous Difficulty Cognition in Large Reasoning Models
di: Liu, Yongjiang, et al.
Pubblicazione: (2025)
di: Liu, Yongjiang, et al.
Pubblicazione: (2025)
Reasoning Paths as Signals: Augmenting Multi-hop Fact Verification through Structural Reasoning Progression
di: Zheng, Liwen, et al.
Pubblicazione: (2025)
di: Zheng, Liwen, et al.
Pubblicazione: (2025)
DeepThink3D: Enhancing Large Language Models with Programmatic Reasoning in Complex 3D Situated Reasoning Tasks
di: Song, Jiayi, et al.
Pubblicazione: (2025)
di: Song, Jiayi, et al.
Pubblicazione: (2025)
Towards Safe Reasoning in Large Reasoning Models via Corrective Intervention
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
PoTable: Towards Systematic Thinking via Plan-then-Execute Stage Reasoning on Tables
di: Mao, Qingyang, et al.
Pubblicazione: (2024)
di: Mao, Qingyang, et al.
Pubblicazione: (2024)
Adaptive Dual Reasoner: Large Reasoning Models Can Think Efficiently by Hybrid Reasoning
di: Zhang, Yujian, et al.
Pubblicazione: (2025)
di: Zhang, Yujian, et al.
Pubblicazione: (2025)
CoT2-Meta: Budgeted Metacognitive Control for Test-Time Reasoning
di: Ma, Siyuan, et al.
Pubblicazione: (2026)
di: Ma, Siyuan, et al.
Pubblicazione: (2026)
Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey
di: Zhu, Jason, et al.
Pubblicazione: (2025)
di: Zhu, Jason, et al.
Pubblicazione: (2025)
Effectively Controlling Reasoning Models through Thinking Intervention
di: Wu, Tong, et al.
Pubblicazione: (2025)
di: Wu, Tong, et al.
Pubblicazione: (2025)
Scaling Reasoning, Losing Control: Evaluating Instruction Following in Large Reasoning Models
di: Fu, Tingchen, et al.
Pubblicazione: (2025)
di: Fu, Tingchen, et al.
Pubblicazione: (2025)
Dual Traits in Probabilistic Reasoning of Large Language Models
di: Li, Shenxiong, et al.
Pubblicazione: (2024)
di: Li, Shenxiong, et al.
Pubblicazione: (2024)
Modeling Hierarchical Thinking in Large Reasoning Models
di: Shahariar, G M, et al.
Pubblicazione: (2025)
di: Shahariar, G M, et al.
Pubblicazione: (2025)
Efficient Reasoning via Reward Model
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
Towards Understanding the Cognitive Habits of Large Reasoning Models
di: Dong, Jianshuo, et al.
Pubblicazione: (2025)
di: Dong, Jianshuo, et al.
Pubblicazione: (2025)
Measuring the Faithfulness of Thinking Drafts in Large Reasoning Models
di: Xiong, Zidi, et al.
Pubblicazione: (2025)
di: Xiong, Zidi, et al.
Pubblicazione: (2025)
Interactive Reasoning: Visualizing and Controlling Chain-of-Thought Reasoning in Large Language Models
di: Pang, Rock Yuren, et al.
Pubblicazione: (2025)
di: Pang, Rock Yuren, et al.
Pubblicazione: (2025)
Read Quietly, Think Aloud: Decoupling Comprehension and Reasoning in LLMs
di: Wang, Yuanxin, et al.
Pubblicazione: (2025)
di: Wang, Yuanxin, et al.
Pubblicazione: (2025)
STaR: Towards Effective and Stable Table Reasoning via Slow-Thinking Large Language Models
di: Zhang, Huajian, et al.
Pubblicazione: (2025)
di: Zhang, Huajian, et al.
Pubblicazione: (2025)
To Think or Not To Think, That is The Question for Large Reasoning Models in Theory of Mind Tasks
di: Gong, Nanxu, et al.
Pubblicazione: (2026)
di: Gong, Nanxu, et al.
Pubblicazione: (2026)
Dynamic Thinking-Token Selection for Efficient Reasoning in Large Reasoning Models
di: Guo, Zhenyuan, et al.
Pubblicazione: (2026)
di: Guo, Zhenyuan, et al.
Pubblicazione: (2026)
Don't Think Longer, Think Wisely: Optimizing Thinking Dynamics for Large Reasoning Models
di: An, Sohyun, et al.
Pubblicazione: (2025)
di: An, Sohyun, et al.
Pubblicazione: (2025)
Efficient Reasoning with Hidden Thinking
di: Shen, Xuan, et al.
Pubblicazione: (2025)
di: Shen, Xuan, et al.
Pubblicazione: (2025)
Decoupling Understanding from Reasoning via Problem Space Mapping for Small-Scale Model Reasoning
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
Dualformer: Controllable Fast and Slow Thinking by Learning with Randomized Reasoning Traces
di: Su, DiJia, et al.
Pubblicazione: (2024)
di: Su, DiJia, et al.
Pubblicazione: (2024)
Think or Not? Exploring Thinking Efficiency in Large Reasoning Models via an Information-Theoretic Lens
di: Yong, Xixian, et al.
Pubblicazione: (2025)
di: Yong, Xixian, et al.
Pubblicazione: (2025)
AdaReasoner: Adaptive Reasoning Enables More Flexible Thinking in Large Language Models
di: Wang, Xiangqi, et al.
Pubblicazione: (2025)
di: Wang, Xiangqi, et al.
Pubblicazione: (2025)
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
di: Huang, Shijue, et al.
Pubblicazione: (2025)
di: Huang, Shijue, et al.
Pubblicazione: (2025)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
di: Xu, Fengli, et al.
Pubblicazione: (2025)
di: Xu, Fengli, et al.
Pubblicazione: (2025)
Conformal Thinking: Risk Control for Reasoning on a Compute Budget
di: Wang, Xi, et al.
Pubblicazione: (2026)
di: Wang, Xi, et al.
Pubblicazione: (2026)
Mitigating Safety Tax via Distribution-Grounded Refinement in Large Reasoning Models
di: Xie, Yingsha, et al.
Pubblicazione: (2026)
di: Xie, Yingsha, et al.
Pubblicazione: (2026)
The CoT Encyclopedia: Analyzing, Predicting, and Controlling how a Reasoning Model will Think
di: Lee, Seongyun, et al.
Pubblicazione: (2025)
di: Lee, Seongyun, et al.
Pubblicazione: (2025)
From <Answer> to <Think>: Multidimensional Supervision of Reasoning Process for LLM Optimization
di: Wang, Beining, et al.
Pubblicazione: (2025)
di: Wang, Beining, et al.
Pubblicazione: (2025)
Reasoning Matters: Mitigate Hallucination in Multimodal Large Reasoning Models via Reasoning-Conditioned Preference Optimization
di: Kong, Jiawei, et al.
Pubblicazione: (2026)
di: Kong, Jiawei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Beyond Surface-Level Detection: Towards Cognitive-Driven Defense Against Jailbreak Attacks via Meta-Operations Reasoning
di: Pu, Rui, et al.
Pubblicazione: (2025) -
ReasoningGuard: Safeguarding Large Reasoning Models with Inference-time Safety Aha Moments
di: Wang, Yuquan, et al.
Pubblicazione: (2025) -
SafeKey: Amplifying Aha-Moment Insights for Safety Reasoning
di: Zhou, Kaiwen, et al.
Pubblicazione: (2025) -
MirrorShield: Towards Universal Defense Against Jailbreaks via Entropy-Guided Mirror Crafting
di: Pu, Rui, et al.
Pubblicazione: (2025) -
R1-Zero's "Aha Moment" in Visual Reasoning on a 2B Non-SFT Model
di: Zhou, Hengguang, et al.
Pubblicazione: (2025)