Can Aha Moments Be Fake? Towards Quantifying Decorative and True Thinking in Chain-of-Thought
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Jiachen, Sun, Yiyou, Shi, Weiyan, Song, Dawn |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Divide-Fuse-Conquer: Eliciting "Aha Moments" in Multi-Scenario Games
di: Zhang, Xiaoqing, et al.
Pubblicazione: (2025)
di: Zhang, Xiaoqing, et al.
Pubblicazione: (2025)
Climbing the Ladder of Reasoning: What LLMs Can-and Still Can't-Solve after SFT?
di: Sun, Yiyou, et al.
Pubblicazione: (2025)
di: Sun, Yiyou, et al.
Pubblicazione: (2025)
Unsafer in Many Turns: Benchmarking and Defending Multi-Turn Safety Risks in Tool-Using Agents
di: Li, Xu, et al.
Pubblicazione: (2026)
di: Li, Xu, et al.
Pubblicazione: (2026)
Aha Moment Revisited: Are VLMs Truly Capable of Self Verification in Inference-time Scaling?
di: Wu, Mingyuan, et al.
Pubblicazione: (2025)
di: Wu, Mingyuan, et al.
Pubblicazione: (2025)
Deep Thinking by Markov Chain of Continuous Thoughts
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
How and Why LLMs Generalize: A Fine-Grained Analysis of LLM Reasoning from Cognitive Behaviors to Low-Level Patterns
di: Bai, Haoyue, et al.
Pubblicazione: (2025)
di: Bai, Haoyue, et al.
Pubblicazione: (2025)
Temporal Chain of Thought: Long-Video Understanding by Thinking in Frames
di: Arnab, Anurag, et al.
Pubblicazione: (2025)
di: Arnab, Anurag, et al.
Pubblicazione: (2025)
RL Grokking Recipe: How Does RL Unlock and Transfer New Algorithms in LLMs?
di: Sun, Yiyou, et al.
Pubblicazione: (2025)
di: Sun, Yiyou, et al.
Pubblicazione: (2025)
When and How Does In-Distribution Label Help Out-of-Distribution Detection?
di: Du, Xuefeng, et al.
Pubblicazione: (2024)
di: Du, Xuefeng, et al.
Pubblicazione: (2024)
R1-Zero's "Aha Moment" in Visual Reasoning on a 2B Non-SFT Model
di: Zhou, Hengguang, et al.
Pubblicazione: (2025)
di: Zhou, Hengguang, et al.
Pubblicazione: (2025)
Let Me Think! A Long Chain-of-Thought Can Be Worth Exponentially Many Short Ones
di: Mirtaheri, Parsa, et al.
Pubblicazione: (2025)
di: Mirtaheri, Parsa, et al.
Pubblicazione: (2025)
Is Chain-of-Thought Really Not Explainability? Chain-of-Thought Can Be Faithful without Hint Verbalization
di: Zaman, Kerem, et al.
Pubblicazione: (2025)
di: Zaman, Kerem, et al.
Pubblicazione: (2025)
SafeKey: Amplifying Aha-Moment Insights for Safety Reasoning
di: Zhou, Kaiwen, et al.
Pubblicazione: (2025)
di: Zhou, Kaiwen, et al.
Pubblicazione: (2025)
Output Supervision Can Obfuscate the Chain of Thought
di: Drori, Jacob, et al.
Pubblicazione: (2025)
di: Drori, Jacob, et al.
Pubblicazione: (2025)
ExpThink: Experience-Guided Reinforcement Learning for Adaptive Chain-of-Thought Compression
di: Bian, Tingcheng, et al.
Pubblicazione: (2026)
di: Bian, Tingcheng, et al.
Pubblicazione: (2026)
Where's the liability in the Generative Era? Recovery-based Black-Box Detection of AI-Generated Content
di: Bai, Haoyue, et al.
Pubblicazione: (2025)
di: Bai, Haoyue, et al.
Pubblicazione: (2025)
Can Small Training Runs Reliably Guide Data Curation? Rethinking Proxy-Model Practice
di: Wang, Jiachen T., et al.
Pubblicazione: (2025)
di: Wang, Jiachen T., et al.
Pubblicazione: (2025)
Think When You Need: Self-Adaptive Chain-of-Thought Learning
di: Yang, Junjie, et al.
Pubblicazione: (2025)
di: Yang, Junjie, et al.
Pubblicazione: (2025)
Can Machines Learn the True Probabilities?
di: Kim, Jinsook
Pubblicazione: (2024)
di: Kim, Jinsook
Pubblicazione: (2024)
Data Shapley in One Training Run
di: Wang, Jiachen T., et al.
Pubblicazione: (2024)
di: Wang, Jiachen T., et al.
Pubblicazione: (2024)
Transformers Provably Learn to Internalize Chain-of-Thought
di: Huang, Yixiao, et al.
Pubblicazione: (2026)
di: Huang, Yixiao, et al.
Pubblicazione: (2026)
Dynamic Chain-of-Thought: Towards Adaptive Deep Reasoning
di: Wang, Libo
Pubblicazione: (2025)
di: Wang, Libo
Pubblicazione: (2025)
Capturing the Temporal Dependence of Training Data Influence
di: Wang, Jiachen T., et al.
Pubblicazione: (2024)
di: Wang, Jiachen T., et al.
Pubblicazione: (2024)
Think Consistently, Reason Efficiently: Energy-Based Calibration for Implicit Chain-of-Thought
di: Chen, Zhikang, et al.
Pubblicazione: (2025)
di: Chen, Zhikang, et al.
Pubblicazione: (2025)
SALT: Steering Activations towards Leakage-free Thinking in Chain of Thought
di: Batra, Shourya, et al.
Pubblicazione: (2025)
di: Batra, Shourya, et al.
Pubblicazione: (2025)
DFA-RAG: Conversational Semantic Router for Large Language Model with Definite Finite Automaton
di: Sun, Yiyou, et al.
Pubblicazione: (2024)
di: Sun, Yiyou, et al.
Pubblicazione: (2024)
Revisiting Chain-of-Thought Prompting: Zero-shot Can Be Stronger than Few-shot
di: Cheng, Xiang, et al.
Pubblicazione: (2025)
di: Cheng, Xiang, et al.
Pubblicazione: (2025)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
di: Ye, Jiacheng, et al.
Pubblicazione: (2024)
di: Ye, Jiacheng, et al.
Pubblicazione: (2024)
Thought Cloning: Learning to Think while Acting by Imitating Human Thinking
di: Hu, Shengran, et al.
Pubblicazione: (2023)
di: Hu, Shengran, et al.
Pubblicazione: (2023)
Bridging Formal Language with Chain-of-Thought Reasoning to Geometry Problem Solving
di: Yang, Tianyun, et al.
Pubblicazione: (2025)
di: Yang, Tianyun, et al.
Pubblicazione: (2025)
Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression
di: Tang, Yuntian, et al.
Pubblicazione: (2026)
di: Tang, Yuntian, et al.
Pubblicazione: (2026)
Quantifying True Robustness: Synonymity-Weighted Similarity for Trustworthy XAI Evaluation
di: Burger, Christopher
Pubblicazione: (2025)
di: Burger, Christopher
Pubblicazione: (2025)
Modern Hopfield Networks Require Chain-of-Thought to Solve $\mathsf{NC}^1$-Hard Problems
di: Cao, Yang, et al.
Pubblicazione: (2024)
di: Cao, Yang, et al.
Pubblicazione: (2024)
DarkMind: Latent Chain-of-Thought Backdoor in Customized LLMs
di: Guo, Zhen, et al.
Pubblicazione: (2025)
di: Guo, Zhen, et al.
Pubblicazione: (2025)
Chain-of-Visual-Thought: Teaching VLMs to See and Think Better with Continuous Visual Tokens
di: Qin, Yiming, et al.
Pubblicazione: (2025)
di: Qin, Yiming, et al.
Pubblicazione: (2025)
On Learning Verifiers and Implications to Chain-of-Thought Reasoning
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
True Self-Avoiding Walk for Accelerating Markov-Chain Monte Carlo Integration
di: Qinghua, et al.
Pubblicazione: (2026)
di: Qinghua, et al.
Pubblicazione: (2026)
Can DeepFake Speech be Reliably Detected?
di: Liu, Hongbin, et al.
Pubblicazione: (2024)
di: Liu, Hongbin, et al.
Pubblicazione: (2024)
AhaRobot: A Low-Cost Open-Source Bimanual Mobile Manipulator for Embodied AI
di: Cui, Haiqin, et al.
Pubblicazione: (2025)
di: Cui, Haiqin, et al.
Pubblicazione: (2025)
Are You Getting What You Pay For? Auditing Model Substitution in LLM APIs
di: Cai, Will, et al.
Pubblicazione: (2025)
di: Cai, Will, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Divide-Fuse-Conquer: Eliciting "Aha Moments" in Multi-Scenario Games
di: Zhang, Xiaoqing, et al.
Pubblicazione: (2025) -
Climbing the Ladder of Reasoning: What LLMs Can-and Still Can't-Solve after SFT?
di: Sun, Yiyou, et al.
Pubblicazione: (2025) -
Unsafer in Many Turns: Benchmarking and Defending Multi-Turn Safety Risks in Tool-Using Agents
di: Li, Xu, et al.
Pubblicazione: (2026) -
Aha Moment Revisited: Are VLMs Truly Capable of Self Verification in Inference-time Scaling?
di: Wu, Mingyuan, et al.
Pubblicazione: (2025) -
Deep Thinking by Markov Chain of Continuous Thoughts
di: Liu, Jiayu, et al.
Pubblicazione: (2025)