ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Ling, Yu, Zhaochen, Cui, Bin, Wang, Mengdi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ReasonFlux-PRM: Trajectory-Aware PRMs for Long Chain-of-Thought Reasoning in LLMs
par: Zou, Jiaru, et autres
Publié: (2025)
par: Zou, Jiaru, et autres
Publié: (2025)
Temporal Consistency for LLM Reasoning Process Error Identification
par: Guo, Jiacheng, et autres
Publié: (2025)
par: Guo, Jiacheng, et autres
Publié: (2025)
Understanding Reasoning in Chain-of-Thought from the Hopfieldian View
par: Hu, Lijie, et autres
Publié: (2024)
par: Hu, Lijie, et autres
Publié: (2024)
Weight-of-Thought Reasoning: Exploring Neural Network Weights for Enhanced LLM Reasoning
par: Punjwani, Saif, et autres
Publié: (2025)
par: Punjwani, Saif, et autres
Publié: (2025)
Enhancing Generalization in Chain of Thought Reasoning for Smaller Models
par: Yin, Maxwell J., et autres
Publié: (2025)
par: Yin, Maxwell J., et autres
Publié: (2025)
Scalable Chain of Thoughts via Elastic Reasoning
par: Xu, Yuhui, et autres
Publié: (2025)
par: Xu, Yuhui, et autres
Publié: (2025)
Thought Branches: Interpreting LLM Reasoning Requires Resampling
par: Macar, Uzay, et autres
Publié: (2025)
par: Macar, Uzay, et autres
Publié: (2025)
Thought Anchors: Which LLM Reasoning Steps Matter?
par: Bogdan, Paul C., et autres
Publié: (2025)
par: Bogdan, Paul C., et autres
Publié: (2025)
SmartSwitch: Advancing LLM Reasoning by Overcoming Underthinking via Promoting Deeper Thought Exploration
par: Zhang, Xichen, et autres
Publié: (2025)
par: Zhang, Xichen, et autres
Publié: (2025)
Explainable LLM Unlearning Through Reasoning
par: Liao, Junfeng, et autres
Publié: (2026)
par: Liao, Junfeng, et autres
Publié: (2026)
A Hopfieldian View-based Interpretation for Chain-of-Thought Reasoning
par: Hu, Lijie, et autres
Publié: (2024)
par: Hu, Lijie, et autres
Publié: (2024)
Verifying Chain-of-Thought Reasoning via Its Computational Graph
par: Zhao, Zheng, et autres
Publié: (2025)
par: Zhao, Zheng, et autres
Publié: (2025)
Think Consistently, Reason Efficiently: Energy-Based Calibration for Implicit Chain-of-Thought
par: Chen, Zhikang, et autres
Publié: (2025)
par: Chen, Zhikang, et autres
Publié: (2025)
Sketch-of-Thought: Efficient LLM Reasoning with Adaptive Cognitive-Inspired Sketching
par: Aytes, Simon A., et autres
Publié: (2025)
par: Aytes, Simon A., et autres
Publié: (2025)
SHAPE: Stage-aware Hierarchical Advantage via Potential Estimation for LLM Reasoning
par: Ai, Zhengyang, et autres
Publié: (2026)
par: Ai, Zhengyang, et autres
Publié: (2026)
Fractured Chain-of-Thought Reasoning
par: Liao, Baohao, et autres
Publié: (2025)
par: Liao, Baohao, et autres
Publié: (2025)
Enhancing Zero-Shot Chain-of-Thought Reasoning in Large Language Models through Logic
par: Zhao, Xufeng, et autres
Publié: (2023)
par: Zhao, Xufeng, et autres
Publié: (2023)
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
par: Shang, Yu, et autres
Publié: (2024)
par: Shang, Yu, et autres
Publié: (2024)
NPG-Muse: Scaling Long Chain-of-Thought Reasoning with NP-Hard Graph Problems
par: Wang, Yuyao, et autres
Publié: (2025)
par: Wang, Yuyao, et autres
Publié: (2025)
Stepwise Penalization for Length-Efficient Chain-of-Thought Reasoning
par: Li, Xintong, et autres
Publié: (2026)
par: Li, Xintong, et autres
Publié: (2026)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
par: Ye, Jiacheng, et autres
Publié: (2024)
par: Ye, Jiacheng, et autres
Publié: (2024)
Reasoning to Learn from Latent Thoughts
par: Ruan, Yangjun, et autres
Publié: (2025)
par: Ruan, Yangjun, et autres
Publié: (2025)
A Theoretical Understanding of Chain-of-Thought: Coherent Reasoning and Error-Aware Demonstration
par: Cui, Yingqian, et autres
Publié: (2024)
par: Cui, Yingqian, et autres
Publié: (2024)
Value-Guided Search for Efficient Chain-of-Thought Reasoning
par: Wang, Kaiwen, et autres
Publié: (2025)
par: Wang, Kaiwen, et autres
Publié: (2025)
Incentivizing Agentic Reasoning in LLM Judges via Tool-Integrated Reinforcement Learning
par: Xu, Ran, et autres
Publié: (2025)
par: Xu, Ran, et autres
Publié: (2025)
Atom of Thoughts for Markov LLM Test-Time Scaling
par: Teng, Fengwei, et autres
Publié: (2025)
par: Teng, Fengwei, et autres
Publié: (2025)
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
par: Arcuschin, Iván, et autres
Publié: (2025)
par: Arcuschin, Iván, et autres
Publié: (2025)
Reasoning with Latent Thoughts: On the Power of Looped Transformers
par: Saunshi, Nikunj, et autres
Publié: (2025)
par: Saunshi, Nikunj, et autres
Publié: (2025)
Compositional Reasoning with Transformers, RNNs, and Chain of Thought
par: Yehudai, Gilad, et autres
Publié: (2025)
par: Yehudai, Gilad, et autres
Publié: (2025)
Long Chain-of-Thought Reasoning Across Languages
par: Barua, Josh, et autres
Publié: (2025)
par: Barua, Josh, et autres
Publié: (2025)
Is Chain-of-Thought Reasoning of LLMs a Mirage? A Data Distribution Lens
par: Zhao, Chengshuai, et autres
Publié: (2025)
par: Zhao, Chengshuai, et autres
Publié: (2025)
Enhancing Auto-regressive Chain-of-Thought through Loop-Aligned Reasoning
par: Yu, Qifan, et autres
Publié: (2025)
par: Yu, Qifan, et autres
Publié: (2025)
DRAGON: Guard LLM Unlearning in Context via Negative Detection and Reasoning
par: Wang, Yaxuan, et autres
Publié: (2025)
par: Wang, Yaxuan, et autres
Publié: (2025)
Generative Adversarial Reasoner: Enhancing LLM Reasoning with Adversarial Reinforcement Learning
par: Liu, Qihao, et autres
Publié: (2025)
par: Liu, Qihao, et autres
Publié: (2025)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
par: Cui, Yingqian, et autres
Publié: (2025)
par: Cui, Yingqian, et autres
Publié: (2025)
Thought Crime: Backdoors and Emergent Misalignment in Reasoning Models
par: Chua, James, et autres
Publié: (2025)
par: Chua, James, et autres
Publié: (2025)
Advancing LLM Reasoning Generalists with Preference Trees
par: Yuan, Lifan, et autres
Publié: (2024)
par: Yuan, Lifan, et autres
Publié: (2024)
Better LLM Reasoning via Dual-Play
par: Zhang, Zhengxin, et autres
Publié: (2025)
par: Zhang, Zhengxin, et autres
Publié: (2025)
MIR-Bench: Can Your LLM Recognize Complicated Patterns via Many-Shot In-Context Reasoning?
par: Yan, Kai, et autres
Publié: (2025)
par: Yan, Kai, et autres
Publié: (2025)
ReasonBENCH: Benchmarking the (In)Stability of LLM Reasoning
par: Potamitis, Nearchos, et autres
Publié: (2025)
par: Potamitis, Nearchos, et autres
Publié: (2025)
Documents similaires
-
ReasonFlux-PRM: Trajectory-Aware PRMs for Long Chain-of-Thought Reasoning in LLMs
par: Zou, Jiaru, et autres
Publié: (2025) -
Temporal Consistency for LLM Reasoning Process Error Identification
par: Guo, Jiacheng, et autres
Publié: (2025) -
Understanding Reasoning in Chain-of-Thought from the Hopfieldian View
par: Hu, Lijie, et autres
Publié: (2024) -
Weight-of-Thought Reasoning: Exploring Neural Network Weights for Enhanced LLM Reasoning
par: Punjwani, Saif, et autres
Publié: (2025) -
Enhancing Generalization in Chain of Thought Reasoning for Smaller Models
par: Yin, Maxwell J., et autres
Publié: (2025)