Why Can Large Language Models Generate Correct Chain-of-Thoughts?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tutunov, Rasul, Grosnit, Antoine, Ziomek, Juliusz, Wang, Jun, Bou-Ammar, Haitham |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Many of Your DPOs are Secretly One: Attempting Unification Through Mutual Information
par: Tutnov, Rasul, et autres
Publié: (2025)
par: Tutnov, Rasul, et autres
Publié: (2025)
Risk-Controlled Lean-as-Judge for Natural-Language Mathematical Reasoning
par: Bourigault, Pauline, et autres
Publié: (2026)
par: Bourigault, Pauline, et autres
Publié: (2026)
Model-Based and Sample-Efficient AI-Assisted Math Discovery in Sphere Packing
par: Tutunov, Rasul, et autres
Publié: (2025)
par: Tutunov, Rasul, et autres
Publié: (2025)
Decoding as Optimisation on the Probability Simplex: From Top-K to Top-P (Nucleus) to Best-of-K Samplers
par: Ji, Xiaotong, et autres
Publié: (2026)
par: Ji, Xiaotong, et autres
Publié: (2026)
Scalable Power Sampling: Unlocking Efficient, Training-Free Reasoning for LLMs via Distribution Sharpening
par: Ji, Xiaotong, et autres
Publié: (2026)
par: Ji, Xiaotong, et autres
Publié: (2026)
Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving
par: Zimmer, Matthieu, et autres
Publié: (2025)
par: Zimmer, Matthieu, et autres
Publié: (2025)
The Model Knows, the Decoder Finds: Future Value Guided Particle Power Sampling
par: Nguyen, Tu, et autres
Publié: (2026)
par: Nguyen, Tu, et autres
Publié: (2026)
On Almost Surely Safe Alignment of Large Language Models at Inference-Time
par: Ji, Xiaotong, et autres
Publié: (2025)
par: Ji, Xiaotong, et autres
Publié: (2025)
Contextual Causal Bayesian Optimisation
par: Arsenyan, Vahan, et autres
Publié: (2023)
par: Arsenyan, Vahan, et autres
Publié: (2023)
The $\mathbf{Y}$-Combinator for LLMs: Solving Long-Context Rot with $λ$-Calculus
par: Roy, Amartya, et autres
Publié: (2026)
par: Roy, Amartya, et autres
Publié: (2026)
Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?
par: He, Yancheng, et autres
Publié: (2025)
par: He, Yancheng, et autres
Publié: (2025)
SparsePO: Controlling Preference Alignment of LLMs via Sparse Token Masks
par: Christopoulou, Fenia, et autres
Publié: (2024)
par: Christopoulou, Fenia, et autres
Publié: (2024)
Mixture of Attentions For Speculative Decoding
par: Zimmer, Matthieu, et autres
Publié: (2024)
par: Zimmer, Matthieu, et autres
Publié: (2024)
Subjective Depth and Timescale Transformers: Learning Where and When to Compute
par: Wieser, Frederico, et autres
Publié: (2025)
par: Wieser, Frederico, et autres
Publié: (2025)
Active Prompting with Chain-of-Thought for Large Language Models
par: Diao, Shizhe, et autres
Publié: (2023)
par: Diao, Shizhe, et autres
Publié: (2023)
Untangling Component Imbalance in Hybrid Linear Attention Conversion Methods
par: Benfeghoul, Martin, et autres
Publié: (2025)
par: Benfeghoul, Martin, et autres
Publié: (2025)
Chain-of-Conceptual-Thought Elicits Daily Conversation in Large Language Models
par: Gu, Qingqing, et autres
Publié: (2025)
par: Gu, Qingqing, et autres
Publié: (2025)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
par: Lee, Jooyoung, et autres
Publié: (2024)
par: Lee, Jooyoung, et autres
Publié: (2024)
Reinforcing the Diffusion Chain of Lateral Thought with Diffusion Language Models
par: Huang, Zemin, et autres
Publié: (2025)
par: Huang, Zemin, et autres
Publié: (2025)
SuRe: Surprise-Driven Prioritised Replay for Continual LLM Learning
par: Hazard, Hugo, et autres
Publié: (2025)
par: Hazard, Hugo, et autres
Publié: (2025)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
par: Cheng, Xiaoxue, et autres
Publié: (2024)
par: Cheng, Xiaoxue, et autres
Publié: (2024)
ShortCircuit: AlphaZero-Driven Circuit Design
par: Tsaras, Dimitrios, et autres
Publié: (2024)
par: Tsaras, Dimitrios, et autres
Publié: (2024)
Enhancing Chain of Thought Prompting in Large Language Models via Reasoning Patterns
par: Zhang, Yufeng, et autres
Publié: (2024)
par: Zhang, Yufeng, et autres
Publié: (2024)
On the Hardness of Faithful Chain-of-Thought Reasoning in Large Language Models
par: Tanneru, Sree Harsha, et autres
Publié: (2024)
par: Tanneru, Sree Harsha, et autres
Publié: (2024)
Retrieval-augmented Multi-modal Chain-of-Thoughts Reasoning for Large Language Models
par: Liu, Bingshuai, et autres
Publié: (2023)
par: Liu, Bingshuai, et autres
Publié: (2023)
Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering
par: Tang, Xinyu, et autres
Publié: (2025)
par: Tang, Xinyu, et autres
Publié: (2025)
Chain-of-Thought Reasoning with Large Language Models for Clinical Alzheimer's Disease Assessment and Diagnosis
par: Zhang, Tongze, et autres
Publié: (2026)
par: Zhang, Tongze, et autres
Publié: (2026)
CIRF: Tokenizing Chain-of-Thoughts into Reusable Functional Units for Efficient Latent Reasoning in Large Language Models
par: Lee, Yukyung, et autres
Publié: (2026)
par: Lee, Yukyung, et autres
Publié: (2026)
Enhancing Emotional Generation Capability of Large Language Models via Emotional Chain-of-Thought
par: Li, Zaijing, et autres
Publié: (2024)
par: Li, Zaijing, et autres
Publié: (2024)
Applying Large Language Models and Chain-of-Thought for Automatic Scoring
par: Lee, Gyeong-Geon, et autres
Publié: (2023)
par: Lee, Gyeong-Geon, et autres
Publié: (2023)
CoT-RAG: Integrating Chain of Thought and Retrieval-Augmented Generation to Enhance Reasoning in Large Language Models
par: Li, Feiyang, et autres
Publié: (2025)
par: Li, Feiyang, et autres
Publié: (2025)
Beyond Chain-of-Thought, Effective Graph-of-Thought Reasoning in Language Models
par: Yao, Yao, et autres
Publié: (2023)
par: Yao, Yao, et autres
Publié: (2023)
Chain-of-Thought Reasoning Improves Context-Aware Translation with Large Language Models
par: Ataee, Shabnam, et autres
Publié: (2025)
par: Ataee, Shabnam, et autres
Publié: (2025)
Effectiveness of Chain-of-Thought in Distilling Reasoning Capability from Large Language Models
par: Do, Cong-Thanh, et autres
Publié: (2025)
par: Do, Cong-Thanh, et autres
Publié: (2025)
Evaluating Gender Bias in Large Language Models via Chain-of-Thought Prompting
par: Kaneko, Masahiro, et autres
Publié: (2024)
par: Kaneko, Masahiro, et autres
Publié: (2024)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
par: Aravindan, Ashwath Vaithinathan, et autres
Publié: (2026)
par: Aravindan, Ashwath Vaithinathan, et autres
Publié: (2026)
Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts
par: Chen, Yi-Chang, et autres
Publié: (2026)
par: Chen, Yi-Chang, et autres
Publié: (2026)
Why Chain of Thought Fails in Clinical Text Understanding
par: Wu, Jiageng, et autres
Publié: (2025)
par: Wu, Jiageng, et autres
Publié: (2025)
Policy Frameworks for Transparent Chain-of-Thought Reasoning in Large Language Models
par: Chen, Yihang, et autres
Publié: (2025)
par: Chen, Yihang, et autres
Publié: (2025)
Thought Manipulation: External Thought Can Be Efficient for Large Reasoning Models
par: Liu, Yule, et autres
Publié: (2025)
par: Liu, Yule, et autres
Publié: (2025)
Documents similaires
-
Many of Your DPOs are Secretly One: Attempting Unification Through Mutual Information
par: Tutnov, Rasul, et autres
Publié: (2025) -
Risk-Controlled Lean-as-Judge for Natural-Language Mathematical Reasoning
par: Bourigault, Pauline, et autres
Publié: (2026) -
Model-Based and Sample-Efficient AI-Assisted Math Discovery in Sphere Packing
par: Tutunov, Rasul, et autres
Publié: (2025) -
Decoding as Optimisation on the Probability Simplex: From Top-K to Top-P (Nucleus) to Best-of-K Samplers
par: Ji, Xiaotong, et autres
Publié: (2026) -
Scalable Power Sampling: Unlocking Efficient, Training-Free Reasoning for LLMs via Distribution Sharpening
par: Ji, Xiaotong, et autres
Publié: (2026)