Guardado en:
| Autores principales: | Chua, James, Rees, Edward, Batra, Hunar, Bowman, Samuel R., Michael, Julian, Perez, Ethan, Turpin, Miles |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2403.05518 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning
por: Turpin, Miles, et al.
Publicado: (2025)
por: Turpin, Miles, et al.
Publicado: (2025)
Looking Inward: Language Models Can Learn About Themselves by Introspection
por: Binder, Felix J, et al.
Publicado: (2024)
por: Binder, Felix J, et al.
Publicado: (2024)
SpatialThinker: Reinforcing 3D Reasoning in Multimodal LLMs via Spatial Rewards
por: Batra, Hunar, et al.
Publicado: (2025)
por: Batra, Hunar, et al.
Publicado: (2025)
MCJudgeBench: A Benchmark for Constraint-Level Judge Evaluation in Multi-Constraint Instruction Following
por: Lee, Jaeyun, et al.
Publicado: (2026)
por: Lee, Jaeyun, et al.
Publicado: (2026)
EVCL: Elastic Variational Continual Learning with Weight Consolidation
por: Batra, Hunar, et al.
Publicado: (2024)
por: Batra, Hunar, et al.
Publicado: (2024)
Demystifying Long Chain-of-Thought Reasoning in LLMs
por: Yeo, Edward, et al.
Publicado: (2025)
por: Yeo, Edward, et al.
Publicado: (2025)
Mechanics of Bias and Reasoning: Interpreting the Impact of Chain-of-Thought Prompting on Gender Bias in LLMs
por: Pearman, Edie, et al.
Publicado: (2026)
por: Pearman, Edie, et al.
Publicado: (2026)
A Comprehensive Evaluation of Multilingual Chain-of-Thought Reasoning: Performance, Consistency, and Faithfulness Across Languages
por: Zhao, Raoyuan, et al.
Publicado: (2025)
por: Zhao, Raoyuan, et al.
Publicado: (2025)
Thought Crime: Backdoors and Emergent Misalignment in Reasoning Models
por: Chua, James, et al.
Publicado: (2025)
por: Chua, James, et al.
Publicado: (2025)
KAM-CoT: Knowledge Augmented Multimodal Chain-of-Thoughts Reasoning
por: Mondal, Debjyoti, et al.
Publicado: (2024)
por: Mondal, Debjyoti, et al.
Publicado: (2024)
Two Failures of Self-Consistency in the Multi-Step Reasoning of LLMs
por: Chen, Angelica, et al.
Publicado: (2023)
por: Chen, Angelica, et al.
Publicado: (2023)
Chain-of-Thought Augmentation with Logit Contrast for Enhanced Reasoning in Language Models
por: Shim, Jay, et al.
Publicado: (2024)
por: Shim, Jay, et al.
Publicado: (2024)
Graph-Based Chain-of-Thought Pruning for Reducing Redundant Reflections in Reasoning LLMs
por: Yuan, Hongyuan, et al.
Publicado: (2026)
por: Yuan, Hongyuan, et al.
Publicado: (2026)
Self-Training with Direct Preference Optimization Improves Chain-of-Thought Reasoning
por: Wang, Tianduo, et al.
Publicado: (2024)
por: Wang, Tianduo, et al.
Publicado: (2024)
Optimizing Chain-of-Thought Reasoning: Tackling Arranging Bottleneck via Plan Augmentation
por: Qiu, Yuli, et al.
Publicado: (2024)
por: Qiu, Yuli, et al.
Publicado: (2024)
Think Consistently, Reason Efficiently: Energy-Based Calibration for Implicit Chain-of-Thought
por: Chen, Zhikang, et al.
Publicado: (2025)
por: Chen, Zhikang, et al.
Publicado: (2025)
Graph Chain-of-Thought: Augmenting Large Language Models by Reasoning on Graphs
por: Jin, Bowen, et al.
Publicado: (2024)
por: Jin, Bowen, et al.
Publicado: (2024)
Reliable Chain-of-Thought via Prefix Consistency
por: Iwase, Naoto, et al.
Publicado: (2026)
por: Iwase, Naoto, et al.
Publicado: (2026)
Faithfulness as Information Flow: Evaluating and Training Faithful Chain-of-Thought Reasoning
por: Jia, Jinghan, et al.
Publicado: (2026)
por: Jia, Jinghan, et al.
Publicado: (2026)
Learning When to Sample: Confidence-Aware Self-Consistency for Efficient LLM Chain-of-Thought Reasoning
por: Xiong, Juming, et al.
Publicado: (2026)
por: Xiong, Juming, et al.
Publicado: (2026)
Chain-of-Thought Reasoning Without Prompting
por: Wang, Xuezhi, et al.
Publicado: (2024)
por: Wang, Xuezhi, et al.
Publicado: (2024)
Explainable Chain-of-Thought Reasoning: An Empirical Analysis on State-Aware Reasoning Dynamics
por: Yu, Sheldon, et al.
Publicado: (2025)
por: Yu, Sheldon, et al.
Publicado: (2025)
Fractured Chain-of-Thought Reasoning
por: Liao, Baohao, et al.
Publicado: (2025)
por: Liao, Baohao, et al.
Publicado: (2025)
Chained Tuning Leads to Biased Forgetting
por: Ung, Megan, et al.
Publicado: (2024)
por: Ung, Megan, et al.
Publicado: (2024)
Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal
por: Yuan, Aojie, et al.
Publicado: (2026)
por: Yuan, Aojie, et al.
Publicado: (2026)
Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models
por: Yang, Ling, et al.
Publicado: (2024)
por: Yang, Ling, et al.
Publicado: (2024)
Latent Chain-of-Thought for Visual Reasoning
por: Sun, Guohao, et al.
Publicado: (2025)
por: Sun, Guohao, et al.
Publicado: (2025)
A Logically Consistent Chain-of-Thought Approach for Stance Detection
por: Zhang, Bowen, et al.
Publicado: (2023)
por: Zhang, Bowen, et al.
Publicado: (2023)
Beyond Chain-of-Thought, Effective Graph-of-Thought Reasoning in Language Models
por: Yao, Yao, et al.
Publicado: (2023)
por: Yao, Yao, et al.
Publicado: (2023)
Efficient Reasoning via Chain of Unconscious Thought
por: Gong, Ruihan, et al.
Publicado: (2025)
por: Gong, Ruihan, et al.
Publicado: (2025)
On the Impact of Fine-Tuning on Chain-of-Thought Reasoning
por: Lobo, Elita, et al.
Publicado: (2024)
por: Lobo, Elita, et al.
Publicado: (2024)
An Empirical Study of Retrieval Augmented Generation with Chain-of-Thought
por: Zhao, Yuetong, et al.
Publicado: (2024)
por: Zhao, Yuetong, et al.
Publicado: (2024)
Improving Code Generation by Training with Natural Language Feedback
por: Chen, Angelica, et al.
Publicado: (2023)
por: Chen, Angelica, et al.
Publicado: (2023)
A Chain-of-Thought Is as Strong as Its Weakest Link: A Benchmark for Verifiers of Reasoning Chains
por: Jacovi, Alon, et al.
Publicado: (2024)
por: Jacovi, Alon, et al.
Publicado: (2024)
Scaling Code-Assisted Chain-of-Thoughts and Instructions for Model Reasoning
por: Lin, Honglin, et al.
Publicado: (2025)
por: Lin, Honglin, et al.
Publicado: (2025)
How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
por: Chen, Xi, et al.
Publicado: (2025)
por: Chen, Xi, et al.
Publicado: (2025)
MA-RAG: Multi-Agent Retrieval-Augmented Generation via Collaborative Chain-of-Thought Reasoning
por: Nguyen, Thang, et al.
Publicado: (2025)
por: Nguyen, Thang, et al.
Publicado: (2025)
Prompting Science Report 2: The Decreasing Value of Chain of Thought in Prompting
por: Meincke, Lennart, et al.
Publicado: (2025)
por: Meincke, Lennart, et al.
Publicado: (2025)
Chain of Preference Optimization: Improving Chain-of-Thought Reasoning in LLMs
por: Zhang, Xuan, et al.
Publicado: (2024)
por: Zhang, Xuan, et al.
Publicado: (2024)
Scheherazade: Evaluating Chain-of-Thought Math Reasoning in LLMs with Chain-of-Problems
por: Miner, Stephen, et al.
Publicado: (2024)
por: Miner, Stephen, et al.
Publicado: (2024)
Ejemplares similares
-
Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning
por: Turpin, Miles, et al.
Publicado: (2025) -
Looking Inward: Language Models Can Learn About Themselves by Introspection
por: Binder, Felix J, et al.
Publicado: (2024) -
SpatialThinker: Reinforcing 3D Reasoning in Multimodal LLMs via Spatial Rewards
por: Batra, Hunar, et al.
Publicado: (2025) -
MCJudgeBench: A Benchmark for Constraint-Level Judge Evaluation in Multi-Constraint Instruction Following
por: Lee, Jaeyun, et al.
Publicado: (2026) -
EVCL: Elastic Variational Continual Learning with Weight Consolidation
por: Batra, Hunar, et al.
Publicado: (2024)