Chain-of-Thought Prompting Obscures Hallucination Cues in Large Language Models: An Empirical Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Cheng, Jiahao, Su, Tiancheng, Yuan, Jia, He, Guoxiu, Liu, Jiawei, Tao, Xinqi, Xie, Jingwen, Li, Huaxia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Entropy-Aware Speculative Decoding Toward Improved LLM Reasoning
por: Su, Tiancheng, et al.
Publicado: (2025)
por: Su, Tiancheng, et al.
Publicado: (2025)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
por: Cheng, Xiaoxue, et al.
Publicado: (2024)
por: Cheng, Xiaoxue, et al.
Publicado: (2024)
Evaluating Gender Bias in Large Language Models via Chain-of-Thought Prompting
por: Kaneko, Masahiro, et al.
Publicado: (2024)
por: Kaneko, Masahiro, et al.
Publicado: (2024)
Eliminating Agentic Workflow for Introduction Generation with Parametric Stage Tokens
por: Zhang, Meicong, et al.
Publicado: (2025)
por: Zhang, Meicong, et al.
Publicado: (2025)
Active Prompting with Chain-of-Thought for Large Language Models
por: Diao, Shizhe, et al.
Publicado: (2023)
por: Diao, Shizhe, et al.
Publicado: (2023)
MoRI: Learning Motivation-Grounded Reasoning for Scientific Ideation in Large Language Models
por: Gu, Chenyang, et al.
Publicado: (2026)
por: Gu, Chenyang, et al.
Publicado: (2026)
Interweaving Memories of a Siamese Large Language Model
por: Song, Xin, et al.
Publicado: (2024)
por: Song, Xin, et al.
Publicado: (2024)
Enhancing Uncertainty Modeling with Semantic Graph for Hallucination Detection
por: Chen, Kedi, et al.
Publicado: (2025)
por: Chen, Kedi, et al.
Publicado: (2025)
Reinforcing the Diffusion Chain of Lateral Thought with Diffusion Language Models
por: Huang, Zemin, et al.
Publicado: (2025)
por: Huang, Zemin, et al.
Publicado: (2025)
ReasonFlux-PRM: Trajectory-Aware PRMs for Long Chain-of-Thought Reasoning in LLMs
por: Zou, Jiaru, et al.
Publicado: (2025)
por: Zou, Jiaru, et al.
Publicado: (2025)
Graph Chain-of-Thought: Augmenting Large Language Models by Reasoning on Graphs
por: Jin, Bowen, et al.
Publicado: (2024)
por: Jin, Bowen, et al.
Publicado: (2024)
Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
por: Yang, Xinqi, et al.
Publicado: (2024)
por: Yang, Xinqi, et al.
Publicado: (2024)
Instance-adaptive Zero-shot Chain-of-Thought Prompting
por: Yuan, Xiaosong, et al.
Publicado: (2024)
por: Yuan, Xiaosong, et al.
Publicado: (2024)
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
por: Sun, Jiashuo, et al.
Publicado: (2023)
por: Sun, Jiashuo, et al.
Publicado: (2023)
Enhancing Chain of Thought Prompting in Large Language Models via Reasoning Patterns
por: Zhang, Yufeng, et al.
Publicado: (2024)
por: Zhang, Yufeng, et al.
Publicado: (2024)
Learning to Edit Knowledge via Instruction-based Chain-of-Thought Prompting
por: Fu, Jinhu, et al.
Publicado: (2026)
por: Fu, Jinhu, et al.
Publicado: (2026)
When Chain-of-Thought Backfires: Evaluating Prompt Sensitivity in Medical Language Models
por: Sadanandan, Binesh, et al.
Publicado: (2026)
por: Sadanandan, Binesh, et al.
Publicado: (2026)
Generalizable Chain-of-Thought Prompting in Mixed-task Scenarios with Large Language Models
por: Zou, Anni, et al.
Publicado: (2023)
por: Zou, Anni, et al.
Publicado: (2023)
Enhancing Granular Sentiment Classification with Chain-of-Thought Prompting in Large Language Models
por: Miriyala, Vihaan, et al.
Publicado: (2025)
por: Miriyala, Vihaan, et al.
Publicado: (2025)
Beyond the Prompt in Large Language Models: Comprehension, In-Context Learning, and Chain-of-Thought
por: Jiao, Yuling, et al.
Publicado: (2026)
por: Jiao, Yuling, et al.
Publicado: (2026)
GCoT: Chain-of-Thought Prompt Learning for Graphs
por: Yu, Xingtong, et al.
Publicado: (2025)
por: Yu, Xingtong, et al.
Publicado: (2025)
Understanding Before Reasoning: Enhancing Chain-of-Thought with Iterative Summarization Pre-Prompting
por: Zhu, Dong-Hai, et al.
Publicado: (2025)
por: Zhu, Dong-Hai, et al.
Publicado: (2025)
Mitigating Selection Bias in Large Language Models via Permutation-Aware GRPO
por: Zheng, Jinquan, et al.
Publicado: (2026)
por: Zheng, Jinquan, et al.
Publicado: (2026)
Dual Traits in Probabilistic Reasoning of Large Language Models
por: Li, Shenxiong, et al.
Publicado: (2024)
por: Li, Shenxiong, et al.
Publicado: (2024)
Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?
por: He, Yancheng, et al.
Publicado: (2025)
por: He, Yancheng, et al.
Publicado: (2025)
Revisiting Parameter-Based Knowledge Editing in Large Language Models: Theoretical Limits and Empirical Evidence
por: Ren, Wanying, et al.
Publicado: (2026)
por: Ren, Wanying, et al.
Publicado: (2026)
Benchmarking and Rethinking Knowledge Editing for Large Language Models
por: He, Guoxiu, et al.
Publicado: (2025)
por: He, Guoxiu, et al.
Publicado: (2025)
Chain-of-Thought Prompting for Speech Translation
por: Hu, Ke, et al.
Publicado: (2024)
por: Hu, Ke, et al.
Publicado: (2024)
Chain-of-Thought Reasoning Without Prompting
por: Wang, Xuezhi, et al.
Publicado: (2024)
por: Wang, Xuezhi, et al.
Publicado: (2024)
Order Matters in Hallucination: Reasoning Order as Benchmark and Reflexive Prompting for Large-Language-Models
por: Xie, Zikai
Publicado: (2024)
por: Xie, Zikai
Publicado: (2024)
Mitigating Prompt-Induced Hallucinations in Large Language Models via Structured Reasoning
por: Hao, Jinbo, et al.
Publicado: (2026)
por: Hao, Jinbo, et al.
Publicado: (2026)
Retrieval-augmented Multi-modal Chain-of-Thoughts Reasoning for Large Language Models
por: Liu, Bingshuai, et al.
Publicado: (2023)
por: Liu, Bingshuai, et al.
Publicado: (2023)
THINK-Bench: Evaluating Thinking Efficiency and Chain-of-Thought Quality of Large Reasoning Models
por: Li, Zhiyuan, et al.
Publicado: (2025)
por: Li, Zhiyuan, et al.
Publicado: (2025)
The Dawn After the Dark: An Empirical Study on Factuality Hallucination in Large Language Models
por: Li, Junyi, et al.
Publicado: (2024)
por: Li, Junyi, et al.
Publicado: (2024)
Concept-Guided Chain-of-Thought Prompting for Pairwise Comparison Scoring of Texts with Large Language Models
por: Wu, Patrick Y., et al.
Publicado: (2023)
por: Wu, Patrick Y., et al.
Publicado: (2023)
Dynamic Chunking and Selection for Reading Comprehension of Ultra-Long Context in Large Language Models
por: Sheng, Boheng, et al.
Publicado: (2025)
por: Sheng, Boheng, et al.
Publicado: (2025)
Enhancing Depression Diagnosis with Chain-of-Thought Prompting
por: Shi, Elysia, et al.
Publicado: (2024)
por: Shi, Elysia, et al.
Publicado: (2024)
An Empirical Study of Retrieval Augmented Generation with Chain-of-Thought
por: Zhao, Yuetong, et al.
Publicado: (2024)
por: Zhao, Yuetong, et al.
Publicado: (2024)
Compositional Chain-of-Thought Prompting for Large Multimodal Models
por: Mitra, Chancharik, et al.
Publicado: (2023)
por: Mitra, Chancharik, et al.
Publicado: (2023)
FedCoT: Federated Chain-of-Thought Distillation for Large Language Models
por: Fan, Tao, et al.
Publicado: (2024)
por: Fan, Tao, et al.
Publicado: (2024)
Ejemplares similares
-
Entropy-Aware Speculative Decoding Toward Improved LLM Reasoning
por: Su, Tiancheng, et al.
Publicado: (2025) -
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
por: Cheng, Xiaoxue, et al.
Publicado: (2024) -
Evaluating Gender Bias in Large Language Models via Chain-of-Thought Prompting
por: Kaneko, Masahiro, et al.
Publicado: (2024) -
Eliminating Agentic Workflow for Introduction Generation with Parametric Stage Tokens
por: Zhang, Meicong, et al.
Publicado: (2025) -
Active Prompting with Chain-of-Thought for Large Language Models
por: Diao, Shizhe, et al.
Publicado: (2023)