Order Matters in Hallucination: Reasoning Order as Benchmark and Reflexive Prompting for Large-Language-Models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Xie, Zikai |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Premise Order Matters in Reasoning with Large Language Models
par: Chen, Xinyun, et autres
Publié: (2024)
par: Chen, Xinyun, et autres
Publié: (2024)
Order Doesn't Matter, But Reasoning Does: Training LLMs with Order-Centric Augmentation
par: He, Qianxi, et autres
Publié: (2025)
par: He, Qianxi, et autres
Publié: (2025)
Thinking Out of Order: When Output Order Stops Reflecting Reasoning Order in Diffusion Language Models
par: Yu, Longxuan, et autres
Publié: (2026)
par: Yu, Longxuan, et autres
Publié: (2026)
DETAIL Matters: Measuring the Impact of Prompt Specificity on Reasoning in Large Language Models
par: Kim, Olivia
Publié: (2025)
par: Kim, Olivia
Publié: (2025)
K-Level Reasoning: Establishing Higher Order Beliefs in Large Language Models for Strategic Reasoning
par: Zhang, Yadong, et autres
Publié: (2024)
par: Zhang, Yadong, et autres
Publié: (2024)
Layer-Order Inversion: Rethinking Latent Multi-Hop Reasoning in Large Language Models
par: Liu, Xukai, et autres
Publié: (2026)
par: Liu, Xukai, et autres
Publié: (2026)
Triggering Hallucinations in LLMs: A Quantitative Study of Prompt-Induced Hallucination in Large Language Models
par: Sato, Makoto
Publié: (2025)
par: Sato, Makoto
Publié: (2025)
Benchmarking and Defending Against Indirect Prompt Injection Attacks on Large Language Models
par: Yi, Jingwei, et autres
Publié: (2023)
par: Yi, Jingwei, et autres
Publié: (2023)
Second-Order Information Matters: Revisiting Machine Unlearning for Large Language Models
par: Gu, Kang, et autres
Publié: (2024)
par: Gu, Kang, et autres
Publié: (2024)
Investigating the Role of Prompting and External Tools in Hallucination Rates of Large Language Models
par: Barkley, Liam, et autres
Publié: (2024)
par: Barkley, Liam, et autres
Publié: (2024)
Assessing Large Language Models for Structured Medical Order Extraction
par: Karim, A H M Rezaul, et autres
Publié: (2025)
par: Karim, A H M Rezaul, et autres
Publié: (2025)
Lost in the Prompt Order: Revealing the Limitations of Causal Attention in Language Models
par: Ok, Hyunjong, et autres
Publié: (2026)
par: Ok, Hyunjong, et autres
Publié: (2026)
Benchmarking Deflection and Hallucination in Large Vision-Language Models
par: Moratelli, Nicholas, et autres
Publié: (2026)
par: Moratelli, Nicholas, et autres
Publié: (2026)
Beyond Prompts: Dynamic Conversational Benchmarking of Large Language Models
par: Castillo-Bolado, David, et autres
Publié: (2024)
par: Castillo-Bolado, David, et autres
Publié: (2024)
Alleviating Hallucinations of Large Language Models through Induced Hallucinations
par: Zhang, Yue, et autres
Publié: (2023)
par: Zhang, Yue, et autres
Publié: (2023)
CPR: Mitigating Large Language Model Hallucinations with Curative Prompt Refinement
par: Shim, Jung-Woo, et autres
Publié: (2025)
par: Shim, Jung-Woo, et autres
Publié: (2025)
Multi-stage Prompt Refinement for Mitigating Hallucinations in Large Language Models
par: Shim, Jung-Woo, et autres
Publié: (2025)
par: Shim, Jung-Woo, et autres
Publié: (2025)
DiaHalu: A Dialogue-level Hallucination Evaluation Benchmark for Large Language Models
par: Chen, Kedi, et autres
Publié: (2024)
par: Chen, Kedi, et autres
Publié: (2024)
ERBench: An Entity-Relationship based Automatically Verifiable Hallucination Benchmark for Large Language Models
par: Oh, Jio, et autres
Publié: (2024)
par: Oh, Jio, et autres
Publié: (2024)
First-Order Error Matters: Accurate Compensation for Quantized Large Language Models
par: Zheng, Xingyu, et autres
Publié: (2025)
par: Zheng, Xingyu, et autres
Publié: (2025)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
par: Li, Yuangang, et autres
Publié: (2025)
par: Li, Yuangang, et autres
Publié: (2025)
Unveiling Selection Biases: Exploring Order and Token Sensitivity in Large Language Models
par: Wei, Sheng-Lun, et autres
Publié: (2024)
par: Wei, Sheng-Lun, et autres
Publié: (2024)
EpiQAL: Benchmarking Large Language Models in Epidemiological Question Answering and Reasoning
par: Wei, Mingyang, et autres
Publié: (2026)
par: Wei, Mingyang, et autres
Publié: (2026)
Benchmarking Prompt Sensitivity in Large Language Models
par: Razavi, Amirhossein, et autres
Publié: (2025)
par: Razavi, Amirhossein, et autres
Publié: (2025)
Benchmarking Large Language Models on Multiple Tasks in Bioinformatics NLP with Prompting
par: Jiang, Jiyue, et autres
Publié: (2025)
par: Jiang, Jiyue, et autres
Publié: (2025)
MedHallBench: A New Benchmark for Assessing Hallucination in Medical Large Language Models
par: Zuo, Kaiwen, et autres
Publié: (2024)
par: Zuo, Kaiwen, et autres
Publié: (2024)
Reasoning Models Hallucinate More: Factuality-Aware Reinforcement Learning for Large Reasoning Models
par: Li, Junyi, et autres
Publié: (2025)
par: Li, Junyi, et autres
Publié: (2025)
Measuring what Matters: Construct Validity in Large Language Model Benchmarks
par: Bean, Andrew M., et autres
Publié: (2025)
par: Bean, Andrew M., et autres
Publié: (2025)
Hypothesis Testing Prompting Improves Deductive Reasoning in Large Language Models
par: Li, Yitian, et autres
Publié: (2024)
par: Li, Yitian, et autres
Publié: (2024)
Reverse That Number! Decoding Order Matters in Arithmetic Learning
par: Zhang-Li, Daniel, et autres
Publié: (2024)
par: Zhang-Li, Daniel, et autres
Publié: (2024)
LongReasonArena: A Long Reasoning Benchmark for Large Language Models
par: Ding, Jiayu, et autres
Publié: (2025)
par: Ding, Jiayu, et autres
Publié: (2025)
An Evolutionary Large Language Model for Hallucination Mitigation
par: Boulesnane, Abdennour, et autres
Publié: (2024)
par: Boulesnane, Abdennour, et autres
Publié: (2024)
DiagnosisArena: Benchmarking Diagnostic Reasoning for Large Language Models
par: Zhu, Yakun, et autres
Publié: (2025)
par: Zhu, Yakun, et autres
Publié: (2025)
Sentient Agent as a Judge: Evaluating Higher-Order Social Cognition in Large Language Models
par: Zhang, Bang, et autres
Publié: (2025)
par: Zhang, Bang, et autres
Publié: (2025)
Large Language Models are Clinical Reasoners: Reasoning-Aware Diagnosis Framework with Prompt-Generated Rationales
par: Kwon, Taeyoon, et autres
Publié: (2023)
par: Kwon, Taeyoon, et autres
Publié: (2023)
ToolBeHonest: A Multi-level Hallucination Diagnostic Benchmark for Tool-Augmented Large Language Models
par: Zhang, Yuxiang, et autres
Publié: (2024)
par: Zhang, Yuxiang, et autres
Publié: (2024)
LINC: A Neurosymbolic Approach for Logical Reasoning by Combining Language Models with First-Order Logic Provers
par: Olausson, Theo X., et autres
Publié: (2023)
par: Olausson, Theo X., et autres
Publié: (2023)
Mitigating Hallucination in Large Language Models (LLMs): An Application-Oriented Survey on RAG, Reasoning, and Agentic Systems
par: Li, Yihan, et autres
Publié: (2025)
par: Li, Yihan, et autres
Publié: (2025)
Evaluating Prompting Strategies with MedGemma for Medical Order Extraction
par: Balachandran, Abhinand, et autres
Publié: (2025)
par: Balachandran, Abhinand, et autres
Publié: (2025)
Documents similaires
-
Premise Order Matters in Reasoning with Large Language Models
par: Chen, Xinyun, et autres
Publié: (2024) -
Order Doesn't Matter, But Reasoning Does: Training LLMs with Order-Centric Augmentation
par: He, Qianxi, et autres
Publié: (2025) -
Thinking Out of Order: When Output Order Stops Reflecting Reasoning Order in Diffusion Language Models
par: Yu, Longxuan, et autres
Publié: (2026) -
DETAIL Matters: Measuring the Impact of Prompt Specificity on Reasoning in Large Language Models
par: Kim, Olivia
Publié: (2025) -
K-Level Reasoning: Establishing Higher Order Beliefs in Large Language Models for Strategic Reasoning
par: Zhang, Yadong, et autres
Publié: (2024)