Span-Level Hallucination Detection for LLM-Generated Answers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Elchafei, Passant, Abu-Elkheir, Mervet |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Facet-Level Tracing of Evidence Uncertainty and Hallucination in RAG
par: Elchafei, Passant, et autres
Publié: (2026)
par: Elchafei, Passant, et autres
Publié: (2026)
Multimodal Arabic Captioning with Interpretable Visual Concept Integration
par: Elchafei, Passant, et autres
Publié: (2025)
par: Elchafei, Passant, et autres
Publié: (2025)
Lexicon-Enriched Graph Modeling for Arabic Document Readability Prediction
par: Elchafei, Passant, et autres
Publié: (2025)
par: Elchafei, Passant, et autres
Publié: (2025)
H-RAG at SemEval-2026 Task 8: Hierarchical Parent-Child Retrieval for Multi-Turn RAG Conversations
par: Elchafei, Passant, et autres
Publié: (2026)
par: Elchafei, Passant, et autres
Publié: (2026)
InterrogateLLM: Zero-Resource Hallucination Detection in LLM-Generated Answers
par: Yehuda, Yakir, et autres
Publié: (2024)
par: Yehuda, Yakir, et autres
Publié: (2024)
When Models Lie, We Learn: Multilingual Span-Level Hallucination Detection with PsiloQA
par: Rykov, Elisei, et autres
Publié: (2025)
par: Rykov, Elisei, et autres
Publié: (2025)
Learning to Reason for Hallucination Span Detection
par: Su, Hsuan, et autres
Publié: (2025)
par: Su, Hsuan, et autres
Publié: (2025)
Hallucinated Span Detection with Multi-View Attention Features
par: Ogasa, Yuya, et autres
Publié: (2025)
par: Ogasa, Yuya, et autres
Publié: (2025)
keepitsimple at SemEval-2025 Task 3: LLM-Uncertainty based Approach for Multilingual Hallucination Span Detection
par: Vemula, Saketh Reddy, et autres
Publié: (2025)
par: Vemula, Saketh Reddy, et autres
Publié: (2025)
Joint Evaluation of Answer and Reasoning Consistency for Hallucination Detection in Large Reasoning Models
par: Wang, Changyue, et autres
Publié: (2025)
par: Wang, Changyue, et autres
Publié: (2025)
Measuring and Reducing LLM Hallucination without Gold-Standard Answers
par: Wei, Jiaheng, et autres
Publié: (2024)
par: Wei, Jiaheng, et autres
Publié: (2024)
LLM Hallucination Detection: HSAD
par: Li, JinXin, et autres
Publié: (2025)
par: Li, JinXin, et autres
Publié: (2025)
ATLANTIS at SemEval-2025 Task 3: Detecting Hallucinated Text Spans in Question Answering
par: Kobus, Catherine, et autres
Publié: (2025)
par: Kobus, Catherine, et autres
Publié: (2025)
Hallucination-Free Automatic Question & Answer Generation for Intuitive Learning
par: Wang, Nicholas X., et autres
Publié: (2026)
par: Wang, Nicholas X., et autres
Publié: (2026)
Hallucination Detection: Robustly Discerning Reliable Answers in Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
When Answers Stray from Questions: Hallucination Detection via Question-Answer Orthogonal Decomposition
par: Yao, Siyang, et autres
Publié: (2026)
par: Yao, Siyang, et autres
Publié: (2026)
Lowest Span Confidence: A Zero-Shot Metric for Efficient and Black-Box Hallucination Detection in LLMs
par: Qiao, Yitong, et autres
Publié: (2026)
par: Qiao, Yitong, et autres
Publié: (2026)
A Dataset of Open-Domain Question Answering with Multiple-Span Answers
par: Luo, Zhiyi, et autres
Publié: (2024)
par: Luo, Zhiyi, et autres
Publié: (2024)
Detecting Hallucinations in Authentic LLM-Human Interactions
par: Ren, Yujie, et autres
Publié: (2025)
par: Ren, Yujie, et autres
Publié: (2025)
HaloScope: Harnessing Unlabeled LLM Generations for Hallucination Detection
par: Du, Xuefeng, et autres
Publié: (2024)
par: Du, Xuefeng, et autres
Publié: (2024)
Hallucination as Commitment Failure: Larger LLMs Misfire Despite Knowing the Answer
par: Yeom, Jewon, et autres
Publié: (2026)
par: Yeom, Jewon, et autres
Publié: (2026)
HalluEntity: Benchmarking and Understanding Entity-Level Hallucination Detection
par: Yeh, Min-Hsuan, et autres
Publié: (2025)
par: Yeh, Min-Hsuan, et autres
Publié: (2025)
Span Modeling for Idiomaticity and Figurative Language Detection with Span Contrastive Loss
par: Matheny, Blake, et autres
Publié: (2026)
par: Matheny, Blake, et autres
Publié: (2026)
Integrated Framework for LLM Evaluation with Answer Generation
par: Lee, Sujeong, et autres
Publié: (2025)
par: Lee, Sujeong, et autres
Publié: (2025)
Correct after Answer: Enhancing Multi-Span Question Answering with Post-Processing Method
par: Lin, Jiayi, et autres
Publié: (2024)
par: Lin, Jiayi, et autres
Publié: (2024)
GigaCheck: Detecting LLM-generated Content via Object-Centric Span Localization
par: Tolstykh, Irina, et autres
Publié: (2024)
par: Tolstykh, Irina, et autres
Publié: (2024)
Responsible AI in NLP: GUS-Net Span-Level Bias Detection Dataset and Benchmark for Generalizations, Unfairness, and Stereotypes
par: Powers, Maximus, et autres
Publié: (2024)
par: Powers, Maximus, et autres
Publié: (2024)
HalluCounter: Reference-free LLM Hallucination Detection in the Wild!
par: Urlana, Ashok, et autres
Publié: (2025)
par: Urlana, Ashok, et autres
Publié: (2025)
Enhancing LLM-Based Short Answer Grading with Retrieval-Augmented Generation
par: Chu, Yucheng, et autres
Publié: (2025)
par: Chu, Yucheng, et autres
Publié: (2025)
How Does Beam Search improve Span-Level Confidence Estimation in Generative Sequence Labeling?
par: Hashimoto, Kazuma, et autres
Publié: (2022)
par: Hashimoto, Kazuma, et autres
Publié: (2022)
UncertaintyRAG: Span-Level Uncertainty Enhanced Long-Context Modeling for Retrieval-Augmented Generation
par: Li, Zixuan, et autres
Publié: (2024)
par: Li, Zixuan, et autres
Publié: (2024)
Span-Level Machine Translation Meta-Evaluation
par: Perrella, Stefano, et autres
Publié: (2026)
par: Perrella, Stefano, et autres
Publié: (2026)
Chinese-SkillSpan: A Span-Level Dataset for ESCO-Aligned Competency Extraction from Chinese Job Ads
par: Li, Guojing, et autres
Publié: (2026)
par: Li, Guojing, et autres
Publié: (2026)
Steer LLM Latents for Hallucination Detection
par: Park, Seongheon, et autres
Publié: (2025)
par: Park, Seongheon, et autres
Publié: (2025)
DefAn: Definitive Answer Dataset for LLMs Hallucination Evaluation
par: Rahman, A B M Ashikur, et autres
Publié: (2024)
par: Rahman, A B M Ashikur, et autres
Publié: (2024)
Target Span Detection for Implicit Harmful Content
par: Jafari, Nazanin, et autres
Publié: (2024)
par: Jafari, Nazanin, et autres
Publié: (2024)
Semantic Search as Extractive Paraphrase Span Detection
par: Kanerva, Jenna, et autres
Publié: (2021)
par: Kanerva, Jenna, et autres
Publié: (2021)
Banishing LLM Hallucinations Requires Rethinking Generalization
par: Li, Johnny, et autres
Publié: (2024)
par: Li, Johnny, et autres
Publié: (2024)
Enhancing Faithfulness in Abstractive Summarization via Span-Level Fine-Tuning
par: Huang, Sicong, et autres
Publié: (2025)
par: Huang, Sicong, et autres
Publié: (2025)
Hit the Sweet Spot! Span-Level Ensemble for Large Language Models
par: Xu, Yangyifan, et autres
Publié: (2024)
par: Xu, Yangyifan, et autres
Publié: (2024)
Documents similaires
-
Facet-Level Tracing of Evidence Uncertainty and Hallucination in RAG
par: Elchafei, Passant, et autres
Publié: (2026) -
Multimodal Arabic Captioning with Interpretable Visual Concept Integration
par: Elchafei, Passant, et autres
Publié: (2025) -
Lexicon-Enriched Graph Modeling for Arabic Document Readability Prediction
par: Elchafei, Passant, et autres
Publié: (2025) -
H-RAG at SemEval-2026 Task 8: Hierarchical Parent-Child Retrieval for Multi-Turn RAG Conversations
par: Elchafei, Passant, et autres
Publié: (2026) -
InterrogateLLM: Zero-Resource Hallucination Detection in LLM-Generated Answers
par: Yehuda, Yakir, et autres
Publié: (2024)