Beyond ROUGE: N-Gram Subspace Features for LLM Hallucination Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Jerry, Papalexakis, Evangelos |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Are LLM Uncertainty and Correctness Encoded by the Same Features? A Functional Dissociation via Sparse Autoencoders
par: Patel, Het, et autres
Publié: (2026)
par: Patel, Het, et autres
Publié: (2026)
Leveraging Graph Structures to Detect Hallucinations in Large Language Models
par: Nonkes, Noa, et autres
Publié: (2024)
par: Nonkes, Noa, et autres
Publié: (2024)
Every Response Counts: Quantifying Uncertainty of LLM-based Multi-Agent Systems through Tensor Decomposition
par: Chen, Tiejin, et autres
Publié: (2026)
par: Chen, Tiejin, et autres
Publié: (2026)
HaloScope: Harnessing Unlabeled LLM Generations for Hallucination Detection
par: Du, Xuefeng, et autres
Publié: (2024)
par: Du, Xuefeng, et autres
Publié: (2024)
Steer LLM Latents for Hallucination Detection
par: Park, Seongheon, et autres
Publié: (2025)
par: Park, Seongheon, et autres
Publié: (2025)
InterrogateLLM: Zero-Resource Hallucination Detection in LLM-Generated Answers
par: Yehuda, Yakir, et autres
Publié: (2024)
par: Yehuda, Yakir, et autres
Publié: (2024)
Hallucinated Span Detection with Multi-View Attention Features
par: Ogasa, Yuya, et autres
Publié: (2025)
par: Ogasa, Yuya, et autres
Publié: (2025)
Discrete Stochastic Localization for Non-autoregressive Generation
par: Wu, Yunshu, et autres
Publié: (2026)
par: Wu, Yunshu, et autres
Publié: (2026)
Smoothing Out Hallucinations: Mitigating LLM Hallucination with Smoothed Knowledge Distillation
par: Nguyen, Hieu, et autres
Publié: (2025)
par: Nguyen, Hieu, et autres
Publié: (2025)
Hallucination Detection in LLMs Using Spectral Features of Attention Maps
par: Binkowski, Jakub, et autres
Publié: (2025)
par: Binkowski, Jakub, et autres
Publié: (2025)
Beyond Language: Format-Agnostic Reasoning Subspaces in Large Language Models
par: Yuan, Aojie, et autres
Publié: (2026)
par: Yuan, Aojie, et autres
Publié: (2026)
SLM Meets LLM: Balancing Latency, Interpretability and Consistency in Hallucination Detection
par: Hu, Mengya, et autres
Publié: (2024)
par: Hu, Mengya, et autres
Publié: (2024)
MALTO at SemEval-2024 Task 6: Leveraging Synthetic Data for LLM Hallucination Detection
par: Borra, Federico, et autres
Publié: (2024)
par: Borra, Federico, et autres
Publié: (2024)
The HalluRAG Dataset: Detecting Closed-Domain Hallucinations in RAG Applications Using an LLM's Internal States
par: Ridder, Fabian, et autres
Publié: (2024)
par: Ridder, Fabian, et autres
Publié: (2024)
FRAPPE: $\underline{\text{F}}$ast $\underline{\text{Ra}}$nk $\underline{\text{App}}$roximation with $\underline{\text{E}}$xplainable Features for Tensors
par: Shiao, William, et autres
Publié: (2022)
par: Shiao, William, et autres
Publié: (2022)
Detecting AI Hallucinations in Finance: An Information-Theoretic Method Cuts Hallucination Rate by 92%
par: Singha, Mainak
Publié: (2025)
par: Singha, Mainak
Publié: (2025)
Memory-Efficient LLM Training with Online Subspace Descent
par: Liang, Kaizhao, et autres
Publié: (2024)
par: Liang, Kaizhao, et autres
Publié: (2024)
MMD-Flagger: Leveraging Maximum Mean Discrepancy to Detect Hallucinations
par: Mitsuzawa, Kensuke, et autres
Publié: (2025)
par: Mitsuzawa, Kensuke, et autres
Publié: (2025)
Temporal Graph Network: Hallucination Detection in Multi-Turn Conversation
par: Rathore, Vidhi, et autres
Publié: (2026)
par: Rathore, Vidhi, et autres
Publié: (2026)
CoCoTen: Detecting Adversarial Inputs to Large Language Models through Latent Space Features of Contextual Co-occurrence Tensors
par: Kadali, Sri Durga Sai Sowmya, et autres
Publié: (2025)
par: Kadali, Sri Durga Sai Sowmya, et autres
Publié: (2025)
Consistency Is the Key: Detecting Hallucinations in LLM Generated Text By Checking Inconsistencies About Key Facts
par: Gupta, Raavi, et autres
Publié: (2025)
par: Gupta, Raavi, et autres
Publié: (2025)
TextGram: Towards a better domain-adaptive pretraining
par: Hiwarkhedkar, Sharayu, et autres
Publié: (2024)
par: Hiwarkhedkar, Sharayu, et autres
Publié: (2024)
Are Hallucinations Bad Estimations?
par: Liu, Hude, et autres
Publié: (2025)
par: Liu, Hude, et autres
Publié: (2025)
Mitigating LLM Hallucinations via Conformal Abstention
par: Yadkori, Yasin Abbasi, et autres
Publié: (2024)
par: Yadkori, Yasin Abbasi, et autres
Publié: (2024)
Evaluating the Relevance of Uncertainty Estimators for LLM Hallucination
par: Agnimo, Yedidia, et autres
Publié: (2026)
par: Agnimo, Yedidia, et autres
Publié: (2026)
On Mitigating Code LLM Hallucinations with API Documentation
par: Jain, Nihal, et autres
Publié: (2024)
par: Jain, Nihal, et autres
Publié: (2024)
RAGognizer: Hallucination-Aware Fine-Tuning via Detection Head Integration
par: Ridder, Fabian, et autres
Publié: (2026)
par: Ridder, Fabian, et autres
Publié: (2026)
Attention Sinks as Internal Signals for Hallucination Detection in Large Language Models
par: Binkowski, Jakub, et autres
Publié: (2026)
par: Binkowski, Jakub, et autres
Publié: (2026)
Beyond Single Concept Vector: Modeling Concept Subspace in LLMs with Gaussian Distribution
par: Zhao, Haiyan, et autres
Publié: (2024)
par: Zhao, Haiyan, et autres
Publié: (2024)
Enhancing LLM Factual Accuracy with RAG to Counter Hallucinations: A Case Study on Domain-Specific Queries in Private Knowledge-Bases
par: Li, Jiarui, et autres
Publié: (2024)
par: Li, Jiarui, et autres
Publié: (2024)
Do Robot Snakes Dream like Electric Sheep? Investigating the Effects of Architectural Inductive Biases on Hallucination
par: Huang, Jerry, et autres
Publié: (2024)
par: Huang, Jerry, et autres
Publié: (2024)
Learning to Reason for Hallucination Span Detection
par: Su, Hsuan, et autres
Publié: (2025)
par: Su, Hsuan, et autres
Publié: (2025)
Cost-Effective Hallucination Detection for LLMs
par: Valentin, Simon, et autres
Publié: (2024)
par: Valentin, Simon, et autres
Publié: (2024)
GPT-generated Text Detection: Benchmark Dataset and Tensor-based Detection Method
par: Qazi, Zubair, et autres
Publié: (2024)
par: Qazi, Zubair, et autres
Publié: (2024)
Discovering Low-rank Subspaces for Language-agnostic Multilingual Representations
par: Xie, Zhihui, et autres
Publié: (2024)
par: Xie, Zhihui, et autres
Publié: (2024)
Hallucination Detection and Mitigation with Diffusion in Multi-Variate Time-Series Foundation Models
par: Wichitwechkarn, Vijja, et autres
Publié: (2025)
par: Wichitwechkarn, Vijja, et autres
Publié: (2025)
Detection Without Correction: A Robust Asymmetry in Activation-Based Hallucination Probing
par: Roy, Dip, et autres
Publié: (2026)
par: Roy, Dip, et autres
Publié: (2026)
Bolster Hallucination Detection via Prompt-Guided Data Augmentation
par: Li, Wenyun, et autres
Publié: (2025)
par: Li, Wenyun, et autres
Publié: (2025)
Model Unlearning via Sparse Autoencoder Subspace Guided Projections
par: Wang, Xu, et autres
Publié: (2025)
par: Wang, Xu, et autres
Publié: (2025)
Importing Phantoms: Measuring LLM Package Hallucination Vulnerabilities
par: Krishna, Arjun, et autres
Publié: (2025)
par: Krishna, Arjun, et autres
Publié: (2025)
Documents similaires
-
Are LLM Uncertainty and Correctness Encoded by the Same Features? A Functional Dissociation via Sparse Autoencoders
par: Patel, Het, et autres
Publié: (2026) -
Leveraging Graph Structures to Detect Hallucinations in Large Language Models
par: Nonkes, Noa, et autres
Publié: (2024) -
Every Response Counts: Quantifying Uncertainty of LLM-based Multi-Agent Systems through Tensor Decomposition
par: Chen, Tiejin, et autres
Publié: (2026) -
HaloScope: Harnessing Unlabeled LLM Generations for Hallucination Detection
par: Du, Xuefeng, et autres
Publié: (2024) -
Steer LLM Latents for Hallucination Detection
par: Park, Seongheon, et autres
Publié: (2025)