INSIDE: LLMs' Internal States Retain the Power of Hallucination Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Chao, Liu, Kai, Chen, Ze, Gu, Yi, Wu, Yue, Tao, Mingyuan, Fu, Zhihang, Ye, Jieping |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Optimal Parameter and Neuron Pruning for Out-of-Distribution Detection
par: Chen, Chao, et autres
Publié: (2024)
par: Chen, Chao, et autres
Publié: (2024)
Structure-aware Domain Knowledge Injection for Large Language Models
par: Liu, Kai, et autres
Publié: (2024)
par: Liu, Kai, et autres
Publié: (2024)
Category-Extensible Out-of-Distribution Detection via Hierarchical Context Descriptions
par: Liu, Kai, et autres
Publié: (2024)
par: Liu, Kai, et autres
Publié: (2024)
Enhancing LLM's Cognition via Structurization
par: Liu, Kai, et autres
Publié: (2024)
par: Liu, Kai, et autres
Publié: (2024)
ROUTE: Robust Multitask Tuning and Collaboration for Text-to-SQL
par: Qin, Yang, et autres
Publié: (2024)
par: Qin, Yang, et autres
Publié: (2024)
Controlling Thinking Speed in Reasoning Models
par: Lin, Zhengkai, et autres
Publié: (2025)
par: Lin, Zhengkai, et autres
Publié: (2025)
Hallucination Detection with the Internal Layers of LLMs
par: Preiß, Martin
Publié: (2025)
par: Preiß, Martin
Publié: (2025)
Prompt-Guided Internal States for Hallucination Detection of Large Language Models
par: Zhang, Fujie, et autres
Publié: (2024)
par: Zhang, Fujie, et autres
Publié: (2024)
Delving into the Reversal Curse: How Far Can Large Language Models Generalize?
par: Lin, Zhengkai, et autres
Publié: (2024)
par: Lin, Zhengkai, et autres
Publié: (2024)
ROPO: Robust Preference Optimization for Large Language Models
par: Liang, Xize, et autres
Publié: (2024)
par: Liang, Xize, et autres
Publié: (2024)
Rethinking Out-of-Distribution Detection on Imbalanced Data Distribution
par: Liu, Kai, et autres
Publié: (2024)
par: Liu, Kai, et autres
Publié: (2024)
ESOD: Efficient Small Object Detection on High-Resolution Images
par: Liu, Kai, et autres
Publié: (2024)
par: Liu, Kai, et autres
Publié: (2024)
Unsupervised Real-Time Hallucination Detection based on the Internal States of Large Language Models
par: Su, Weihang, et autres
Publié: (2024)
par: Su, Weihang, et autres
Publié: (2024)
D$^2$HScore: Reasoning-Aware Hallucination Detection via Semantic Breadth and Depth Analysis in LLMs
par: Ding, Yue, et autres
Publié: (2025)
par: Ding, Yue, et autres
Publié: (2025)
Structure-Enhanced Protein Instruction Tuning: Towards General-Purpose Protein Understanding with LLMs
par: Wu, Wei, et autres
Publié: (2024)
par: Wu, Wei, et autres
Publié: (2024)
OPDAI at SemEval-2024 Task 6: Small LLMs can Accelerate Hallucination Detection with Weakly Supervised Data
par: Wei, Chengcheng, et autres
Publié: (2024)
par: Wei, Chengcheng, et autres
Publié: (2024)
LLM Internal States Reveal Hallucination Risk Faced With a Query
par: Ji, Ziwei, et autres
Publié: (2024)
par: Ji, Ziwei, et autres
Publié: (2024)
Hallucination Detection via Internal States and Structured Reasoning Consistency in Large Language Models
par: Song, Yusheng, et autres
Publié: (2025)
par: Song, Yusheng, et autres
Publié: (2025)
Detecting Contextual Hallucinations in LLMs with Frequency-Aware Attention
par: Qi, Siya, et autres
Publié: (2026)
par: Qi, Siya, et autres
Publié: (2026)
Mitigating Hallucinations in Large Vision-Language Models with Internal Fact-based Contrastive Decoding
par: Wang, Chao, et autres
Publié: (2025)
par: Wang, Chao, et autres
Publié: (2025)
Tree-of-Table: Unleashing the Power of LLMs for Enhanced Large-Scale Table Understanding
par: Ji, Deyi, et autres
Publié: (2024)
par: Ji, Deyi, et autres
Publié: (2024)
Llama SLayer 8B: Shallow Layers Hold the Key to Knowledge Injection
par: Chen, Tianxiang, et autres
Publié: (2024)
par: Chen, Tianxiang, et autres
Publié: (2024)
Are Rationales Necessary and Sufficient? Tuning LLMs for Explainable Misinformation Detection
par: Wang, Bing, et autres
Publié: (2026)
par: Wang, Bing, et autres
Publié: (2026)
KDCM: Reducing Hallucination in LLMs through Explicit Reasoning Structures
par: Hao, Jinbo, et autres
Publié: (2026)
par: Hao, Jinbo, et autres
Publié: (2026)
Geometric Uncertainty for Detecting and Correcting Hallucinations in LLMs
par: Phillips, Edward, et autres
Publié: (2025)
par: Phillips, Edward, et autres
Publié: (2025)
Cost-Effective Hallucination Detection for LLMs
par: Valentin, Simon, et autres
Publié: (2024)
par: Valentin, Simon, et autres
Publié: (2024)
Flora: Effortless Context Construction to Arbitrary Length and Scale
par: Chen, Tianxiang, et autres
Publié: (2025)
par: Chen, Tianxiang, et autres
Publié: (2025)
Can LLMs Detect Their Own Hallucinations?
par: Kadotani, Sora, et autres
Publié: (2025)
par: Kadotani, Sora, et autres
Publié: (2025)
Probing LLM Hallucination from Within: Perturbation-Driven Approach via Internal Knowledge
par: Lee, Seongmin, et autres
Publié: (2024)
par: Lee, Seongmin, et autres
Publié: (2024)
Do LLMs Know about Hallucination? An Empirical Investigation of LLM's Hidden States
par: Duan, Hanyu, et autres
Publié: (2024)
par: Duan, Hanyu, et autres
Publié: (2024)
EnsemHalDet: Robust VLM Hallucination Detection via Ensemble of Internal State Detectors
par: Miyazato, Ryuhei, et autres
Publié: (2026)
par: Miyazato, Ryuhei, et autres
Publié: (2026)
CCNU at SemEval-2025 Task 3: Leveraging Internal and External Knowledge of Large Language Models for Multilingual Hallucination Annotation
par: Liu, Xu, et autres
Publié: (2025)
par: Liu, Xu, et autres
Publié: (2025)
Detecting Hallucinations in Large Language Models via Internal Attention Divergence Signals
par: van Dijk, Gijs
Publié: (2026)
par: van Dijk, Gijs
Publié: (2026)
The HalluRAG Dataset: Detecting Closed-Domain Hallucinations in RAG Applications Using an LLM's Internal States
par: Ridder, Fabian, et autres
Publié: (2024)
par: Ridder, Fabian, et autres
Publié: (2024)
Lowest Span Confidence: A Zero-Shot Metric for Efficient and Black-Box Hallucination Detection in LLMs
par: Qiao, Yitong, et autres
Publié: (2026)
par: Qiao, Yitong, et autres
Publié: (2026)
ICR Probe: Tracking Hidden State Dynamics for Reliable Hallucination Detection in LLMs
par: Zhang, Zhenliang, et autres
Publié: (2025)
par: Zhang, Zhenliang, et autres
Publié: (2025)
Hallucination Detection and Hallucination Mitigation: An Investigation
par: Luo, Junliang, et autres
Publié: (2024)
par: Luo, Junliang, et autres
Publié: (2024)
Med-HEAL: Analyzing and Mitigating Hallucinations in Medical LLMs with Hallucination-Aware In-Context Learning
par: Liao, Yiming, et autres
Publié: (2026)
par: Liao, Yiming, et autres
Publié: (2026)
Detecting Hallucinations in Retrieval-Augmented Generation via Semantic-level Internal Reasoning Graph
par: Hu, Jianpeng, et autres
Publié: (2026)
par: Hu, Jianpeng, et autres
Publié: (2026)
InternalInspector $I^2$: Robust Confidence Estimation in LLMs through Internal States
par: Beigi, Mohammad, et autres
Publié: (2024)
par: Beigi, Mohammad, et autres
Publié: (2024)
Documents similaires
-
Optimal Parameter and Neuron Pruning for Out-of-Distribution Detection
par: Chen, Chao, et autres
Publié: (2024) -
Structure-aware Domain Knowledge Injection for Large Language Models
par: Liu, Kai, et autres
Publié: (2024) -
Category-Extensible Out-of-Distribution Detection via Hierarchical Context Descriptions
par: Liu, Kai, et autres
Publié: (2024) -
Enhancing LLM's Cognition via Structurization
par: Liu, Kai, et autres
Publié: (2024) -
ROUTE: Robust Multitask Tuning and Collaboration for Text-to-SQL
par: Qin, Yang, et autres
Publié: (2024)