HALT: Hallucination Assessment via Log-probs as Time series
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shapiro, Ahmad, Taneja, Karan, Goel, Ashok |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MuDoC: An Interactive Multimodal Document-grounded Conversational AI System
par: Taneja, Karan, et autres
Publié: (2025)
par: Taneja, Karan, et autres
Publié: (2025)
Can Active Label Correction Improve LLM-based Modular AI Systems?
par: Taneja, Karan, et autres
Publié: (2024)
par: Taneja, Karan, et autres
Publié: (2024)
HALT-RAG: A Task-Adaptable Framework for Hallucination Detection with Calibrated NLI Ensembles and Abstention
par: Goswami, Saumya, et autres
Publié: (2025)
par: Goswami, Saumya, et autres
Publié: (2025)
Jill Watson: A Virtual Teaching Assistant powered by ChatGPT
par: Taneja, Karan, et autres
Publié: (2024)
par: Taneja, Karan, et autres
Publié: (2024)
Impact of Multimodal and Conversational AI on Learning Outcomes and Experience
par: Taneja, Karan, et autres
Publié: (2026)
par: Taneja, Karan, et autres
Publié: (2026)
Towards a Multimodal Document-grounded Conversational AI System for Education
par: Taneja, Karan, et autres
Publié: (2025)
par: Taneja, Karan, et autres
Publié: (2025)
Monte Carlo Tree Search for Recipe Generation using GPT-2
par: Taneja, Karan, et autres
Publié: (2024)
par: Taneja, Karan, et autres
Publié: (2024)
High Accuracy, Less Talk (HALT): Reliable LLMs through Capability-Aligned Finetuning
par: Franzmeyer, Tim, et autres
Publié: (2025)
par: Franzmeyer, Tim, et autres
Publié: (2025)
HIDE and Seek: Detecting Hallucinations in Language Models via Decoupled Representations
par: Chatterjee, Anwoy, et autres
Publié: (2025)
par: Chatterjee, Anwoy, et autres
Publié: (2025)
SymTax: Symbiotic Relationship and Taxonomy Fusion for Effective Citation Recommendation
par: Goyal, Karan, et autres
Publié: (2024)
par: Goyal, Karan, et autres
Publié: (2024)
Controlled Automatic Task-Specific Synthetic Data Generation for Hallucination Detection
par: Xie, Yong, et autres
Publié: (2024)
par: Xie, Yong, et autres
Publié: (2024)
HalluWorld: A Controlled Benchmark for Hallucination via Reference World Models
par: Liu, Emmy, et autres
Publié: (2026)
par: Liu, Emmy, et autres
Publié: (2026)
Evaluating Learner Representations for Differentiation Prior to Instructional Outcomes
par: Park, Junsoo, et autres
Publié: (2026)
par: Park, Junsoo, et autres
Publié: (2026)
Learning from Contrastive Prompts: Automated Optimization and Adaptation
par: Li, Mingqi, et autres
Publié: (2024)
par: Li, Mingqi, et autres
Publié: (2024)
ChatLog: Carefully Evaluating the Evolution of ChatGPT Across Time
par: Tu, Shangqing, et autres
Publié: (2023)
par: Tu, Shangqing, et autres
Publié: (2023)
Enhancing Hallucination Detection via Future Context
par: Lee, Joosung, et autres
Publié: (2025)
par: Lee, Joosung, et autres
Publié: (2025)
Hallucination Detection and Hallucination Mitigation: An Investigation
par: Luo, Junliang, et autres
Publié: (2024)
par: Luo, Junliang, et autres
Publié: (2024)
HICD: Hallucination-Inducing via Attention Dispersion for Contrastive Decoding to Mitigate Hallucinations in Large Language Models
par: Jiang, Xinyan, et autres
Publié: (2025)
par: Jiang, Xinyan, et autres
Publié: (2025)
Self-Explanation in Social AI Agents
par: Basappa, Rhea, et autres
Publié: (2025)
par: Basappa, Rhea, et autres
Publié: (2025)
AlignCheck: a Semantic Open-Domain Metric for Factual Consistency Assessment
par: Aghaebrahimian, Ahmad
Publié: (2025)
par: Aghaebrahimian, Ahmad
Publié: (2025)
Removal of Hallucination on Hallucination: Debate-Augmented RAG
par: Hu, Wentao, et autres
Publié: (2025)
par: Hu, Wentao, et autres
Publié: (2025)
AI Hallucination from Students' Perspective: A Thematic Analysis
par: Shoufan, Abdulhadi, et autres
Publié: (2026)
par: Shoufan, Abdulhadi, et autres
Publié: (2026)
LLM-CAS: Dynamic Neuron Perturbation for Real-Time Hallucination Correction
par: Zhang, Jensen, et autres
Publié: (2025)
par: Zhang, Jensen, et autres
Publié: (2025)
Hallucination as an Anomaly: Dynamic Intervention via Probabilistic Circuits
par: Nielsen, Erik, et autres
Publié: (2026)
par: Nielsen, Erik, et autres
Publié: (2026)
HARP: Hallucination Detection via Reasoning Subspace Projection
par: Hu, Junjie, et autres
Publié: (2025)
par: Hu, Junjie, et autres
Publié: (2025)
A Unified Definition of Hallucination: It's The World Model, Stupid!
par: Liu, Emmy, et autres
Publié: (2025)
par: Liu, Emmy, et autres
Publié: (2025)
The Energy of Falsehood: Detecting Hallucinations via Diffusion Model Likelihoods
par: Gautam, Arpit Singh, et autres
Publié: (2026)
par: Gautam, Arpit Singh, et autres
Publié: (2026)
Do Benchmarks Underestimate LLM Performance? Evaluating Hallucination Detection With LLM-First Human-Adjudicated Assessment
par: Atasoy, I. F., et autres
Publié: (2026)
par: Atasoy, I. F., et autres
Publié: (2026)
Alleviating Hallucinations of Large Language Models through Induced Hallucinations
par: Zhang, Yue, et autres
Publié: (2023)
par: Zhang, Yue, et autres
Publié: (2023)
Memory-Based vs. Context-Only Conditioning Produces Distinct Behavioral Patterns in Stateful Personalization
par: Park, Junsoo, et autres
Publié: (2026)
par: Park, Junsoo, et autres
Publié: (2026)
Unsupervised Real-Time Hallucination Detection based on the Internal States of Large Language Models
par: Su, Weihang, et autres
Publié: (2024)
par: Su, Weihang, et autres
Publié: (2024)
HausaNLP at SemEval-2025 Task 3: Towards a Fine-Grained Model-Aware Hallucination Detection
par: Bala, Maryam, et autres
Publié: (2025)
par: Bala, Maryam, et autres
Publié: (2025)
Black-Box Hallucination Detection via Consistency Under the Uncertain Expression
par: Joo, Seongho, et autres
Publié: (2025)
par: Joo, Seongho, et autres
Publié: (2025)
Self-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation
par: Zhang, Xiaoying, et autres
Publié: (2024)
par: Zhang, Xiaoying, et autres
Publié: (2024)
The Path of Least Resistance: Guiding LLM Reasoning Trajectories with Prefix Consensus
par: Jindal, Ishan, et autres
Publié: (2026)
par: Jindal, Ishan, et autres
Publié: (2026)
Don't Let It Hallucinate: Premise Verification via Retrieval-Augmented Logical Reasoning
par: Qin, Yuehan, et autres
Publié: (2025)
par: Qin, Yuehan, et autres
Publié: (2025)
Controllable Text Generation in the Instruction-Tuning Era
par: Ashok, Dhananjay, et autres
Publié: (2024)
par: Ashok, Dhananjay, et autres
Publié: (2024)
FaithBench: A Diverse Hallucination Benchmark for Summarization by Modern LLMs
par: Bao, Forrest Sheng, et autres
Publié: (2024)
par: Bao, Forrest Sheng, et autres
Publié: (2024)
Triggering Hallucinations in LLMs: A Quantitative Study of Prompt-Induced Hallucination in Large Language Models
par: Sato, Makoto
Publié: (2025)
par: Sato, Makoto
Publié: (2025)
How Much Do LLMs Hallucinate across Languages? On Realistic Multilingual Estimation of LLM Hallucination
par: Islam, Saad Obaid ul, et autres
Publié: (2025)
par: Islam, Saad Obaid ul, et autres
Publié: (2025)
Documents similaires
-
MuDoC: An Interactive Multimodal Document-grounded Conversational AI System
par: Taneja, Karan, et autres
Publié: (2025) -
Can Active Label Correction Improve LLM-based Modular AI Systems?
par: Taneja, Karan, et autres
Publié: (2024) -
HALT-RAG: A Task-Adaptable Framework for Hallucination Detection with Calibrated NLI Ensembles and Abstention
par: Goswami, Saumya, et autres
Publié: (2025) -
Jill Watson: A Virtual Teaching Assistant powered by ChatGPT
par: Taneja, Karan, et autres
Publié: (2024) -
Impact of Multimodal and Conversational AI on Learning Outcomes and Experience
par: Taneja, Karan, et autres
Publié: (2026)