A Head to Predict and a Head to Question: Pre-trained Uncertainty Quantification Heads for Hallucination Detection in LLM Outputs
Fuente:
arXiv
Salvato in:
| Autori principali: | Shelmanov, Artem, Fadeeva, Ekaterina, Tsvigun, Akim, Tsvigun, Ivan, Xie, Zhuohan, Kiselev, Igor, Daheim, Nico, Zhang, Caiqi, Vazhentsev, Artem, Sachan, Mrinmaya, Nakov, Preslav, Baldwin, Timothy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Uncertainty-Aware Attention Heads: Efficient Unsupervised Uncertainty Quantification for LLMs
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025)
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025)
Faithfulness-Aware Uncertainty Quantification for Fact-Checking the Output of Retrieval Augmented Generation
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2025)
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2025)
Benchmarking Uncertainty Quantification Methods for Large Language Models with LM-Polygraph
di: Vashurin, Roman, et al.
Pubblicazione: (2024)
di: Vashurin, Roman, et al.
Pubblicazione: (2024)
Don't Throw Away Your Beams: Improving Consistency-based Uncertainties in LLMs via Beam Search
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2025)
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2025)
Unconditional Truthfulness: Learning Unconditional Uncertainty of Large Language Models
di: Vazhentsev, Artem, et al.
Pubblicazione: (2024)
di: Vazhentsev, Artem, et al.
Pubblicazione: (2024)
Uncertainty Quantification for Large Language Diffusion Models
di: Vazhentsev, Artem, et al.
Pubblicazione: (2026)
di: Vazhentsev, Artem, et al.
Pubblicazione: (2026)
Fact-Checking the Output of Large Language Models via Token-Level Uncertainty Quantification
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2024)
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2024)
Token-Level Density-Based Uncertainty Quantification Methods for Eliciting Truthfulness of Large Language Models
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025)
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025)
Uncertainty Quantification for LLMs through Minimum Bayes Risk: Bridging Confidence and Consistency
di: Vashurin, Roman, et al.
Pubblicazione: (2025)
di: Vashurin, Roman, et al.
Pubblicazione: (2025)
ReProbe: Efficient Test-Time Scaling of Multi-Step Reasoning by Probing Internal States of Large Language Models
di: Ni, Jingwei, et al.
Pubblicazione: (2025)
di: Ni, Jingwei, et al.
Pubblicazione: (2025)
ATGen: A Framework for Active Text Generation
di: Tsvigun, Akim, et al.
Pubblicazione: (2025)
di: Tsvigun, Akim, et al.
Pubblicazione: (2025)
M4GT-Bench: Evaluation Benchmark for Black-Box Machine-Generated Text Detection
di: Wang, Yuxia, et al.
Pubblicazione: (2024)
di: Wang, Yuxia, et al.
Pubblicazione: (2024)
Uncertainty-aware abstention in medical diagnosis based on medical texts
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025)
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025)
SemEval-2024 Task 8: Multidomain, Multimodel and Multilingual Machine-Generated Text Detection
di: Wang, Yuxia, et al.
Pubblicazione: (2024)
di: Wang, Yuxia, et al.
Pubblicazione: (2024)
M4: Multi-generator, Multi-domain, and Multi-lingual Black-Box Machine-Generated Text Detection
di: Wang, Yuxia, et al.
Pubblicazione: (2023)
di: Wang, Yuxia, et al.
Pubblicazione: (2023)
On the Emergence of Induction Heads for In-Context Learning
di: Musat, Tiberiu, et al.
Pubblicazione: (2025)
di: Musat, Tiberiu, et al.
Pubblicazione: (2025)
Stepwise Verification and Remediation of Student Reasoning Errors with Large Language Model Tutors
di: Daheim, Nico, et al.
Pubblicazione: (2024)
di: Daheim, Nico, et al.
Pubblicazione: (2024)
Hands-On Tutorial: Labeling with LLM and Human-in-the-Loop
di: Artemova, Ekaterina, et al.
Pubblicazione: (2024)
di: Artemova, Ekaterina, et al.
Pubblicazione: (2024)
Book2Dial: Generating Teacher-Student Interactions from Textbooks for Cost-Effective Development of Educational Chatbots
di: Wang, Junling, et al.
Pubblicazione: (2024)
di: Wang, Junling, et al.
Pubblicazione: (2024)
ALIEN: Aligned Entropy Head for Improving Uncertainty Estimation of LLMs
di: Zabolotnyi, Artem, et al.
Pubblicazione: (2025)
di: Zabolotnyi, Artem, et al.
Pubblicazione: (2025)
MathTutorBench: A Benchmark for Measuring Open-ended Pedagogical Capabilities of LLM Tutors
di: Macina, Jakub, et al.
Pubblicazione: (2025)
di: Macina, Jakub, et al.
Pubblicazione: (2025)
Efficient Test-Time Inference via Deterministic Exploration of Truncated Decoding Trees
di: Li, Xueyan, et al.
Pubblicazione: (2026)
di: Li, Xueyan, et al.
Pubblicazione: (2026)
From Problem-Solving to Teaching Problem-Solving: Aligning LLMs with Pedagogy using Reinforcement Learning
di: Dinucu-Jianu, David, et al.
Pubblicazione: (2025)
di: Dinucu-Jianu, David, et al.
Pubblicazione: (2025)
Vikhr: The Family of Open-Source Instruction-Tuned Large Language Models for Russian
di: Nikolich, Aleksandr, et al.
Pubblicazione: (2024)
di: Nikolich, Aleksandr, et al.
Pubblicazione: (2024)
Inference-Time Selective Debiasing to Enhance Fairness in Text Classification Models
di: Kuzmin, Gleb, et al.
Pubblicazione: (2024)
di: Kuzmin, Gleb, et al.
Pubblicazione: (2024)
LLM-DetectAIve: a Tool for Fine-Grained Machine-Generated Text Detection
di: Abassy, Mervat, et al.
Pubblicazione: (2024)
di: Abassy, Mervat, et al.
Pubblicazione: (2024)
FinCARDS: Card-Based Analyst Reranking for Financial Document Question Answering
di: Zhou, Yixi, et al.
Pubblicazione: (2026)
di: Zhou, Yixi, et al.
Pubblicazione: (2026)
Densemarks: Learning Canonical Embeddings for Human Heads Images via Point Tracks
di: Pozdeev, Dmitrii, et al.
Pubblicazione: (2025)
di: Pozdeev, Dmitrii, et al.
Pubblicazione: (2025)
Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI
di: Wang, Yuxia, et al.
Pubblicazione: (2025)
di: Wang, Yuxia, et al.
Pubblicazione: (2025)
Beyond Memorization: Extending Reasoning Depth with Recurrence, Memory and Test-Time Compute Scaling
di: Rodkin, Ivan, et al.
Pubblicazione: (2025)
di: Rodkin, Ivan, et al.
Pubblicazione: (2025)
Automated Knowledge Concept Annotation and Question Representation Learning for Knowledge Tracing
di: Ozyurt, Yilmazcan, et al.
Pubblicazione: (2024)
di: Ozyurt, Yilmazcan, et al.
Pubblicazione: (2024)
Argument-Based Comparative Question Answering Evaluation Benchmark
di: Nikishina, Irina, et al.
Pubblicazione: (2025)
di: Nikishina, Irina, et al.
Pubblicazione: (2025)
TabM: Advancing Tabular Deep Learning with Parameter-Efficient Ensembling
di: Gorishniy, Yury, et al.
Pubblicazione: (2024)
di: Gorishniy, Yury, et al.
Pubblicazione: (2024)
GenAI Content Detection Task 1: English and Multilingual Machine-Generated Text Detection: AI vs. Human
di: Wang, Yuxia, et al.
Pubblicazione: (2025)
di: Wang, Yuxia, et al.
Pubblicazione: (2025)
Mathematical model of thyroid gland functioning as a follicles system
di: Ekaterina Vladimirovna Fadeeva
Pubblicazione: (2021)
di: Ekaterina Vladimirovna Fadeeva
Pubblicazione: (2021)
HeadCraft: Modeling High-Detail Shape Variations for Animated 3DMMs
di: Sevastopolsky, Artem, et al.
Pubblicazione: (2023)
di: Sevastopolsky, Artem, et al.
Pubblicazione: (2023)
Why Don't You Know? Evaluating the Impact of Uncertainty Sources on Uncertainty Quantification in LLMs
di: Goloburda, Maiya, et al.
Pubblicazione: (2026)
di: Goloburda, Maiya, et al.
Pubblicazione: (2026)
Induction Heads as an Essential Mechanism for Pattern Matching in In-context Learning
di: Crosbie, Joy, et al.
Pubblicazione: (2024)
di: Crosbie, Joy, et al.
Pubblicazione: (2024)
Avat3r: Large Animatable Gaussian Reconstruction Model for High-fidelity 3D Head Avatars
di: Kirschstein, Tobias, et al.
Pubblicazione: (2025)
di: Kirschstein, Tobias, et al.
Pubblicazione: (2025)
Complex-Valued Unitary Representations as Classification Heads for Improved Uncertainty Quantification in Deep Neural Networks
di: Jafari, Akbar Anbar, et al.
Pubblicazione: (2026)
di: Jafari, Akbar Anbar, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Uncertainty-Aware Attention Heads: Efficient Unsupervised Uncertainty Quantification for LLMs
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025) -
Faithfulness-Aware Uncertainty Quantification for Fact-Checking the Output of Retrieval Augmented Generation
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2025) -
Benchmarking Uncertainty Quantification Methods for Large Language Models with LM-Polygraph
di: Vashurin, Roman, et al.
Pubblicazione: (2024) -
Don't Throw Away Your Beams: Improving Consistency-based Uncertainties in LLMs via Beam Search
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2025) -
Unconditional Truthfulness: Learning Unconditional Uncertainty of Large Language Models
di: Vazhentsev, Artem, et al.
Pubblicazione: (2024)