Teaming LLMs to Detect and Mitigate Hallucinations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Till, Demian, Smeaton, John, Haubrick, Peter, Saheb, Gouse, Graef, Florian, Berman, David |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
KV-weights are all you need for skipless transformers
par: Graef, Nils
Publié: (2024)
par: Graef, Nils
Publié: (2024)
Transformer tricks: Precomputing the first layer
par: Graef, Nils
Publié: (2024)
par: Graef, Nils
Publié: (2024)
A Concise Review of Hallucinations in LLMs and their Mitigation
par: Pulkundwar, Parth, et autres
Publié: (2025)
par: Pulkundwar, Parth, et autres
Publié: (2025)
Detecting and Mitigating Insertion Hallucination in Video-to-Audio Generation
par: Chen, Liyang, et autres
Publié: (2025)
par: Chen, Liyang, et autres
Publié: (2025)
Slim attention: cut your context memory in half without loss -- K-cache is all you need for MHA
par: Graef, Nils, et autres
Publié: (2025)
par: Graef, Nils, et autres
Publié: (2025)
Egalitarian Gradient Descent: A Simple Approach to Accelerated Grokking
par: Pasand, Ali Saheb, et autres
Publié: (2025)
par: Pasand, Ali Saheb, et autres
Publié: (2025)
Robust Hallucination Detection in LLMs via Adaptive Token Selection
par: Niu, Mengjia, et autres
Publié: (2025)
par: Niu, Mengjia, et autres
Publié: (2025)
LANCET: Neural Intervention via Structural Entropy for Mitigating Faithfulness Hallucinations in LLMs
par: Wang, Chenxu, et autres
Publié: (2026)
par: Wang, Chenxu, et autres
Publié: (2026)
Cost-Effective Hallucination Detection for LLMs
par: Valentin, Simon, et autres
Publié: (2024)
par: Valentin, Simon, et autres
Publié: (2024)
Conditional Hallucinations for Image Compression
par: Aczel, Till, et autres
Publié: (2024)
par: Aczel, Till, et autres
Publié: (2024)
Understanding Foundation Models: Are We Back in 1924?
par: Smeaton, Alan F.
Publié: (2024)
par: Smeaton, Alan F.
Publié: (2024)
KARL: Mitigating Hallucinations in LLMs via Knowledge-Boundary-Aware Reinforcement Learning
par: Gao, Cheng, et autres
Publié: (2026)
par: Gao, Cheng, et autres
Publié: (2026)
Hallucination Detection and Mitigation with Diffusion in Multi-Variate Time-Series Foundation Models
par: Wichitwechkarn, Vijja, et autres
Publié: (2025)
par: Wichitwechkarn, Vijja, et autres
Publié: (2025)
Smoothing Out Hallucinations: Mitigating LLM Hallucination with Smoothed Knowledge Distillation
par: Nguyen, Hieu, et autres
Publié: (2025)
par: Nguyen, Hieu, et autres
Publié: (2025)
The Illusion of Progress: Re-evaluating Hallucination Detection in LLMs
par: Janiak, Denis, et autres
Publié: (2025)
par: Janiak, Denis, et autres
Publié: (2025)
Self-contradictory Hallucinations of Large Language Models: Evaluation, Detection and Mitigation
par: Mündler, Niels, et autres
Publié: (2023)
par: Mündler, Niels, et autres
Publié: (2023)
Mitigating Multimodal LLMs Hallucinations via Relevance Propagation at Inference Time
par: Allouche, Itai, et autres
Publié: (2026)
par: Allouche, Itai, et autres
Publié: (2026)
On the Expressive Power of Contextual Relations in Transformers
par: Fraiman, Demián
Publié: (2026)
par: Fraiman, Demián
Publié: (2026)
Can LLMs Lie? Investigation beyond Hallucination
par: Huan, Haoran, et autres
Publié: (2025)
par: Huan, Haoran, et autres
Publié: (2025)
LLMs Will Always Hallucinate, and We Need to Live With This
par: Banerjee, Sourav, et autres
Publié: (2024)
par: Banerjee, Sourav, et autres
Publié: (2024)
EigenTrack: Spectral Activation Feature Tracking for Hallucination and Out-of-Distribution Detection in LLMs and VLMs
par: Ettori, Davide, et autres
Publié: (2025)
par: Ettori, Davide, et autres
Publié: (2025)
Mitigating LLM Hallucinations via Conformal Abstention
par: Yadkori, Yasin Abbasi, et autres
Publié: (2024)
par: Yadkori, Yasin Abbasi, et autres
Publié: (2024)
HD-NDEs: Neural Differential Equations for Hallucination Detection in LLMs
par: Li, Qing, et autres
Publié: (2025)
par: Li, Qing, et autres
Publié: (2025)
Hallucination Detection in LLMs Using Spectral Features of Attention Maps
par: Binkowski, Jakub, et autres
Publié: (2025)
par: Binkowski, Jakub, et autres
Publié: (2025)
Semantic Entropy Probes: Robust and Cheap Hallucination Detection in LLMs
par: Kossen, Jannik, et autres
Publié: (2024)
par: Kossen, Jannik, et autres
Publié: (2024)
HaloProbe: Bayesian Detection and Mitigation of Object Hallucinations in Vision-Language Models
par: Zohrabi, Reihaneh, et autres
Publié: (2026)
par: Zohrabi, Reihaneh, et autres
Publié: (2026)
FlashNorm: Fast Normalization for Transformers
par: Graef, Nils, et autres
Publié: (2024)
par: Graef, Nils, et autres
Publié: (2024)
GRAD: Graph-Retrieved Adaptive Decoding for Hallucination Mitigation
par: Nguyen, Manh, et autres
Publié: (2025)
par: Nguyen, Manh, et autres
Publié: (2025)
Efficient Contrastive Decoding with Probabilistic Hallucination Detection - Mitigating Hallucinations in Large Vision Language Models -
par: Fieback, Laura, et autres
Publié: (2025)
par: Fieback, Laura, et autres
Publié: (2025)
Detecting Hallucinations in SpeechLLMs at Inference Time Using Attention Maps
par: Waldendorf, Jonas, et autres
Publié: (2026)
par: Waldendorf, Jonas, et autres
Publié: (2026)
Hallucination Detection in LLMs: Fast and Memory-Efficient Fine-Tuned Models
par: Arteaga, Gabriel Y., et autres
Publié: (2024)
par: Arteaga, Gabriel Y., et autres
Publié: (2024)
Mitigating Hallucinated Translations in Large Language Models with Hallucination-focused Preference Optimization
par: Tang, Zilu, et autres
Publié: (2025)
par: Tang, Zilu, et autres
Publié: (2025)
WERank: Towards Rank Degradation Prevention for Self-Supervised Learning Using Weight Regularization
par: Pasand, Ali Saheb, et autres
Publié: (2024)
par: Pasand, Ali Saheb, et autres
Publié: (2024)
Decoupling Contrastive Decoding: Robust Hallucination Mitigation in Multimodal Large Language Models
par: Chen, Wei, et autres
Publié: (2025)
par: Chen, Wei, et autres
Publié: (2025)
Mitigating Diffusion Model Hallucinations with Dynamic Guidance
par: Triaridis, Kostas, et autres
Publié: (2025)
par: Triaridis, Kostas, et autres
Publié: (2025)
On Mitigating Code LLM Hallucinations with API Documentation
par: Jain, Nihal, et autres
Publié: (2024)
par: Jain, Nihal, et autres
Publié: (2024)
Generation Constraint Scaling Can Mitigate Hallucination
par: Kollias, Georgios, et autres
Publié: (2024)
par: Kollias, Georgios, et autres
Publié: (2024)
REAM: Merging Improves Pruning of Experts in LLMs
par: Jha, Saurav, et autres
Publié: (2026)
par: Jha, Saurav, et autres
Publié: (2026)
Mitigating Hallucinations in Vision-Language Models through Image-Guided Head Suppression
par: Sarkar, Sreetama, et autres
Publié: (2025)
par: Sarkar, Sreetama, et autres
Publié: (2025)
Mitigating LLM Hallucination via Behaviorally Calibrated Reinforcement Learning
par: Wu, Jiayun, et autres
Publié: (2025)
par: Wu, Jiayun, et autres
Publié: (2025)
Documents similaires
-
KV-weights are all you need for skipless transformers
par: Graef, Nils
Publié: (2024) -
Transformer tricks: Precomputing the first layer
par: Graef, Nils
Publié: (2024) -
A Concise Review of Hallucinations in LLMs and their Mitigation
par: Pulkundwar, Parth, et autres
Publié: (2025) -
Detecting and Mitigating Insertion Hallucination in Video-to-Audio Generation
par: Chen, Liyang, et autres
Publié: (2025) -
Slim attention: cut your context memory in half without loss -- K-cache is all you need for MHA
par: Graef, Nils, et autres
Publié: (2025)