Hallucination Detection: Robustly Discerning Reliable Answers in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yuyan, Fu, Qiang, Yuan, Yichen, Wen, Zhihao, Fan, Ge, Liu, Dayiheng, Zhang, Dongmei, Li, Zhixu, Xiao, Yanghua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MAPO: Boosting Large Language Model Performance with Model-Adaptive Prompt Optimization
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Hadamard Adapter: An Extreme Parameter-Efficient Adapter Tuning Method for Pre-trained Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Recent Advancement of Emotion Cognition in Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Can Pre-trained Language Models Understand Chinese Humor?
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
OVEL: Large Language Model as Memory Manager for Online Video Entity Linking
di: Zhao, Haiquan, et al.
Pubblicazione: (2024)
di: Zhao, Haiquan, et al.
Pubblicazione: (2024)
Dr.Academy: A Benchmark for Evaluating Questioning Capability in Education for Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Why Did Apple Fall: Evaluating Curiosity in Large Language Models
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
EmotionQueen: A Benchmark for Evaluating Empathy of Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Is There a One-Model-Fits-All Approach to Information Extraction? Revisiting Task Definition Biases
di: Huang, Wenhao, et al.
Pubblicazione: (2024)
di: Huang, Wenhao, et al.
Pubblicazione: (2024)
Do Large Language Models have Problem-Solving Capability under Incomplete Information Scenarios?
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Hallucination Detection via Internal States and Structured Reasoning Consistency in Large Language Models
di: Song, Yusheng, et al.
Pubblicazione: (2025)
di: Song, Yusheng, et al.
Pubblicazione: (2025)
Joint Evaluation of Answer and Reasoning Consistency for Hallucination Detection in Large Reasoning Models
di: Wang, Changyue, et al.
Pubblicazione: (2025)
di: Wang, Changyue, et al.
Pubblicazione: (2025)
Adaptive Ordered Information Extraction with Deep Reinforcement Learning
di: Huang, Wenhao, et al.
Pubblicazione: (2023)
di: Huang, Wenhao, et al.
Pubblicazione: (2023)
Unified Hallucination Detection for Multimodal Large Language Models
di: Chen, Xiang, et al.
Pubblicazione: (2024)
di: Chen, Xiang, et al.
Pubblicazione: (2024)
Judge Before Answer: Can MLLM Discern the False Premise in Question?
di: Li, Jidong, et al.
Pubblicazione: (2025)
di: Li, Jidong, et al.
Pubblicazione: (2025)
Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models
di: Amiri-Margavi, Alireza, et al.
Pubblicazione: (2024)
di: Amiri-Margavi, Alireza, et al.
Pubblicazione: (2024)
Mitigating Entity-Level Hallucination in Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2024)
di: Su, Weihang, et al.
Pubblicazione: (2024)
XMeCap: Meme Caption Generation with Sub-Image Adaptability
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
ESC-Eval: Evaluating Emotion Support Conversations in Large Language Models
di: Zhao, Haiquan, et al.
Pubblicazione: (2024)
di: Zhao, Haiquan, et al.
Pubblicazione: (2024)
Span-Level Hallucination Detection for LLM-Generated Answers
di: Elchafei, Passant, et al.
Pubblicazione: (2025)
di: Elchafei, Passant, et al.
Pubblicazione: (2025)
Attention-guided Self-reflection for Zero-shot Hallucination Detection in Large Language Models
di: Liu, Qiang, et al.
Pubblicazione: (2025)
di: Liu, Qiang, et al.
Pubblicazione: (2025)
AutoScraper: A Progressive Understanding Web Agent for Web Scraper Generation
di: Huang, Wenhao, et al.
Pubblicazione: (2024)
di: Huang, Wenhao, et al.
Pubblicazione: (2024)
RECKON: Large-scale Reference-based Efficient Knowledge Evaluation for Large Language Model
di: Zhang, Lin, et al.
Pubblicazione: (2025)
di: Zhang, Lin, et al.
Pubblicazione: (2025)
TravelAgent: An AI Assistant for Personalized Travel Planning
di: Chen, Aili, et al.
Pubblicazione: (2024)
di: Chen, Aili, et al.
Pubblicazione: (2024)
Hallucination Detection and Evaluation of Large Language Model
di: Zhang, Chenggong, et al.
Pubblicazione: (2025)
di: Zhang, Chenggong, et al.
Pubblicazione: (2025)
Diagnosing Failures in Large Language Models' Answers: Integrating Error Attribution into Evaluation Framework
di: Xu, Zishan, et al.
Pubblicazione: (2025)
di: Xu, Zishan, et al.
Pubblicazione: (2025)
DetectBench: Can Large Language Model Detect and Piece Together Implicit Evidence?
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
How Easily do Irrelevant Inputs Skew the Responses of Large Language Models?
di: Wu, Siye, et al.
Pubblicazione: (2024)
di: Wu, Siye, et al.
Pubblicazione: (2024)
Improving Recall of Large Language Models: A Model Collaboration Approach for Relational Triple Extraction
di: Ding, Zepeng, et al.
Pubblicazione: (2024)
di: Ding, Zepeng, et al.
Pubblicazione: (2024)
Framework for Hallucination Detection in Large Language Models
di: Dheeraj Sundaragiri, et al.
Pubblicazione: (2026)
di: Dheeraj Sundaragiri, et al.
Pubblicazione: (2026)
GumbelSoft: Diversified Language Model Watermarking via the GumbelMax-trick
di: Fu, Jiayi, et al.
Pubblicazione: (2024)
di: Fu, Jiayi, et al.
Pubblicazione: (2024)
HalluSAE: Detecting Hallucinations in Large Language Models via Sparse Auto-Encoders
di: Chen, Boshui, et al.
Pubblicazione: (2026)
di: Chen, Boshui, et al.
Pubblicazione: (2026)
Delta -- Contrastive Decoding Mitigates Text Hallucinations in Large Language Models
di: Huang, Cheng Peng, et al.
Pubblicazione: (2025)
di: Huang, Cheng Peng, et al.
Pubblicazione: (2025)
Past Meets Present: Creating Historical Analogy with Large Language Models
di: Li, Nianqi, et al.
Pubblicazione: (2024)
di: Li, Nianqi, et al.
Pubblicazione: (2024)
Structured Reasoning for Large Language Models
di: Han, Jinyi, et al.
Pubblicazione: (2026)
di: Han, Jinyi, et al.
Pubblicazione: (2026)
Poly-FEVER: A Multilingual Fact Verification Benchmark for Hallucination Detection in Large Language Models
di: Zhang, Hanzhi, et al.
Pubblicazione: (2025)
di: Zhang, Hanzhi, et al.
Pubblicazione: (2025)
Exploring and Mitigating Fawning Hallucinations in Large Language Models
di: Shangguan, Zixuan, et al.
Pubblicazione: (2025)
di: Shangguan, Zixuan, et al.
Pubblicazione: (2025)
Towards Lightweight Reliability: Using Soft Prompts for Hallucination Mitigation in Large Language Models
di: Siddiqui, S M Tahmid, et al.
Pubblicazione: (2026)
di: Siddiqui, S M Tahmid, et al.
Pubblicazione: (2026)
Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models
di: Xiong, Guangzhi, et al.
Pubblicazione: (2025)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2025)
MetaGPT: Merging Large Language Models Using Model Exclusive Task Arithmetic
di: Zhou, Yuyan, et al.
Pubblicazione: (2024)
di: Zhou, Yuyan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MAPO: Boosting Large Language Model Performance with Model-Adaptive Prompt Optimization
di: Chen, Yuyan, et al.
Pubblicazione: (2024) -
Hadamard Adapter: An Extreme Parameter-Efficient Adapter Tuning Method for Pre-trained Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024) -
Recent Advancement of Emotion Cognition in Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024) -
Can Pre-trained Language Models Understand Chinese Humor?
di: Chen, Yuyan, et al.
Pubblicazione: (2024) -
OVEL: Large Language Model as Memory Manager for Online Video Entity Linking
di: Zhao, Haiquan, et al.
Pubblicazione: (2024)