Hallucination Detection and Evaluation of Large Language Model
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Chenggong, Wang, Haopeng, Meng, Hexi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Towards Unification of Hallucination Detection and Fact Verification for Large Language Models
by: Su, Weihang, et al.
Published: (2025)
by: Su, Weihang, et al.
Published: (2025)
Mitigating Entity-Level Hallucination in Large Language Models
by: Su, Weihang, et al.
Published: (2024)
by: Su, Weihang, et al.
Published: (2024)
Large Language Models as Evaluators for Recommendation Explanations
by: Zhang, Xiaoyu, et al.
Published: (2024)
by: Zhang, Xiaoyu, et al.
Published: (2024)
Conversational Recommender System and Large Language Model Are Made for Each Other in E-commerce Pre-sales Dialogue
by: Liu, Yuanxing, et al.
Published: (2023)
by: Liu, Yuanxing, et al.
Published: (2023)
Enhance Graph Alignment for Large Language Models
by: Luo, Haitong, et al.
Published: (2024)
by: Luo, Haitong, et al.
Published: (2024)
Unveiling the Magic: Investigating Attention Distillation in Retrieval-augmented Generation
by: Li, Zizhong, et al.
Published: (2024)
by: Li, Zizhong, et al.
Published: (2024)
Unified Hallucination Detection for Multimodal Large Language Models
by: Chen, Xiang, et al.
Published: (2024)
by: Chen, Xiang, et al.
Published: (2024)
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
by: Wang, Xiaolei, et al.
Published: (2023)
by: Wang, Xiaolei, et al.
Published: (2023)
Can Large Language Models Detect Rumors on Social Media?
by: Liu, Qiang, et al.
Published: (2024)
by: Liu, Qiang, et al.
Published: (2024)
Medico: Towards Hallucination Detection and Correction with Multi-source Evidence Fusion
by: Zhao, Xinping, et al.
Published: (2024)
by: Zhao, Xinping, et al.
Published: (2024)
Evaluating Large Language Models for Cross-Lingual Retrieval
by: Zuo, Longfei, et al.
Published: (2025)
by: Zuo, Longfei, et al.
Published: (2025)
Large Language Models' Detection of Political Orientation in Newspapers
by: Buscemi, Alessio, et al.
Published: (2024)
by: Buscemi, Alessio, et al.
Published: (2024)
Generative Multi-Modal Knowledge Retrieval with Large Language Models
by: Long, Xinwei, et al.
Published: (2024)
by: Long, Xinwei, et al.
Published: (2024)
OAEI-LLM: A Benchmark Dataset for Understanding Large Language Model Hallucinations in Ontology Matching
by: Qiang, Zhangcheng, et al.
Published: (2024)
by: Qiang, Zhangcheng, et al.
Published: (2024)
MDEval: Evaluating and Enhancing Markdown Awareness in Large Language Models
by: Chen, Zhongpu, et al.
Published: (2025)
by: Chen, Zhongpu, et al.
Published: (2025)
Music Recommendation with Large Language Models: Challenges, Opportunities, and Evaluation
by: Epure, Elena V., et al.
Published: (2025)
by: Epure, Elena V., et al.
Published: (2025)
Hybrid Retrieval for Hallucination Mitigation in Large Language Models: A Comparative Analysis
by: Mala, Chandana Sree, et al.
Published: (2025)
by: Mala, Chandana Sree, et al.
Published: (2025)
UniConv: Unifying Retrieval and Response Generation for Large Language Models in Conversations
by: Mo, Fengran, et al.
Published: (2025)
by: Mo, Fengran, et al.
Published: (2025)
PRE: A Peer Review Based Large Language Model Evaluator
by: Chu, Zhumin, et al.
Published: (2024)
by: Chu, Zhumin, et al.
Published: (2024)
A Comprehensive Evaluation of Large Language Models on Temporal Event Forecasting
by: Chang, He, et al.
Published: (2024)
by: Chang, He, et al.
Published: (2024)
Can We Use Large Language Models to Fill Relevance Judgment Holes?
by: Abbasiantaeb, Zahra, et al.
Published: (2024)
by: Abbasiantaeb, Zahra, et al.
Published: (2024)
The Great Nugget Recall: Automating Fact Extraction and RAG Evaluation with Large Language Models
by: Pradeep, Ronak, et al.
Published: (2025)
by: Pradeep, Ronak, et al.
Published: (2025)
Prospect Personalized Recommendation on Large Language Model-based Agent Platform
by: Zhang, Jizhi, et al.
Published: (2024)
by: Zhang, Jizhi, et al.
Published: (2024)
Evaluating the External and Parametric Knowledge Fusion of Large Language Models
by: Zhang, Hao, et al.
Published: (2024)
by: Zhang, Hao, et al.
Published: (2024)
Large Language Model Agent for Fake News Detection
by: Li, Xinyi, et al.
Published: (2024)
by: Li, Xinyi, et al.
Published: (2024)
Improving Text Embeddings with Large Language Models
by: Wang, Liang, et al.
Published: (2023)
by: Wang, Liang, et al.
Published: (2023)
Learning to Retrieve In-Context Examples for Large Language Models
by: Wang, Liang, et al.
Published: (2023)
by: Wang, Liang, et al.
Published: (2023)
Large Language Models for Stemming: Promises, Pitfalls and Failures
by: Wang, Shuai, et al.
Published: (2024)
by: Wang, Shuai, et al.
Published: (2024)
Evaluating Large Language Models in Semantic Parsing for Conversational Question Answering over Knowledge Graphs
by: Schneider, Phillip, et al.
Published: (2024)
by: Schneider, Phillip, et al.
Published: (2024)
Self-Calibrated Listwise Reranking with Large Language Models
by: Ren, Ruiyang, et al.
Published: (2024)
by: Ren, Ruiyang, et al.
Published: (2024)
LogEval: A Comprehensive Benchmark Suite for Large Language Models In Log Analysis
by: Cui, Tianyu, et al.
Published: (2024)
by: Cui, Tianyu, et al.
Published: (2024)
Multimodal Misinformation Detection using Large Vision-Language Models
by: Tahmasebi, Sahar, et al.
Published: (2024)
by: Tahmasebi, Sahar, et al.
Published: (2024)
Large Language Model Empowered Recommendation Meets All-domain Continual Pre-Training
by: Ma, Haokai, et al.
Published: (2025)
by: Ma, Haokai, et al.
Published: (2025)
Leveraging Passage Embeddings for Efficient Listwise Reranking with Large Language Models
by: Liu, Qi, et al.
Published: (2024)
by: Liu, Qi, et al.
Published: (2024)
LLM-ESR: Large Language Models Enhancement for Long-tailed Sequential Recommendation
by: Liu, Qidong, et al.
Published: (2024)
by: Liu, Qidong, et al.
Published: (2024)
Collaborative Cross-modal Fusion with Large Language Model for Recommendation
by: Liu, Zhongzhou, et al.
Published: (2024)
by: Liu, Zhongzhou, et al.
Published: (2024)
ClarifyMT-Bench: Benchmarking and Improving Multi-Turn Clarification for Conversational Large Language Models
by: Luo, Sichun, et al.
Published: (2025)
by: Luo, Sichun, et al.
Published: (2025)
Large Language Models for Information Retrieval: A Survey
by: Zhu, Yutao, et al.
Published: (2023)
by: Zhu, Yutao, et al.
Published: (2023)
INTERS: Unlocking the Power of Large Language Models in Search with Instruction Tuning
by: Zhu, Yutao, et al.
Published: (2024)
by: Zhu, Yutao, et al.
Published: (2024)
Multi-Layer Ranking with Large Language Models for News Source Recommendation
by: Zhang, Wenjia, et al.
Published: (2024)
by: Zhang, Wenjia, et al.
Published: (2024)
Similar Items
-
Towards Unification of Hallucination Detection and Fact Verification for Large Language Models
by: Su, Weihang, et al.
Published: (2025) -
Mitigating Entity-Level Hallucination in Large Language Models
by: Su, Weihang, et al.
Published: (2024) -
Large Language Models as Evaluators for Recommendation Explanations
by: Zhang, Xiaoyu, et al.
Published: (2024) -
Conversational Recommender System and Large Language Model Are Made for Each Other in E-commerce Pre-sales Dialogue
by: Liu, Yuanxing, et al.
Published: (2023) -
Enhance Graph Alignment for Large Language Models
by: Luo, Haitong, et al.
Published: (2024)