Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Xiong, Guangzhi, Xie, Eric, Williams, Corey, Kim, Myles, Shariatmadari, Amir Hassan, Guo, Sikun, Bekiranov, Stefan, Zhang, Aidong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Scientific Hypothesis Generation with Knowledge Grounded Large Language Models
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
IdeaBench: Benchmarking Large Language Models for Research Idea Generation
di: Guo, Sikun, et al.
Pubblicazione: (2024)
di: Guo, Sikun, et al.
Pubblicazione: (2024)
COCO-Tree: Compositional Hierarchical Concept Trees for Enhanced Reasoning in Vision Language Models
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
Structural Causality-based Generalizable Concept Discovery Models
di: Sinha, Sanchit, et al.
Pubblicazione: (2024)
di: Sinha, Sanchit, et al.
Pubblicazione: (2024)
ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
CoLiDR: Concept Learning using Aggregated Disentangled Representations
di: Sinha, Sanchit, et al.
Pubblicazione: (2024)
di: Sinha, Sanchit, et al.
Pubblicazione: (2024)
Neural Additive Experts: Context-Gated Experts for Controllable Model Additivity
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
A Self-explaining Neural Architecture for Generalizable Concept Learning
di: Sinha, Sanchit, et al.
Pubblicazione: (2024)
di: Sinha, Sanchit, et al.
Pubblicazione: (2024)
ProtoNAM: Prototypical Neural Additive Models for Interpretable Deep Tabular Learning
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
Reasoning Beyond Chain-of-Thought: A Latent Computational Mode in Large Language Models
di: He, Zhenghao, et al.
Pubblicazione: (2026)
di: He, Zhenghao, et al.
Pubblicazione: (2026)
Rethinking Visual Attribution for Chest X-ray Reasoning in Large Vision Language Models
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
Attention-guided Fine-tuning of Multimodal Large Language Models Improves Chain-of-Thought Reasoning
di: Sinha, Sanchit, et al.
Pubblicazione: (2026)
di: Sinha, Sanchit, et al.
Pubblicazione: (2026)
Concept-RuleNet: Grounded Multi-Agent Neurosymbolic Reasoning in Vision Language Models
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
The Geometry of Truth: Layer-wise Semantic Dynamics for Hallucination Detection in Large Language Models
di: Mir, Amir Hameed
Pubblicazione: (2025)
di: Mir, Amir Hameed
Pubblicazione: (2025)
Toward Faithful Retrieval-Augmented Generation with Sparse Autoencoders
di: Xiong, Guangzhi, et al.
Pubblicazione: (2025)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2025)
GCAV: A Global Concept Activation Vector Framework for Cross-Layer Consistency in Interpretability
di: He, Zhenghao, et al.
Pubblicazione: (2025)
di: He, Zhenghao, et al.
Pubblicazione: (2025)
Retrieving Counterfactuals Improves Visual In-Context Learning
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
Benchmarking Retrieval-Augmented Generation for Medicine
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
Implementing the Koopman-von Neumann approach on continuous-variable photonic quantum computers
di: Gao, Xinfeng, et al.
Pubblicazione: (2025)
di: Gao, Xinfeng, et al.
Pubblicazione: (2025)
Towards Reliable Truth-Aligned Uncertainty Estimation in Large Language Models
di: Srey, Ponhvoan, et al.
Pubblicazione: (2026)
di: Srey, Ponhvoan, et al.
Pubblicazione: (2026)
TruthX: Alleviating Hallucinations by Editing Large Language Models in Truthful Space
di: Zhang, Shaolei, et al.
Pubblicazione: (2024)
di: Zhang, Shaolei, et al.
Pubblicazione: (2024)
SlideBot: A Multi-Agent Framework for Generating Informative, Reliable, Multi-Modal Presentations
di: Xie, Eric, et al.
Pubblicazione: (2025)
di: Xie, Eric, et al.
Pubblicazione: (2025)
Hallucination to Truth: A Review of Fact-Checking and Factuality Evaluation in Large Language Models
di: Rahman, Subhey Sadi, et al.
Pubblicazione: (2025)
di: Rahman, Subhey Sadi, et al.
Pubblicazione: (2025)
CASL: Concept-Aligned Sparse Latents for Interpreting Diffusion Models
di: He, Zhenghao, et al.
Pubblicazione: (2026)
di: He, Zhenghao, et al.
Pubblicazione: (2026)
The Truthfulness Spectrum Hypothesis
di: Ying, Zhuofan Josh, et al.
Pubblicazione: (2026)
di: Ying, Zhuofan Josh, et al.
Pubblicazione: (2026)
The Lattice Representation Hypothesis of Large Language Models
di: Xiong, Bo
Pubblicazione: (2026)
di: Xiong, Bo
Pubblicazione: (2026)
TruthEval: A Dataset to Evaluate LLM Truthfulness and Reliability
di: Khatun, Aisha, et al.
Pubblicazione: (2024)
di: Khatun, Aisha, et al.
Pubblicazione: (2024)
Towards Lightweight Reliability: Using Soft Prompts for Hallucination Mitigation in Large Language Models
di: Siddiqui, S M Tahmid, et al.
Pubblicazione: (2026)
di: Siddiqui, S M Tahmid, et al.
Pubblicazione: (2026)
Improving Retrieval-Augmented Generation in Medicine with Iterative Follow-up Questions
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
Uhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African Languages
di: Bayes, Edward, et al.
Pubblicazione: (2024)
di: Bayes, Edward, et al.
Pubblicazione: (2024)
MedCite: Can Language Models Generate Verifiable Text for Medicine?
di: Wang, Xiao, et al.
Pubblicazione: (2025)
di: Wang, Xiao, et al.
Pubblicazione: (2025)
TruthPrInt: Mitigating Large Vision-Language Models Object Hallucination Via Latent Truthful-Guided Pre-Intervention
di: Duan, Jinhao, et al.
Pubblicazione: (2025)
di: Duan, Jinhao, et al.
Pubblicazione: (2025)
Advancing the Scientific Method with Large Language Models: From Hypothesis to Discovery
di: Zhang, Yanbo, et al.
Pubblicazione: (2025)
di: Zhang, Yanbo, et al.
Pubblicazione: (2025)
Towards a Systematic Evaluation of Hallucinations in Large-Vision Language Models
di: Seth, Ashish, et al.
Pubblicazione: (2024)
di: Seth, Ashish, et al.
Pubblicazione: (2024)
Towards Reliable Evaluation of Large Language Models for Multilingual and Multimodal E-Commerce Applications
di: Xie, Shuyi, et al.
Pubblicazione: (2025)
di: Xie, Shuyi, et al.
Pubblicazione: (2025)
A Survey on Hypothesis Generation for Scientific Discovery in the Era of Large Language Models
di: Alkan, Atilla Kaan, et al.
Pubblicazione: (2025)
di: Alkan, Atilla Kaan, et al.
Pubblicazione: (2025)
Towards Reliable Large Audio Language Model
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
Audio Hallucination Attacks: Probing the Reliability of Large Audio Language Models
di: Seth, Ashish, et al.
Pubblicazione: (2026)
di: Seth, Ashish, et al.
Pubblicazione: (2026)
Hallucination Detection: Robustly Discerning Reliable Answers in Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
xFinder: Large Language Models as Automated Evaluators for Reliable Evaluation
di: Yu, Qingchen, et al.
Pubblicazione: (2024)
di: Yu, Qingchen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Improving Scientific Hypothesis Generation with Knowledge Grounded Large Language Models
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024) -
IdeaBench: Benchmarking Large Language Models for Research Idea Generation
di: Guo, Sikun, et al.
Pubblicazione: (2024) -
COCO-Tree: Compositional Hierarchical Concept Trees for Enhanced Reasoning in Vision Language Models
di: Sinha, Sanchit, et al.
Pubblicazione: (2025) -
Structural Causality-based Generalizable Concept Discovery Models
di: Sinha, Sanchit, et al.
Pubblicazione: (2024) -
ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)