Can Multiple Responses from an LLM Reveal the Sources of Its Uncertainty?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nan, Yang, He, Pengfei, Tandon, Ravi, Xu, Han |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TRUEBench: Can LLM Response Meet Real-world Constraints as Productivity Assistant?
par: Park, Jiho, et autres
Publié: (2025)
par: Park, Jiho, et autres
Publié: (2025)
Can Language Models Follow Multiple Turns of Entangled Instructions?
par: Han, Chi, et autres
Publié: (2025)
par: Han, Chi, et autres
Publié: (2025)
Distilling Closed-Source LLM's Knowledge for Locally Stable and Economic Biomedical Entity Linking
par: Ai, Yihao, et autres
Publié: (2025)
par: Ai, Yihao, et autres
Publié: (2025)
Can Large Language Models Express Uncertainty Like Human?
par: Tao, Linwei, et autres
Publié: (2025)
par: Tao, Linwei, et autres
Publié: (2025)
Mapping Clinical Doubt: Locating Linguistic Uncertainty in LLMs
par: Sridhar, Srivarshinee, et autres
Publié: (2025)
par: Sridhar, Srivarshinee, et autres
Publié: (2025)
The Alignment Tax: Response Homogenization in Aligned LLMs and Its Implications for Uncertainty Estimation
par: Liu, Mingyi
Publié: (2026)
par: Liu, Mingyi
Publié: (2026)
LLM The Genius Paradox: A Linguistic and Math Expert's Struggle with Simple Word-based Counting Problems
par: Xu, Nan, et autres
Publié: (2024)
par: Xu, Nan, et autres
Publié: (2024)
LLM-based Schema-Guided Extraction and Validation of Missing-Person Intelligence from Heterogeneous Data Sources
par: Castillo, Joshua, et autres
Publié: (2026)
par: Castillo, Joshua, et autres
Publié: (2026)
Improving Entity Recognition Using Ensembles of Deep Learning and Fine-tuned Large Language Models: A Case Study on Adverse Event Extraction from Multiple Sources
par: Li, Yiming, et autres
Publié: (2024)
par: Li, Yiming, et autres
Publié: (2024)
Pretrained LLMs Learn Multiple Types of Uncertainty
par: Cohen, Roi, et autres
Publié: (2025)
par: Cohen, Roi, et autres
Publié: (2025)
Estimating LLM Uncertainty with Evidence
par: Ma, Huan, et autres
Publié: (2025)
par: Ma, Huan, et autres
Publié: (2025)
Unlocking the Power of LLM Uncertainty for Active In-Context Example Selection
par: Huang, Hsiu-Yuan, et autres
Publié: (2024)
par: Huang, Hsiu-Yuan, et autres
Publié: (2024)
RepreGuard: Detecting LLM-Generated Text by Revealing Hidden Representation Patterns
par: Chen, Xin, et autres
Publié: (2025)
par: Chen, Xin, et autres
Publié: (2025)
LLM Augmentations to support Analytical Reasoning over Multiple Documents
par: Yousuf, Raquib Bin, et autres
Publié: (2024)
par: Yousuf, Raquib Bin, et autres
Publié: (2024)
Lynx: An Open Source Hallucination Evaluation Model
par: Ravi, Selvan Sunitha, et autres
Publié: (2024)
par: Ravi, Selvan Sunitha, et autres
Publié: (2024)
How Trustworthy Are LLM-as-Judge Ratings for Interpretive Responses? Implications for Qualitative Research Workflows
par: Han, Songhee, et autres
Publié: (2026)
par: Han, Songhee, et autres
Publié: (2026)
Can We Trust LLM Detectors?
par: Sandhan, Jivnesh, et autres
Publié: (2026)
par: Sandhan, Jivnesh, et autres
Publié: (2026)
Small Language Model Can Self-correct
par: Han, Haixia, et autres
Publié: (2024)
par: Han, Haixia, et autres
Publié: (2024)
LLM-REVal: Can We Trust LLM Reviewers Yet?
par: Li, Rui, et autres
Publié: (2025)
par: Li, Rui, et autres
Publié: (2025)
Can Brain Signals Reveal Inner Alignment with Human Languages?
par: Han, William, et autres
Publié: (2022)
par: Han, William, et autres
Publié: (2022)
SurveyEval: Towards Comprehensive Evaluation of LLM-Generated Academic Surveys
par: Zhao, Jiahao, et autres
Publié: (2025)
par: Zhao, Jiahao, et autres
Publié: (2025)
Structured Uncertainty guided Clarification for LLM Agents
par: Suri, Manan, et autres
Publié: (2025)
par: Suri, Manan, et autres
Publié: (2025)
Can LLM Agents Generate Real-World Evidence? Evaluating Observational Studies in Medical Databases
par: Li, Dubai, et autres
Publié: (2026)
par: Li, Dubai, et autres
Publié: (2026)
LawGPT: Knowledge-Guided Data Generation and Its Application to Legal LLM
par: Zhou, Zhi, et autres
Publié: (2025)
par: Zhou, Zhi, et autres
Publié: (2025)
LoRTA: Low Rank Tensor Adaptation of Large Language Models
par: Hounie, Ignacio, et autres
Publié: (2024)
par: Hounie, Ignacio, et autres
Publié: (2024)
Can GNN be Good Adapter for LLMs?
par: Huang, Xuanwen, et autres
Publié: (2024)
par: Huang, Xuanwen, et autres
Publié: (2024)
Can LLMs Detect Their Confabulations? Estimating Reliability in Uncertainty-Aware Language Models
par: Zhou, Tianyi, et autres
Publié: (2025)
par: Zhou, Tianyi, et autres
Publié: (2025)
Can abstract concepts from LLM improve SLM performance?
par: Tandon, Siddharth
Publié: (2025)
par: Tandon, Siddharth
Publié: (2025)
AdaSkip: Adaptive Sublayer Skipping for Accelerating Long-Context LLM Inference
par: He, Zhuomin, et autres
Publié: (2025)
par: He, Zhuomin, et autres
Publié: (2025)
LLM should think and action as a human
par: Leung, Haun, et autres
Publié: (2025)
par: Leung, Haun, et autres
Publié: (2025)
Parameter Efficient Instruction Tuning: An Empirical Study
par: He, Pengfei
Publié: (2024)
par: He, Pengfei
Publié: (2024)
Can Large Language Models be Trusted for Evaluation? Scalable Meta-Evaluation of LLMs as Evaluators via Agent Debate
par: Chern, Steffi, et autres
Publié: (2024)
par: Chern, Steffi, et autres
Publié: (2024)
If an LLM Were a Character, Would It Know Its Own Story? Evaluating Lifelong Learning in LLMs
par: Fan, Siqi, et autres
Publié: (2025)
par: Fan, Siqi, et autres
Publié: (2025)
Can Language Models Solve Graph Problems in Natural Language?
par: Wang, Heng, et autres
Publié: (2023)
par: Wang, Heng, et autres
Publié: (2023)
How Much Can RAG Help the Reasoning of LLM?
par: Liu, Jingyu, et autres
Publié: (2024)
par: Liu, Jingyu, et autres
Publié: (2024)
7B Fully Open Source Moxin-LLM/VLM -- From Pretraining to GRPO-based Reinforcement Learning Enhancement
par: Zhao, Pu, et autres
Publié: (2024)
par: Zhao, Pu, et autres
Publié: (2024)
Can We Verify Step by Step for Incorrect Answer Detection?
par: Xu, Xin, et autres
Publié: (2024)
par: Xu, Xin, et autres
Publié: (2024)
Harvesting Events from Multiple Sources: Towards a Cross-Document Event Extraction Paradigm
par: Gao, Qiang, et autres
Publié: (2024)
par: Gao, Qiang, et autres
Publié: (2024)
"I know myself better, but not really greatly": How Well Can LLMs Detect and Explain LLM-Generated Texts?
par: Ji, Jiazhou, et autres
Publié: (2025)
par: Ji, Jiazhou, et autres
Publié: (2025)
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
par: Gou, Zhibin, et autres
Publié: (2023)
par: Gou, Zhibin, et autres
Publié: (2023)
Documents similaires
-
TRUEBench: Can LLM Response Meet Real-world Constraints as Productivity Assistant?
par: Park, Jiho, et autres
Publié: (2025) -
Can Language Models Follow Multiple Turns of Entangled Instructions?
par: Han, Chi, et autres
Publié: (2025) -
Distilling Closed-Source LLM's Knowledge for Locally Stable and Economic Biomedical Entity Linking
par: Ai, Yihao, et autres
Publié: (2025) -
Can Large Language Models Express Uncertainty Like Human?
par: Tao, Linwei, et autres
Publié: (2025) -
Mapping Clinical Doubt: Locating Linguistic Uncertainty in LLMs
par: Sridhar, Srivarshinee, et autres
Publié: (2025)