Benchmarking Large Language Model Uncertainty for Prompt Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Pei-Fu, Tsai, Yun-Da, Lin, Shou-De |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Uncertainty Profiles for LLMs: Uncertainty Source Decomposition and Adaptive Model-Metric Selection
di: Guo, Pei-Fu, et al.
Pubblicazione: (2025)
di: Guo, Pei-Fu, et al.
Pubblicazione: (2025)
Towards Optimizing with Large Language Models
di: Guo, Pei-Fu, et al.
Pubblicazione: (2023)
di: Guo, Pei-Fu, et al.
Pubblicazione: (2023)
Generalizing Large Language Model Usability Across Resource-Constrained
di: Tsai, Yun-Da
Pubblicazione: (2025)
di: Tsai, Yun-Da
Pubblicazione: (2025)
Text-centric Alignment for Multi-Modality Learning
di: Tsai, Yun-Da, et al.
Pubblicazione: (2024)
di: Tsai, Yun-Da, et al.
Pubblicazione: (2024)
Enhance the Robustness of Text-Centric Multimodal Alignments
di: Yen, Ting-Yu, et al.
Pubblicazione: (2024)
di: Yen, Ting-Yu, et al.
Pubblicazione: (2024)
Prompt-Dependent Ranking of Large Language Models with Uncertainty Quantification
di: Menendez, Angel Rodrigo Avelar, et al.
Pubblicazione: (2026)
di: Menendez, Angel Rodrigo Avelar, et al.
Pubblicazione: (2026)
CLUE: Concept-Level Uncertainty Estimation for Large Language Models
di: Wang, Yu-Hsiang, et al.
Pubblicazione: (2024)
di: Wang, Yu-Hsiang, et al.
Pubblicazione: (2024)
Adaptive Prompt Structure Factorization: A Framework for Self-Discovering and Optimizing Compositional Prompt Programs
di: Liu, Haoyue, et al.
Pubblicazione: (2026)
di: Liu, Haoyue, et al.
Pubblicazione: (2026)
Understanding the Relationship between Prompts and Response Uncertainty in Large Language Models
di: Zhang, Ze Yu, et al.
Pubblicazione: (2024)
di: Zhang, Ze Yu, et al.
Pubblicazione: (2024)
Unraveling Arithmetic in Large Language Models: The Role of Algebraic Structures
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
Beyond Facts: Benchmarking Distributional Reading Comprehension in Large Language Models
di: Guo, Pei-Fu, et al.
Pubblicazione: (2026)
di: Guo, Pei-Fu, et al.
Pubblicazione: (2026)
Benchmarking Uncertainty Quantification Methods for Large Language Models with LM-Polygraph
di: Vashurin, Roman, et al.
Pubblicazione: (2024)
di: Vashurin, Roman, et al.
Pubblicazione: (2024)
Benchmarking Uncertainty Calibration in Large Language Model Long-Form Question Answering
di: Müller, Philip, et al.
Pubblicazione: (2026)
di: Müller, Philip, et al.
Pubblicazione: (2026)
Large Language Model Prompt Datasets: An In-depth Analysis and Insights
di: Zhang, Yuanming, et al.
Pubblicazione: (2025)
di: Zhang, Yuanming, et al.
Pubblicazione: (2025)
Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models
di: Lin, Zhen, et al.
Pubblicazione: (2023)
di: Lin, Zhen, et al.
Pubblicazione: (2023)
Uncertainty Awareness of Large Language Models Under Code Distribution Shifts: A Benchmark Study
di: Li, Yufei, et al.
Pubblicazione: (2024)
di: Li, Yufei, et al.
Pubblicazione: (2024)
Efficient Non-Parametric Uncertainty Quantification for Black-Box Large Language Models and Decision Planning
di: Tsai, Yao-Hung Hubert, et al.
Pubblicazione: (2024)
di: Tsai, Yao-Hung Hubert, et al.
Pubblicazione: (2024)
GLaPE: Gold Label-agnostic Prompt Evaluation and Optimization for Large Language Model
di: Zhang, Xuanchang, et al.
Pubblicazione: (2024)
di: Zhang, Xuanchang, et al.
Pubblicazione: (2024)
Transferable Embedding Inversion Attack: Uncovering Privacy Risks in Text Embeddings without Model Queries
di: Huang, Yu-Hsiang, et al.
Pubblicazione: (2024)
di: Huang, Yu-Hsiang, et al.
Pubblicazione: (2024)
Automatic Prompt Selection for Large Language Models
di: Do, Viet-Tung, et al.
Pubblicazione: (2024)
di: Do, Viet-Tung, et al.
Pubblicazione: (2024)
Beyond the Prompt in Large Language Models: Comprehension, In-Context Learning, and Chain-of-Thought
di: Jiao, Yuling, et al.
Pubblicazione: (2026)
di: Jiao, Yuling, et al.
Pubblicazione: (2026)
An Examination on the Effectiveness of Divide-and-Conquer Prompting in Large Language Models
di: Zhang, Yizhou, et al.
Pubblicazione: (2024)
di: Zhang, Yizhou, et al.
Pubblicazione: (2024)
Decoding Uncertainty: The Impact of Decoding Strategies for Uncertainty Estimation in Large Language Models
di: Hashimoto, Wataru, et al.
Pubblicazione: (2025)
di: Hashimoto, Wataru, et al.
Pubblicazione: (2025)
JoPA:Explaining Large Language Model's Generation via Joint Prompt Attribution
di: Chang, Yurui, et al.
Pubblicazione: (2024)
di: Chang, Yurui, et al.
Pubblicazione: (2024)
DeLLMa: Decision Making Under Uncertainty with Large Language Models
di: Liu, Ollie, et al.
Pubblicazione: (2024)
di: Liu, Ollie, et al.
Pubblicazione: (2024)
Uncertainty Quantification for In-Context Learning of Large Language Models
di: Ling, Chen, et al.
Pubblicazione: (2024)
di: Ling, Chen, et al.
Pubblicazione: (2024)
PMPO: Probabilistic Metric Prompt Optimization for Small and Large Language Models
di: Zhao, Chenzhuo, et al.
Pubblicazione: (2025)
di: Zhao, Chenzhuo, et al.
Pubblicazione: (2025)
Uncertainty-Aware Explainable Recommendation with Large Language Models
di: Peng, Yicui, et al.
Pubblicazione: (2024)
di: Peng, Yicui, et al.
Pubblicazione: (2024)
PromptCoT 2.0: Scaling Prompt Synthesis for Large Language Model Reasoning
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
Testing Uncertainty of Large Language Models for Physics Knowledge and Reasoning
di: Reganova, Elizaveta, et al.
Pubblicazione: (2024)
di: Reganova, Elizaveta, et al.
Pubblicazione: (2024)
FERA: Uncertainty-Aware Federated Reasoning for Large Language Models
di: Wang, Ruhan, et al.
Pubblicazione: (2026)
di: Wang, Ruhan, et al.
Pubblicazione: (2026)
Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and Beyond
di: Wang, Xinyu, et al.
Pubblicazione: (2024)
di: Wang, Xinyu, et al.
Pubblicazione: (2024)
Prompting Large Language Models for Clinical Temporal Relation Extraction
di: He, Jianping, et al.
Pubblicazione: (2024)
di: He, Jianping, et al.
Pubblicazione: (2024)
Bias after Prompting: Persistent Discrimination in Large Language Models
di: Sivakumar, Nivedha, et al.
Pubblicazione: (2025)
di: Sivakumar, Nivedha, et al.
Pubblicazione: (2025)
Prompting Large Language Models to Detect Dementia Family Caregivers
di: Biswas, Md Badsha, et al.
Pubblicazione: (2025)
di: Biswas, Md Badsha, et al.
Pubblicazione: (2025)
Progressive-Hint Prompting Improves Reasoning in Large Language Models
di: Zheng, Chuanyang, et al.
Pubblicazione: (2023)
di: Zheng, Chuanyang, et al.
Pubblicazione: (2023)
Quantifying Uncertainty in Natural Language Explanations of Large Language Models for Question Answering
di: Li, Yangyi, et al.
Pubblicazione: (2025)
di: Li, Yangyi, et al.
Pubblicazione: (2025)
HiDe-LLaVA: Hierarchical Decoupling for Continual Instruction Tuning of Multimodal Large Language Model
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
Multimodal Clinical Trial Outcome Prediction with Large Language Models
di: Zheng, Wenhao, et al.
Pubblicazione: (2024)
di: Zheng, Wenhao, et al.
Pubblicazione: (2024)
Mitigating Geospatial Knowledge Hallucination in Large Language Models: Benchmarking and Dynamic Factuality Aligning
di: Wang, Shengyuan, et al.
Pubblicazione: (2025)
di: Wang, Shengyuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Uncertainty Profiles for LLMs: Uncertainty Source Decomposition and Adaptive Model-Metric Selection
di: Guo, Pei-Fu, et al.
Pubblicazione: (2025) -
Towards Optimizing with Large Language Models
di: Guo, Pei-Fu, et al.
Pubblicazione: (2023) -
Generalizing Large Language Model Usability Across Resource-Constrained
di: Tsai, Yun-Da
Pubblicazione: (2025) -
Text-centric Alignment for Multi-Modality Learning
di: Tsai, Yun-Da, et al.
Pubblicazione: (2024) -
Enhance the Robustness of Text-Centric Multimodal Alignments
di: Yen, Ting-Yu, et al.
Pubblicazione: (2024)