COIN: Uncertainty-Guarding Selective Question Answering for Foundation Models with Provable Risk Guarantees
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Zhiyuan, Duan, Jinhao, Wang, Qingni, Zhu, Xiaofeng, Chen, Tianlong, Shi, Xiaoshuang, Xu, Kaidi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SConU: Selective Conformal Uncertainty in Large Language Models
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2025)
ConU: Conformal Uncertainty in Large Language Models with Correctness Coverage Guarantees
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2024)
Word-Sequence Entropy: Towards Uncertainty Estimation in Free-Form Medical Question Answering Applications and Beyond
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2024)
LEC: Linear Expectation Constraints for Selection-Conditioned Risk Control in Selective Prediction and Routing Systems
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2025)
IUQ: Interrogative Uncertainty Quantification for Long-Form Large Language Model Generation
von: Fan, Haozhi, et al.
Veröffentlicht: (2026)
von: Fan, Haozhi, et al.
Veröffentlicht: (2026)
UProp: Investigating the Uncertainty Propagation of LLMs in Multi-Step Agentic Decision-Making
von: Duan, Jinhao, et al.
Veröffentlicht: (2025)
von: Duan, Jinhao, et al.
Veröffentlicht: (2025)
Sparse Neurons Carry Strong Signals of Question Ambiguity in LLMs
von: Zhang, Zhuoxuan, et al.
Veröffentlicht: (2025)
von: Zhang, Zhuoxuan, et al.
Veröffentlicht: (2025)
TruthPrInt: Mitigating Large Vision-Language Models Object Hallucination Via Latent Truthful-Guided Pre-Intervention
von: Duan, Jinhao, et al.
Veröffentlicht: (2025)
von: Duan, Jinhao, et al.
Veröffentlicht: (2025)
LRR-Bench: Left, Right or Rotate? Vision-Language models Still Struggle With Spatial Understanding Tasks
von: Kong, Fei, et al.
Veröffentlicht: (2025)
von: Kong, Fei, et al.
Veröffentlicht: (2025)
Shifting Attention to Relevance: Towards the Predictive Uncertainty Quantification of Free-Form Large Language Models
von: Duan, Jinhao, et al.
Veröffentlicht: (2023)
von: Duan, Jinhao, et al.
Veröffentlicht: (2023)
Conformal Sets in Multiple-Choice Question Answering under Black-Box Settings with Provable Coverage Guarantees
von: Yang, Guang, et al.
Veröffentlicht: (2025)
von: Yang, Guang, et al.
Veröffentlicht: (2025)
Sample then Identify: A General Framework for Risk Control and Assessment in Multimodal Large Language Models
von: Wang, Qingni, et al.
Veröffentlicht: (2024)
von: Wang, Qingni, et al.
Veröffentlicht: (2024)
Conformal P-Value in Multiple-Choice Question Answering Tasks with Provable Risk Control
von: Ye, Yuanchang
Veröffentlicht: (2025)
von: Ye, Yuanchang
Veröffentlicht: (2025)
Conformal Lesion Segmentation for 3D Medical Images
von: Tan, Binyu, et al.
Veröffentlicht: (2025)
von: Tan, Binyu, et al.
Veröffentlicht: (2025)
CALM: Unleashing the Cross-Lingual Self-Aligning Ability of Language Model Question Answering
von: Wang, Yumeng, et al.
Veröffentlicht: (2025)
von: Wang, Yumeng, et al.
Veröffentlicht: (2025)
On the Limitations of Rank-One Model Editing in Answering Multi-hop Questions
von: He, Zhiyuan, et al.
Veröffentlicht: (2026)
von: He, Zhiyuan, et al.
Veröffentlicht: (2026)
MiRD: Reliable Set-Valued Prediction for Open-Ended Question Answering via Miscoverage Risk Decomposition
von: Hu, Anqi, et al.
Veröffentlicht: (2026)
von: Hu, Anqi, et al.
Veröffentlicht: (2026)
ACT-Diffusion: Efficient Adversarial Consistency Training for One-step Diffusion Models
von: Kong, Fei, et al.
Veröffentlicht: (2023)
von: Kong, Fei, et al.
Veröffentlicht: (2023)
DRESSing Up LLM: Efficient Stylized Question-Answering via Style Subspace Editing
von: Ma, Xinyu, et al.
Veröffentlicht: (2025)
von: Ma, Xinyu, et al.
Veröffentlicht: (2025)
DynaCode: A Dynamic Complexity-Aware Code Benchmark for Evaluating Large Language Models in Code Generation
von: Hu, Wenhao, et al.
Veröffentlicht: (2025)
von: Hu, Wenhao, et al.
Veröffentlicht: (2025)
Caterpillar: A Pure-MLP Architecture with Shifted-Pillars-Concatenation
von: Sun, Jin, et al.
Veröffentlicht: (2023)
von: Sun, Jin, et al.
Veröffentlicht: (2023)
GTBench: Uncovering the Strategic Reasoning Limitations of LLMs via Game-Theoretic Evaluations
von: Duan, Jinhao, et al.
Veröffentlicht: (2024)
von: Duan, Jinhao, et al.
Veröffentlicht: (2024)
BELLE: A Bi-Level Multi-Agent Reasoning Framework for Multi-Hop Question Answering
von: Zhang, Taolin, et al.
Veröffentlicht: (2025)
von: Zhang, Taolin, et al.
Veröffentlicht: (2025)
Uncertainty Quantification in Retrieval Augmented Question Answering
von: Perez-Beltrachini, Laura, et al.
Veröffentlicht: (2025)
von: Perez-Beltrachini, Laura, et al.
Veröffentlicht: (2025)
AMATA: Adaptive Multi-Agent Trajectory Alignment for Knowledge-Intensive Question Answering
von: Zhang, Taolin, et al.
Veröffentlicht: (2026)
von: Zhang, Taolin, et al.
Veröffentlicht: (2026)
MULTITAT: Benchmarking Multilingual Table-and-Text Question Answering
von: Zhang, Xuanliang, et al.
Veröffentlicht: (2025)
von: Zhang, Xuanliang, et al.
Veröffentlicht: (2025)
Uncertainty Estimation of Large Language Models in Medical Question Answering
von: Wu, Jiaxin, et al.
Veröffentlicht: (2024)
von: Wu, Jiaxin, et al.
Veröffentlicht: (2024)
Exploring Hybrid Question Answering via Program-based Prompting
von: Shi, Qi, et al.
Veröffentlicht: (2024)
von: Shi, Qi, et al.
Veröffentlicht: (2024)
Evaluating Large Language Models for Evidence-Based Clinical Question Answering
von: Wang, Can, et al.
Veröffentlicht: (2025)
von: Wang, Can, et al.
Veröffentlicht: (2025)
Question Calibration and Multi-Hop Modeling for Temporal Question Answering
von: Xue, Chao, et al.
Veröffentlicht: (2024)
von: Xue, Chao, et al.
Veröffentlicht: (2024)
Uncertainty as Feature Gaps: Epistemic Uncertainty Quantification of LLMs in Contextual Question-Answering
von: Bakman, Yavuz, et al.
Veröffentlicht: (2025)
von: Bakman, Yavuz, et al.
Veröffentlicht: (2025)
MedHallu: A Comprehensive Benchmark for Detecting Medical Hallucinations in Large Language Models
von: Pandit, Shrey, et al.
Veröffentlicht: (2025)
von: Pandit, Shrey, et al.
Veröffentlicht: (2025)
Continual Learning for Temporal-Sensitive Question Answering
von: Yang, Wanqi, et al.
Veröffentlicht: (2024)
von: Yang, Wanqi, et al.
Veröffentlicht: (2024)
Selectively Answering Visual Questions
von: Eisenschlos, Julian Martin, et al.
Veröffentlicht: (2024)
von: Eisenschlos, Julian Martin, et al.
Veröffentlicht: (2024)
How Accurate Are LLMs at Multi-Question Answering on Conversational Transcripts?
von: Zhu, Xiliang, et al.
Veröffentlicht: (2025)
von: Zhu, Xiliang, et al.
Veröffentlicht: (2025)
Benchmarking Large Language Models for Conversational Question Answering in Multi-instructional Documents
von: Wu, Shiwei, et al.
Veröffentlicht: (2024)
von: Wu, Shiwei, et al.
Veröffentlicht: (2024)
Positional Bias in Binary Question Answering: How Uncertainty Shapes Model Preferences
von: Labruna, Tiziano, et al.
Veröffentlicht: (2025)
von: Labruna, Tiziano, et al.
Veröffentlicht: (2025)
Towards Building a Robust Knowledge Intensive Question Answering Model with Large Language Models
von: Hong, Xingyun, et al.
Veröffentlicht: (2024)
von: Hong, Xingyun, et al.
Veröffentlicht: (2024)
Retrieval-Augmented Generation with Knowledge Graphs for Customer Service Question Answering
von: Xu, Zhentao, et al.
Veröffentlicht: (2024)
von: Xu, Zhentao, et al.
Veröffentlicht: (2024)
Mind the Ambiguity: Aleatoric Uncertainty Quantification in LLMs for Safe Medical Question Answering
von: Liu, Yaokun, et al.
Veröffentlicht: (2026)
von: Liu, Yaokun, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
SConU: Selective Conformal Uncertainty in Large Language Models
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2025) -
ConU: Conformal Uncertainty in Large Language Models with Correctness Coverage Guarantees
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2024) -
Word-Sequence Entropy: Towards Uncertainty Estimation in Free-Form Medical Question Answering Applications and Beyond
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2024) -
LEC: Linear Expectation Constraints for Selection-Conditioned Risk Control in Selective Prediction and Routing Systems
von: Wang, Zhiyuan, et al.
Veröffentlicht: (2025) -
IUQ: Interrogative Uncertainty Quantification for Long-Form Large Language Model Generation
von: Fan, Haozhi, et al.
Veröffentlicht: (2026)