Complementing Self-Consistency with Cross-Model Disagreement for Uncertainty Quantification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hamidieh, Kimia, Thost, Veronika, Gerych, Walter, Yurochkin, Mikhail, Ghassemi, Marzyeh |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Identifying Implicit Social Biases in Vision-Language Models
par: Hamidieh, Kimia, et autres
Publié: (2024)
par: Hamidieh, Kimia, et autres
Publié: (2024)
The MedPerturb Dataset: What Non-Content Perturbations Reveal About Human and Clinical LLM Decision Making
par: Gourabathina, Abinitha, et autres
Publié: (2025)
par: Gourabathina, Abinitha, et autres
Publié: (2025)
When Style Breaks Safety: Defending LLMs Against Superficial Style Alignment
par: Xiao, Yuxin, et autres
Publié: (2025)
par: Xiao, Yuxin, et autres
Publié: (2025)
BendVLM: Test-Time Debiasing of Vision-Language Embeddings
par: Gerych, Walter, et autres
Publié: (2024)
par: Gerych, Walter, et autres
Publié: (2024)
MaskMedPaint: Masked Medical Image Inpainting with Diffusion Models for Mitigation of Spurious Correlations
par: Jin, Qixuan, et autres
Publié: (2024)
par: Jin, Qixuan, et autres
Publié: (2024)
Views Can Be Deceiving: Improved SSL Through Feature Space Augmentation
par: Hamidieh, Kimia, et autres
Publié: (2024)
par: Hamidieh, Kimia, et autres
Publié: (2024)
Uncertainty Quantification via Stable Distribution Propagation
par: Petersen, Felix, et autres
Publié: (2024)
par: Petersen, Felix, et autres
Publié: (2024)
Self-Supervised Learning on Molecular Graphs: A Systematic Investigation of Masking Design
par: Yang, Jiannan, et autres
Publié: (2025)
par: Yang, Jiannan, et autres
Publié: (2025)
An Investigation of Memorization Risk in Healthcare Foundation Models
par: Tonekaboni, Sana, et autres
Publié: (2025)
par: Tonekaboni, Sana, et autres
Publié: (2025)
Data Debiasing with Datamodels (D3M): Improving Subgroup Robustness via Data Selection
par: Jain, Saachi, et autres
Publié: (2024)
par: Jain, Saachi, et autres
Publié: (2024)
Hedging and Non-Affirmation: Quantifying LLM Alignment on Questions of Human Rights
par: Javed, Rafiya, et autres
Publié: (2025)
par: Javed, Rafiya, et autres
Publié: (2025)
SFTMix: Elevating Language Model Instruction Tuning with Mixup Recipe
par: Xiao, Yuxin, et autres
Publié: (2024)
par: Xiao, Yuxin, et autres
Publié: (2024)
Adaptive Uncertainty Quantification for Generative AI
par: Kim, Jungeum, et autres
Publié: (2024)
par: Kim, Jungeum, et autres
Publié: (2024)
The Consistency Hypothesis in Uncertainty Quantification for Large Language Models
par: Xiao, Quan, et autres
Publié: (2025)
par: Xiao, Quan, et autres
Publié: (2025)
Speak Easy: Eliciting Harmful Jailbreaks from LLMs with Simple Interactions
par: Chan, Yik Siu, et autres
Publié: (2025)
par: Chan, Yik Siu, et autres
Publié: (2025)
Reaching Beyond the Mode: RL for Distributional Reasoning in Language Models
par: Puri, Isha, et autres
Publié: (2026)
par: Puri, Isha, et autres
Publié: (2026)
KScope: A Framework for Characterizing the Knowledge Status of Language Models
par: Xiao, Yuxin, et autres
Publié: (2025)
par: Xiao, Yuxin, et autres
Publié: (2025)
Cross-Model Disagreement as a Label-Free Correctness Signal
par: Gorbett, Matt, et autres
Publié: (2026)
par: Gorbett, Matt, et autres
Publié: (2026)
MOSAIC: Modeling Social AI for Content Dissemination and Regulation in Multi-Agent Simulations
par: Liu, Genglin, et autres
Publié: (2025)
par: Liu, Genglin, et autres
Publié: (2025)
Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding
par: Wang, Ziyao, et autres
Publié: (2025)
par: Wang, Ziyao, et autres
Publié: (2025)
SPRI: Aligning Large Language Models with Context-Situated Principles
par: Zhan, Hongli, et autres
Publié: (2025)
par: Zhan, Hongli, et autres
Publié: (2025)
GNN's Uncertainty Quantification using Self-Distillation
par: Daneshvar, Hirad, et autres
Publié: (2025)
par: Daneshvar, Hirad, et autres
Publié: (2025)
Semantic Consistency-Based Uncertainty Quantification for Factuality in Radiology Report Generation
par: Wang, Chenyu, et autres
Publié: (2024)
par: Wang, Chenyu, et autres
Publié: (2024)
Out-of-Distribution Detection using Synthetic Data Generation
par: Abbas, Momin, et autres
Publié: (2025)
par: Abbas, Momin, et autres
Publié: (2025)
Evolutionary Search for Automated Design of Uncertainty Quantification Methods
par: Seleznyov, Mikhail, et autres
Publié: (2026)
par: Seleznyov, Mikhail, et autres
Publié: (2026)
SCoOP: Semantic Consistent Opinion Pooling for Uncertainty Quantification in Multiple Vision-Language Model Systems
par: Yu, Chung-En Johnny, et autres
Publié: (2026)
par: Yu, Chung-En Johnny, et autres
Publié: (2026)
Self-Supervised Laplace Approximation for Bayesian Uncertainty Quantification
par: Rodemann, Julian, et autres
Publié: (2026)
par: Rodemann, Julian, et autres
Publié: (2026)
Learning under Temporal Label Noise
par: Nagaraj, Sujay, et autres
Publié: (2024)
par: Nagaraj, Sujay, et autres
Publié: (2024)
Sloth: scaling laws for LLM skills to predict multi-benchmark performance across families
par: Polo, Felipe Maia, et autres
Publié: (2024)
par: Polo, Felipe Maia, et autres
Publié: (2024)
ZeroShotOpt: Towards Zero-Shot Pretrained Models for Efficient Black-Box Optimization
par: Meindl, Jamison, et autres
Publié: (2025)
par: Meindl, Jamison, et autres
Publié: (2025)
Agentic Uncertainty Quantification
par: Zhang, Jiaxin, et autres
Publié: (2026)
par: Zhang, Jiaxin, et autres
Publié: (2026)
Towards Uncertainty Quantification in Generative Model Learning
par: Morales, Giorgio, et autres
Publié: (2025)
par: Morales, Giorgio, et autres
Publié: (2025)
Robust Uncertainty Quantification for Self-Evolving Large Language Models via Continual Domain Pretraining
par: Zhou, Xiaofan, et autres
Publié: (2025)
par: Zhou, Xiaofan, et autres
Publié: (2025)
Efficient Non-Parametric Uncertainty Quantification for Black-Box Large Language Models and Decision Planning
par: Tsai, Yao-Hung Hubert, et autres
Publié: (2024)
par: Tsai, Yao-Hung Hubert, et autres
Publié: (2024)
Weak Supervision Performance Evaluation via Partial Identification
par: Polo, Felipe Maia, et autres
Publié: (2023)
par: Polo, Felipe Maia, et autres
Publié: (2023)
EMoE: Training-Free Expert Disagreement for Uncertainty-Aware Text-to-Image Diffusion
par: Berry, Lucas, et autres
Publié: (2025)
par: Berry, Lucas, et autres
Publié: (2025)
SemanticOpt: Towards LLM-Based Semantic Black-Box Optimization
par: Meindl, Jamison, et autres
Publié: (2025)
par: Meindl, Jamison, et autres
Publié: (2025)
Conf-Gen: Conformal Uncertainty Quantification for Generative Models
par: Loaiza-Ganem, Gabriel, et autres
Publié: (2026)
par: Loaiza-Ganem, Gabriel, et autres
Publié: (2026)
Model-Agnostic Dynamic Feature Selection with Uncertainty Quantification
par: Fumanal-Idocin, Javier, et autres
Publié: (2025)
par: Fumanal-Idocin, Javier, et autres
Publié: (2025)
Uncertainty Quantification in the Tsetlin Machine
par: Helin, Runar, et autres
Publié: (2025)
par: Helin, Runar, et autres
Publié: (2025)
Documents similaires
-
Identifying Implicit Social Biases in Vision-Language Models
par: Hamidieh, Kimia, et autres
Publié: (2024) -
The MedPerturb Dataset: What Non-Content Perturbations Reveal About Human and Clinical LLM Decision Making
par: Gourabathina, Abinitha, et autres
Publié: (2025) -
When Style Breaks Safety: Defending LLMs Against Superficial Style Alignment
par: Xiao, Yuxin, et autres
Publié: (2025) -
BendVLM: Test-Time Debiasing of Vision-Language Embeddings
par: Gerych, Walter, et autres
Publié: (2024) -
MaskMedPaint: Masked Medical Image Inpainting with Diffusion Models for Mitigation of Spurious Correlations
par: Jin, Qixuan, et autres
Publié: (2024)