Multi-Agent Reasoning with Consistency Verification Improves Uncertainty Calibration in Medical MCQA
Fuente:
arXiv
Salvato in:
| Autore principale: | Martinez, John Ray B. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Finding the Cracks: Improving LLMs Reasoning with Paraphrastic Probing and Consistency Verification
di: Shi, Weili, et al.
Pubblicazione: (2026)
di: Shi, Weili, et al.
Pubblicazione: (2026)
Think Consistently, Reason Efficiently: Energy-Based Calibration for Implicit Chain-of-Thought
di: Chen, Zhikang, et al.
Pubblicazione: (2025)
di: Chen, Zhikang, et al.
Pubblicazione: (2025)
Self-Training Meets Consistency: Improving LLMs' Reasoning with Consistency-Driven Rationale Evaluation
di: Lee, Jaehyeok, et al.
Pubblicazione: (2024)
di: Lee, Jaehyeok, et al.
Pubblicazione: (2024)
Soft Self-Consistency Improves Language Model Agents
di: Wang, Han, et al.
Pubblicazione: (2024)
di: Wang, Han, et al.
Pubblicazione: (2024)
Introducing Verification Task of Set Consistency with Set-Consistency Energy Networks
di: Song, Mooho, et al.
Pubblicazione: (2025)
di: Song, Mooho, et al.
Pubblicazione: (2025)
TinyV: Reducing False Negatives in Verification Improves RL for LLM Reasoning
di: Xu, Zhangchen, et al.
Pubblicazione: (2025)
di: Xu, Zhangchen, et al.
Pubblicazione: (2025)
Black-Box Reliability Certification for AI Agents via Self-Consistency Sampling and Conformal Calibration
di: Mouzouni, Charafeddine
Pubblicazione: (2026)
di: Mouzouni, Charafeddine
Pubblicazione: (2026)
MAVEN: Multi-Agent Verification-Elaboration Network with In-Step Epistemic Auditing
di: Yao, Yinsheng, et al.
Pubblicazione: (2026)
di: Yao, Yinsheng, et al.
Pubblicazione: (2026)
Improving LLM Code Reasoning via Semantic Equivalence Self-Play with Formal Verification
di: Barone, Antonio Valerio Miceli, et al.
Pubblicazione: (2026)
di: Barone, Antonio Valerio Miceli, et al.
Pubblicazione: (2026)
Improving Quantized Model Performance in Qualitative Analysis with Multi-Pass Prompt Verification
di: Adeseye, Aisvarya, et al.
Pubblicazione: (2026)
di: Adeseye, Aisvarya, et al.
Pubblicazione: (2026)
Revisiting Uncertainty Estimation and Calibration of Large Language Models
di: Tao, Linwei, et al.
Pubblicazione: (2025)
di: Tao, Linwei, et al.
Pubblicazione: (2025)
Uncertainty in Language Models: Assessment through Rank-Calibration
di: Huang, Xinmeng, et al.
Pubblicazione: (2024)
di: Huang, Xinmeng, et al.
Pubblicazione: (2024)
On Subjective Uncertainty Quantification and Calibration in Natural Language Generation
di: Wang, Ziyu, et al.
Pubblicazione: (2024)
di: Wang, Ziyu, et al.
Pubblicazione: (2024)
MMedAgent-RL: Optimizing Multi-Agent Collaboration for Multimodal Medical Reasoning
di: Xia, Peng, et al.
Pubblicazione: (2025)
di: Xia, Peng, et al.
Pubblicazione: (2025)
The Consistency Hypothesis in Uncertainty Quantification for Large Language Models
di: Xiao, Quan, et al.
Pubblicazione: (2025)
di: Xiao, Quan, et al.
Pubblicazione: (2025)
Consistency Calibration: Improving Uncertainty Calibration via Consistency among Perturbed Neighbors
di: Tao, Linwei, et al.
Pubblicazione: (2024)
di: Tao, Linwei, et al.
Pubblicazione: (2024)
Verification-Aware Planning for Multi-Agent Systems
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
BayesAgent: Bayesian Agentic Reasoning Under Uncertainty via Verbalized Probabilistic Graphical Modeling
di: Huang, Hengguan, et al.
Pubblicazione: (2024)
di: Huang, Hengguan, et al.
Pubblicazione: (2024)
Reinforce LLM Reasoning through Multi-Agent Reflection
di: Yuan, Yurun, et al.
Pubblicazione: (2025)
di: Yuan, Yurun, et al.
Pubblicazione: (2025)
An Assessment of Human vs. Model Uncertainty in Soft-Label Learning and Calibration
di: Pavlovic, Maja, et al.
Pubblicazione: (2026)
di: Pavlovic, Maja, et al.
Pubblicazione: (2026)
Learning from Synthetic Data Improves Multi-hop Reasoning
di: Kabra, Anmol, et al.
Pubblicazione: (2026)
di: Kabra, Anmol, et al.
Pubblicazione: (2026)
Tracing Uncertainty in Language Model "Reasoning"
di: Grünefeld, Nils, et al.
Pubblicazione: (2026)
di: Grünefeld, Nils, et al.
Pubblicazione: (2026)
Forward-Backward Reasoning in Large Language Models for Mathematical Verification
di: Jiang, Weisen, et al.
Pubblicazione: (2023)
di: Jiang, Weisen, et al.
Pubblicazione: (2023)
Aligning LLMs with Human Uncertainty: A Beta-Bernoulli Calibrator for LLM Forecasting
di: Dai, Hui, et al.
Pubblicazione: (2026)
di: Dai, Hui, et al.
Pubblicazione: (2026)
ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training
di: Liang, Yu, et al.
Pubblicazione: (2026)
di: Liang, Yu, et al.
Pubblicazione: (2026)
Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning
di: Krishnan, Ranganath, et al.
Pubblicazione: (2024)
di: Krishnan, Ranganath, et al.
Pubblicazione: (2024)
ARM: Discovering Agentic Reasoning Modules for Generalizable Multi-Agent Systems
di: Yao, Bohan, et al.
Pubblicazione: (2025)
di: Yao, Bohan, et al.
Pubblicazione: (2025)
Temporal Consistency for LLM Reasoning Process Error Identification
di: Guo, Jiacheng, et al.
Pubblicazione: (2025)
di: Guo, Jiacheng, et al.
Pubblicazione: (2025)
Beyond Isolation: Multi-Agent Synergy for Improving Knowledge Graph Construction
di: Ye, Hongbin, et al.
Pubblicazione: (2023)
di: Ye, Hongbin, et al.
Pubblicazione: (2023)
Less is More for Improving Automatic Evaluation of Factual Consistency
di: Wang, Tong, et al.
Pubblicazione: (2024)
di: Wang, Tong, et al.
Pubblicazione: (2024)
Forging the Forger: An Attempt to Improve Authorship Verification via Data Augmentation
di: Corbara, Silvia, et al.
Pubblicazione: (2024)
di: Corbara, Silvia, et al.
Pubblicazione: (2024)
Stabilizing Reasoning in Medical LLMs with Continued Pretraining and Reasoning Preference Optimization
di: Kawakami, Wataru, et al.
Pubblicazione: (2025)
di: Kawakami, Wataru, et al.
Pubblicazione: (2025)
Husky: A Unified, Open-Source Language Agent for Multi-Step Reasoning
di: Kim, Joongwon, et al.
Pubblicazione: (2024)
di: Kim, Joongwon, et al.
Pubblicazione: (2024)
Diversity of Thought Elicits Stronger Reasoning Capabilities in Multi-Agent Debate Frameworks
di: Hegazy, Mahmood
Pubblicazione: (2024)
di: Hegazy, Mahmood
Pubblicazione: (2024)
CAMPHOR: Collaborative Agents for Multi-input Planning and High-Order Reasoning On Device
di: Fu, Yicheng, et al.
Pubblicazione: (2024)
di: Fu, Yicheng, et al.
Pubblicazione: (2024)
Stepwise Self-Consistent Mathematical Reasoning with Large Language Models
di: Zhao, Zilong, et al.
Pubblicazione: (2024)
di: Zhao, Zilong, et al.
Pubblicazione: (2024)
Every Response Counts: Quantifying Uncertainty of LLM-based Multi-Agent Systems through Tensor Decomposition
di: Chen, Tiejin, et al.
Pubblicazione: (2026)
di: Chen, Tiejin, et al.
Pubblicazione: (2026)
Self-Verification Dilemma: Experience-Driven Suppression of Overused Checking in LLM Reasoning
di: Long, Quanyu, et al.
Pubblicazione: (2026)
di: Long, Quanyu, et al.
Pubblicazione: (2026)
How Uncertainty Estimation Scales with Sampling in Reasoning Models
di: Del, Maksym, et al.
Pubblicazione: (2026)
di: Del, Maksym, et al.
Pubblicazione: (2026)
Stepwise Verification and Remediation of Student Reasoning Errors with Large Language Model Tutors
di: Daheim, Nico, et al.
Pubblicazione: (2024)
di: Daheim, Nico, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Finding the Cracks: Improving LLMs Reasoning with Paraphrastic Probing and Consistency Verification
di: Shi, Weili, et al.
Pubblicazione: (2026) -
Think Consistently, Reason Efficiently: Energy-Based Calibration for Implicit Chain-of-Thought
di: Chen, Zhikang, et al.
Pubblicazione: (2025) -
Self-Training Meets Consistency: Improving LLMs' Reasoning with Consistency-Driven Rationale Evaluation
di: Lee, Jaehyeok, et al.
Pubblicazione: (2024) -
Soft Self-Consistency Improves Language Model Agents
di: Wang, Han, et al.
Pubblicazione: (2024) -
Introducing Verification Task of Set Consistency with Set-Consistency Energy Networks
di: Song, Mooho, et al.
Pubblicazione: (2025)