Epistemic Gain, Aleatoric Cost: Uncertainty Decomposition in Multi-Agent Debate for Math Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Qiao, Dan, Chen, Binbin, Cai, Fengyu, Chen, Jianlong, Li, Wenhao, Jiang, Fuxin, Chen, Zuzhi, Zha, Hongyuan, Zhang, Tieying, Wang, Baoxiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition
di: Qiao, Dan, et al.
Pubblicazione: (2025)
di: Qiao, Dan, et al.
Pubblicazione: (2025)
Learning to Communicate Through Implicit Communication Channels
di: Wang, Han, et al.
Pubblicazione: (2024)
di: Wang, Han, et al.
Pubblicazione: (2024)
Carbon Market Simulation with Adaptive Mechanism Design
di: Wang, Han, et al.
Pubblicazione: (2024)
di: Wang, Han, et al.
Pubblicazione: (2024)
Talk, Judge, Cooperate: Gossip-Driven Indirect Reciprocity in Self-Interested LLM Agents
di: Zhu, Shuhui, et al.
Pubblicazione: (2026)
di: Zhu, Shuhui, et al.
Pubblicazione: (2026)
Healthcare Mechanisms from Policy-as-Code Search under Strategic Provider Response
di: Wang, Zihan, et al.
Pubblicazione: (2026)
di: Wang, Zihan, et al.
Pubblicazione: (2026)
MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation
di: Lin, Huawei, et al.
Pubblicazione: (2026)
di: Lin, Huawei, et al.
Pubblicazione: (2026)
LOPT: Learning Optimal Pigovian Tax in Sequential Social Dilemmas
di: Hua, Yun, et al.
Pubblicazione: (2023)
di: Hua, Yun, et al.
Pubblicazione: (2023)
CortexDebate: Debating Sparsely and Equally for Multi-Agent Debate
di: Sun, Yiliu, et al.
Pubblicazione: (2025)
di: Sun, Yiliu, et al.
Pubblicazione: (2025)
Can LLM Agents Really Debate? A Controlled Study of Multi-Agent Debate in Logical Reasoning
di: Wu, Haolun, et al.
Pubblicazione: (2025)
di: Wu, Haolun, et al.
Pubblicazione: (2025)
From Debate to Deliberation: Structured Collective Reasoning with Typed Epistemic Acts
di: Prakash, Sunil
Pubblicazione: (2026)
di: Prakash, Sunil
Pubblicazione: (2026)
Scalable UAV Multi-Hop Networking via Multi-Agent Reinforcement Learning with Large Language Models
di: Xu, Yanggang, et al.
Pubblicazione: (2025)
di: Xu, Yanggang, et al.
Pubblicazione: (2025)
Heterogeneous Consensus-Progressive Reasoning for Efficient Multi-Agent Debate
di: Liu, Yiqing, et al.
Pubblicazione: (2026)
di: Liu, Yiqing, et al.
Pubblicazione: (2026)
The Cost of Consensus: Malignant Epistemic Herding and Adaptive Gating in Distributed Multi-Agent Search
di: Farr, David, et al.
Pubblicazione: (2026)
di: Farr, David, et al.
Pubblicazione: (2026)
Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation
di: Wang, Siying, et al.
Pubblicazione: (2025)
di: Wang, Siying, et al.
Pubblicazione: (2025)
Debate-Feedback: A Multi-Agent Framework for Efficient Legal Judgment Prediction
di: Chen, Xi, et al.
Pubblicazione: (2025)
di: Chen, Xi, et al.
Pubblicazione: (2025)
The Cost of Consensus: Isolated Self-Correction Prevails Over Unguided Homogeneous Multi-Agent Debate
di: Bertalanič, Blaž, et al.
Pubblicazione: (2026)
di: Bertalanič, Blaž, et al.
Pubblicazione: (2026)
When Identity Skews Debate: Anonymization for Bias-Reduced Multi-Agent Reasoning
di: Choi, Hyeong Kyu, et al.
Pubblicazione: (2025)
di: Choi, Hyeong Kyu, et al.
Pubblicazione: (2025)
Communication Gain and Delay Cost Under Cross-Timestep Delays in Cooperative Multi-Agent Reinforcement Learning
di: Gao, Zihong, et al.
Pubblicazione: (2026)
di: Gao, Zihong, et al.
Pubblicazione: (2026)
Beyond the Individual: Virtualizing Multi-Disciplinary Reasoning for Clinical Intake via Collaborative Agents
di: Chen, Huangwei, et al.
Pubblicazione: (2026)
di: Chen, Huangwei, et al.
Pubblicazione: (2026)
The Value of Variance: Mitigating Debate Collapse in Multi-Agent Systems via Uncertainty-Driven Policy Optimization
di: Tang, Luoxi, et al.
Pubblicazione: (2026)
di: Tang, Luoxi, et al.
Pubblicazione: (2026)
VERITAS: Verifiable Epistemic Reasoning for Image-Derived Hypothesis Testing via Agentic Systems
di: Stoffl, Lucas, et al.
Pubblicazione: (2026)
di: Stoffl, Lucas, et al.
Pubblicazione: (2026)
STAR-PólyaMath: Multi-Agent Reasoning under Persistent Meta-Strategic Supervision
di: Wu, Jiaao, et al.
Pubblicazione: (2026)
di: Wu, Jiaao, et al.
Pubblicazione: (2026)
TS-Debate: Multimodal Collaborative Debate for Zero-Shot Time Series Reasoning
di: Trirat, Patara, et al.
Pubblicazione: (2026)
di: Trirat, Patara, et al.
Pubblicazione: (2026)
Breaking the Communication-Accuracy Trade-off: A Sparsified Information Diffusion Framework for Multi-Agent Collaborative Perception
di: Zha, Jirong, et al.
Pubblicazione: (2026)
di: Zha, Jirong, et al.
Pubblicazione: (2026)
MACRO-LLM: LLM-Empowered Multi-Agent Collaborative Reasoning under Spatiotemporal Partial Observability
di: Chen, Handi, et al.
Pubblicazione: (2026)
di: Chen, Handi, et al.
Pubblicazione: (2026)
An Epistemic Perspective on Agent Awareness
di: Naumov, Pavel, et al.
Pubblicazione: (2025)
di: Naumov, Pavel, et al.
Pubblicazione: (2025)
Sci-Mind: Cognitively-Inspired Adversarial Debate for Autonomous Mathematical Modeling
di: Jia, Junhao, et al.
Pubblicazione: (2026)
di: Jia, Junhao, et al.
Pubblicazione: (2026)
Scaling Multi-Agent Epistemic Planning through GNN-Derived Heuristics
di: Briglia, Giovanni, et al.
Pubblicazione: (2025)
di: Briglia, Giovanni, et al.
Pubblicazione: (2025)
Shapley-Coop: Credit Assignment for Emergent Cooperation in Self-Interested LLM Agents
di: Hua, Yun, et al.
Pubblicazione: (2025)
di: Hua, Yun, et al.
Pubblicazione: (2025)
Understanding Individual Agent Importance in Multi-Agent System via Counterfactual Reasoning
di: Chen, Jianming, et al.
Pubblicazione: (2024)
di: Chen, Jianming, et al.
Pubblicazione: (2024)
Debate2Create: Robot Co-design via Multi-Agent LLM Debate
di: Qiu, Kevin, et al.
Pubblicazione: (2025)
di: Qiu, Kevin, et al.
Pubblicazione: (2025)
TVDO: Tchebycheff Value-Decomposition Optimization for Multi-Agent Reinforcement Learning
di: Hu, Xiaoliang, et al.
Pubblicazione: (2023)
di: Hu, Xiaoliang, et al.
Pubblicazione: (2023)
Towards CausalGPT: A Multi-Agent Approach for Faithful Knowledge Reasoning via Promoting Causal Consistency in LLMs
di: Tang, Ziyi, et al.
Pubblicazione: (2023)
di: Tang, Ziyi, et al.
Pubblicazione: (2023)
AIPOM: Agent-aware Interactive Planning for Multi-Agent Systems
di: Kim, Hannah, et al.
Pubblicazione: (2025)
di: Kim, Hannah, et al.
Pubblicazione: (2025)
Logic of Awareness in Agent's Reasoning
di: Kubono, Yudai, et al.
Pubblicazione: (2023)
di: Kubono, Yudai, et al.
Pubblicazione: (2023)
FedGUI: Benchmarking Federated GUI Agents across Heterogeneous Platforms, Devices, and Operating Systems
di: Wang, Wenhao, et al.
Pubblicazione: (2026)
di: Wang, Wenhao, et al.
Pubblicazione: (2026)
DataSage: Multi-agent Collaboration for Insight Discovery with External Knowledge Retrieval, Multi-role Debating, and Multi-path Reasoning
di: Liu, Xiaochuan, et al.
Pubblicazione: (2025)
di: Liu, Xiaochuan, et al.
Pubblicazione: (2025)
Debate-Driven Multi-Agent LLMs for Phishing Email Detection
di: Nguyen, Ngoc Tuong Vy, et al.
Pubblicazione: (2025)
di: Nguyen, Ngoc Tuong Vy, et al.
Pubblicazione: (2025)
Revolutionizing Bridge Operation and Maintenance with LLM-based Agents: An Overview of Applications and Insights
di: Chen, Xinyu, et al.
Pubblicazione: (2024)
di: Chen, Xinyu, et al.
Pubblicazione: (2024)
Breaking the Secret: Economic Interventions for Combating Collusion in Embodied Multi-Agent Systems
di: Liu, Qi, et al.
Pubblicazione: (2026)
di: Liu, Qi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition
di: Qiao, Dan, et al.
Pubblicazione: (2025) -
Learning to Communicate Through Implicit Communication Channels
di: Wang, Han, et al.
Pubblicazione: (2024) -
Carbon Market Simulation with Adaptive Mechanism Design
di: Wang, Han, et al.
Pubblicazione: (2024) -
Talk, Judge, Cooperate: Gossip-Driven Indirect Reciprocity in Self-Interested LLM Agents
di: Zhu, Shuhui, et al.
Pubblicazione: (2026) -
Healthcare Mechanisms from Policy-as-Code Search under Strategic Provider Response
di: Wang, Zihan, et al.
Pubblicazione: (2026)