Enhancing Multi-Agent Debate System Performance via Confidence Expression
Fuente:
arXiv
Guardado en:
| Autores principales: | Lin, Zijie, Hooi, Bryan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ConfTuner: Training Large Language Models to Express Their Confidence Verbally
por: Li, Yibo, et al.
Publicado: (2025)
por: Li, Yibo, et al.
Publicado: (2025)
Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs
por: Xiong, Miao, et al.
Publicado: (2023)
por: Xiong, Miao, et al.
Publicado: (2023)
Conversation for Non-verifiable Learning: Self-Evolving LLMs through Meta-Evaluation
por: Sui, Yuan, et al.
Publicado: (2026)
por: Sui, Yuan, et al.
Publicado: (2026)
Learning to Break: Knowledge-Enhanced Reasoning in Multi-Agent Debate System
por: Wang, Haotian, et al.
Publicado: (2023)
por: Wang, Haotian, et al.
Publicado: (2023)
GroupDebate: Enhancing the Efficiency of Multi-Agent Debate Using Group Discussion
por: Liu, Tongxuan, et al.
Publicado: (2024)
por: Liu, Tongxuan, et al.
Publicado: (2024)
Fake News in Sheep's Clothing: Robust Fake News Detection Against LLM-Empowered Style Attacks
por: Wu, Jiaying, et al.
Publicado: (2023)
por: Wu, Jiaying, et al.
Publicado: (2023)
Enhancing LLM Character-Level Manipulation via Divide and Conquer
por: Xiong, Zhen, et al.
Publicado: (2025)
por: Xiong, Zhen, et al.
Publicado: (2025)
Enhancing Confidence Expression in Large Language Models Through Learning from Past Experience
por: Han, Haixia, et al.
Publicado: (2024)
por: Han, Haixia, et al.
Publicado: (2024)
Confidence Calibration and Rationalization for LLMs via Multi-Agent Deliberation
por: Yang, Ruixin, et al.
Publicado: (2024)
por: Yang, Ruixin, et al.
Publicado: (2024)
The Hunger Game Debate: On the Emergence of Over-Competition in Multi-Agent Systems
por: Ma, Xinbei, et al.
Publicado: (2025)
por: Ma, Xinbei, et al.
Publicado: (2025)
Seeing is Believing: Mitigating Hallucination in Large Vision-Language Models via CLIP-Guided Decoding
por: Deng, Ailin, et al.
Publicado: (2024)
por: Deng, Ailin, et al.
Publicado: (2024)
RedDebate: Safer Responses Through Multi-Agent Red Teaming Debates
por: Asad, Ali, et al.
Publicado: (2025)
por: Asad, Ali, et al.
Publicado: (2025)
Learning from Self-Debate: Preparing Reasoning Models for Multi-Agent Debate
por: Liu, Chenxi, et al.
Publicado: (2026)
por: Liu, Chenxi, et al.
Publicado: (2026)
Confident RAG: Enhancing the Performance of LLMs for Mathematics Question Answering through Multi-Embedding and Confidence Scoring
por: Chen, Shiting, et al.
Publicado: (2025)
por: Chen, Shiting, et al.
Publicado: (2025)
SWE-Debate: Competitive Multi-Agent Debate for Software Issue Resolution
por: Li, Han, et al.
Publicado: (2025)
por: Li, Han, et al.
Publicado: (2025)
Calibrated Confidence Expression for Radiology Report Generation
por: Bani-Harouni, David, et al.
Publicado: (2026)
por: Bani-Harouni, David, et al.
Publicado: (2026)
Multi-Agent Debate with Memory Masking
por: Tian, Hongduan, et al.
Publicado: (2026)
por: Tian, Hongduan, et al.
Publicado: (2026)
S$^2$-MAD: Breaking the Token Barrier to Enhance Multi-Agent Debate Efficiency
por: Zeng, Yuting, et al.
Publicado: (2025)
por: Zeng, Yuting, et al.
Publicado: (2025)
Gradual Vigilance and Interval Communication: Enhancing Value Alignment in Multi-Agent Debates
por: Zou, Rui, et al.
Publicado: (2024)
por: Zou, Rui, et al.
Publicado: (2024)
Improving Multi-Agent Debate with Sparse Communication Topology
por: Li, Yunxuan, et al.
Publicado: (2024)
por: Li, Yunxuan, et al.
Publicado: (2024)
Dialectic-Med: Mitigating Diagnostic Hallucinations via Counterfactual Adversarial Multi-Agent Debate
por: Lu, Zhixiang, et al.
Publicado: (2026)
por: Lu, Zhixiang, et al.
Publicado: (2026)
Beyond Brainstorming: What Drives High-Quality Scientific Ideas? Lessons from Multi-Agent Collaboration
por: Chen, Nuo, et al.
Publicado: (2025)
por: Chen, Nuo, et al.
Publicado: (2025)
Towards A Unified View of Answer Calibration for Multi-Step Reasoning
por: Deng, Shumin, et al.
Publicado: (2023)
por: Deng, Shumin, et al.
Publicado: (2023)
When in Doubt, Consult: Expert Debate for Sexism Detection via Confidence-Based Routing
por: Alajmi, Anwar, et al.
Publicado: (2025)
por: Alajmi, Anwar, et al.
Publicado: (2025)
QChunker: Learning Question-Aware Text Chunking for Domain RAG via Multi-Agent Debate
por: Zhao, Jihao, et al.
Publicado: (2026)
por: Zhao, Jihao, et al.
Publicado: (2026)
Hear Both Sides: Efficient Multi-Agent Debate via Diversity-Aware Message Retention
por: Nguyen, Manh, et al.
Publicado: (2026)
por: Nguyen, Manh, et al.
Publicado: (2026)
Peacemaker or Troublemaker: How Sycophancy Shapes Multi-Agent Debate
por: Yao, Binwei, et al.
Publicado: (2025)
por: Yao, Binwei, et al.
Publicado: (2025)
FinDebate: Multi-Agent Collaborative Intelligence for Financial Analysis
por: Cai, Tianshi, et al.
Publicado: (2025)
por: Cai, Tianshi, et al.
Publicado: (2025)
Combating Adversarial Attacks with Multi-Agent Debate
por: Chern, Steffi, et al.
Publicado: (2024)
por: Chern, Steffi, et al.
Publicado: (2024)
Dynamic Role Assignment for Multi-Agent Debate
por: Zhang, Miao, et al.
Publicado: (2026)
por: Zhang, Miao, et al.
Publicado: (2026)
Breaking Event Rumor Detection via Stance-Separated Multi-Agent Debate
por: Zhang, Mingqing, et al.
Publicado: (2024)
por: Zhang, Mingqing, et al.
Publicado: (2024)
Con-ReCall: Detecting Pre-training Data in LLMs via Contrastive Decoding
por: Wang, Cheng, et al.
Publicado: (2024)
por: Wang, Cheng, et al.
Publicado: (2024)
Can Knowledge Graphs Make Large Language Models More Trustworthy? An Empirical Study Over Open-ended Question Answering
por: Sui, Yuan, et al.
Publicado: (2024)
por: Sui, Yuan, et al.
Publicado: (2024)
Debate to Align: Reliable Entity Alignment through Two-Stage Multi-Agent Debate
por: Wang, Cunda, et al.
Publicado: (2026)
por: Wang, Cunda, et al.
Publicado: (2026)
Guiding VLM Agents with Process Rewards at Inference Time for GUI Navigation
por: Hu, Zhiyuan, et al.
Publicado: (2025)
por: Hu, Zhiyuan, et al.
Publicado: (2025)
Do "New Snow Tablets" Contain Snow? Large Language Models Over-Rely on Names to Identify Ingredients of Chinese Drugs
por: Li, Sifan, et al.
Publicado: (2025)
por: Li, Sifan, et al.
Publicado: (2025)
BLUEmed: Retrieval-Augmented Multi-Agent Debate for Clinical Error Detection
por: You, Saukun Thika, et al.
Publicado: (2026)
por: You, Saukun Thika, et al.
Publicado: (2026)
HarmTransform: Transforming Explicit Harmful Queries into Stealthy via Multi-Agent Debate
por: Zhu, Shenzhe
Publicado: (2025)
por: Zhu, Shenzhe
Publicado: (2025)
Exploring Collaboration Mechanisms for LLM Agents: A Social Psychology View
por: Zhang, Jintian, et al.
Publicado: (2023)
por: Zhang, Jintian, et al.
Publicado: (2023)
MAD-Fact: A Multi-Agent Debate Framework for Long-Form Factuality Evaluation in LLMs
por: Ning, Yucheng, et al.
Publicado: (2025)
por: Ning, Yucheng, et al.
Publicado: (2025)
Ejemplares similares
-
ConfTuner: Training Large Language Models to Express Their Confidence Verbally
por: Li, Yibo, et al.
Publicado: (2025) -
Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs
por: Xiong, Miao, et al.
Publicado: (2023) -
Conversation for Non-verifiable Learning: Self-Evolving LLMs through Meta-Evaluation
por: Sui, Yuan, et al.
Publicado: (2026) -
Learning to Break: Knowledge-Enhanced Reasoning in Multi-Agent Debate System
por: Wang, Haotian, et al.
Publicado: (2023) -
GroupDebate: Enhancing the Efficiency of Multi-Agent Debate Using Group Discussion
por: Liu, Tongxuan, et al.
Publicado: (2024)