Saved in:
| Main Authors: | Yao, Yu, Dong, Jiayi, Yang, Yang, Li, Ju, Du, Yilun |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2509.16839 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MarsRL: Advancing Multi-Agent Reasoning System via Reinforcement Learning with Agentic Pipeline Parallelism
by: Liu, Shulin, et al.
Published: (2025)
by: Liu, Shulin, et al.
Published: (2025)
Multi-Modal Manipulation via Multi-Modal Policy Consensus
by: Chen, Haonan, et al.
Published: (2025)
by: Chen, Haonan, et al.
Published: (2025)
Heterogeneous Consensus-Progressive Reasoning for Efficient Multi-Agent Debate
by: Liu, Yiqing, et al.
Published: (2026)
by: Liu, Yiqing, et al.
Published: (2026)
Optimize Wider, Not Deeper: Consensus Aggregation for Policy Optimization
by: Su, Zelal, et al.
Published: (2026)
by: Su, Zelal, et al.
Published: (2026)
Generalizable Reasoning through Compositional Energy Minimization
by: Oarga, Alexandru, et al.
Published: (2025)
by: Oarga, Alexandru, et al.
Published: (2025)
Multi-Agent Verification: Scaling Test-Time Compute with Multiple Verifiers
by: Lifshitz, Shalev, et al.
Published: (2025)
by: Lifshitz, Shalev, et al.
Published: (2025)
Streaming Diffusion Policy: Fast Policy Synthesis with Variable Noise Diffusion Models
by: Høeg, Sigmund H., et al.
Published: (2024)
by: Høeg, Sigmund H., et al.
Published: (2024)
Maximizing Confidence Alone Improves Reasoning
by: Prabhudesai, Mihir, et al.
Published: (2025)
by: Prabhudesai, Mihir, et al.
Published: (2025)
Reaching Consensus in Cooperative Multi-Agent Reinforcement Learning with Goal Imagination
by: Wang, Liangzhou, et al.
Published: (2024)
by: Wang, Liangzhou, et al.
Published: (2024)
Reasoning with Sampling: Your Base Model is Smarter Than You Think
by: Karan, Aayush, et al.
Published: (2025)
by: Karan, Aayush, et al.
Published: (2025)
Flexible Multitask Learning with Factorized Diffusion Policy
by: Liu, Chaoqi, et al.
Published: (2025)
by: Liu, Chaoqi, et al.
Published: (2025)
Insider Attacks in Multi-Agent LLM Consensus Systems
by: Sun, Xiaolin, et al.
Published: (2026)
by: Sun, Xiaolin, et al.
Published: (2026)
Weak-Link Optimization for Multi-Agent Reasoning and Collaboration
by: Bian, Haoyu, et al.
Published: (2026)
by: Bian, Haoyu, et al.
Published: (2026)
AgentsEval: Clinically Faithful Evaluation of Medical Imaging Reports via Multi-Agent Reasoning
by: Fu, Suzhong, et al.
Published: (2026)
by: Fu, Suzhong, et al.
Published: (2026)
SciAgent: A Unified Multi-Agent System for Generalistic Scientific Reasoning
by: Li, Xuchen, et al.
Published: (2025)
by: Li, Xuchen, et al.
Published: (2025)
Haibu Mathematical-Medical Intelligent Agent:Enhancing Large Language Model Reliability in Medical Tasks via Verifiable Reasoning Chains
by: Zhang, Yilun, et al.
Published: (2025)
by: Zhang, Yilun, et al.
Published: (2025)
Empowering LLM Agents with Geospatial Awareness: Toward Grounded Reasoning for Wildfire Response
by: Chen, Yiheng, et al.
Published: (2025)
by: Chen, Yiheng, et al.
Published: (2025)
JudgeSQL: Reasoning over SQL Candidates with Weighted Consensus Tournament
by: Bai, Jiayuan, et al.
Published: (2025)
by: Bai, Jiayuan, et al.
Published: (2025)
Learning Iterative Reasoning through Energy Diffusion
by: Du, Yilun, et al.
Published: (2024)
by: Du, Yilun, et al.
Published: (2024)
Learning to Break: Knowledge-Enhanced Reasoning in Multi-Agent Debate System
by: Wang, Haotian, et al.
Published: (2023)
by: Wang, Haotian, et al.
Published: (2023)
AgentAsk: Multi-Agent Systems Need to Ask
by: Lin, Bohan, et al.
Published: (2025)
by: Lin, Bohan, et al.
Published: (2025)
Group Deliberation Oriented Multi-Agent Conversational Model for Complex Reasoning
by: Shi, Zheyu, et al.
Published: (2025)
by: Shi, Zheyu, et al.
Published: (2025)
Reason in Chains, Learn in Trees: Self-Rectification and Grafting for Multi-turn Agent Policy Optimization
by: Li, Yu, et al.
Published: (2026)
by: Li, Yu, et al.
Published: (2026)
Improving Multi-Step Reasoning Abilities of Large Language Models with Direct Advantage Policy Optimization
by: Liu, Jiacai, et al.
Published: (2024)
by: Liu, Jiacai, et al.
Published: (2024)
Tree of Agents: Improving Long-Context Capabilities of Large Language Models through Multi-Perspective Reasoning
by: Yu, Song, et al.
Published: (2025)
by: Yu, Song, et al.
Published: (2025)
Agent-GSPO: Communication-Efficient Multi-Agent Systems via Group Sequence Policy Optimization
by: Fan, Yijia, et al.
Published: (2025)
by: Fan, Yijia, et al.
Published: (2025)
FROGENT: An End-to-End Full-process Drug Design Multi-Agent System
by: Pan, Qihua, et al.
Published: (2025)
by: Pan, Qihua, et al.
Published: (2025)
Towards Responsible and Explainable AI Agents with Consensus-Driven Reasoning
by: Bandara, Eranga, et al.
Published: (2025)
by: Bandara, Eranga, et al.
Published: (2025)
Free-MAD: Consensus-Free Multi-Agent Debate
by: Cui, Yu, et al.
Published: (2025)
by: Cui, Yu, et al.
Published: (2025)
MASLegalBench: Benchmarking Multi-Agent Systems in Deductive Legal Reasoning
by: Jing, Huihao, et al.
Published: (2025)
by: Jing, Huihao, et al.
Published: (2025)
Stablecoin Design with Adversarial-Robust Multi-Agent Systems via Trust-Weighted Signal Aggregation
by: You, Shengwei, et al.
Published: (2026)
by: You, Shengwei, et al.
Published: (2026)
Disagreements in Reasoning: How a Model's Thinking Process Dictates Persuasion in Multi-Agent Systems
by: Zhao, Haodong, et al.
Published: (2025)
by: Zhao, Haodong, et al.
Published: (2025)
Improving LLM Reasoning with Multi-Agent Tree-of-Thought Validator Agent
by: Haji, Fatemeh, et al.
Published: (2024)
by: Haji, Fatemeh, et al.
Published: (2024)
Sequence to Sequence Reward Modeling: Improving RLHF by Language Feedback
by: Zhou, Jiayi, et al.
Published: (2024)
by: Zhou, Jiayi, et al.
Published: (2024)
Counterfactual Credit Policy Optimization for Multi-Agent Collaboration
by: Li, Zhongyi, et al.
Published: (2026)
by: Li, Zhongyi, et al.
Published: (2026)
MedAgentsBench: Benchmarking Thinking Models and Agent Frameworks for Complex Medical Reasoning
by: Tang, Xiangru, et al.
Published: (2025)
by: Tang, Xiangru, et al.
Published: (2025)
Reflective Confidence: Correcting Reasoning Flaws via Online Self-Correction
by: Zeng, Qinglin, et al.
Published: (2025)
by: Zeng, Qinglin, et al.
Published: (2025)
DIANOIA: Diagnostic Decomposition and Joint Optimization for Multi-Agent Reasoning
by: Yang, Yiming, et al.
Published: (2026)
by: Yang, Yiming, et al.
Published: (2026)
DynaTrust: Defending Multi-Agent Systems Against Sleeper Agents via Dynamic Trust Graphs
by: Li, Yu, et al.
Published: (2026)
by: Li, Yu, et al.
Published: (2026)
SUB-PLAY: Adversarial Policies against Partially Observed Multi-Agent Reinforcement Learning Systems
by: Ma, Oubo, et al.
Published: (2024)
by: Ma, Oubo, et al.
Published: (2024)
Similar Items
-
MarsRL: Advancing Multi-Agent Reasoning System via Reinforcement Learning with Agentic Pipeline Parallelism
by: Liu, Shulin, et al.
Published: (2025) -
Multi-Modal Manipulation via Multi-Modal Policy Consensus
by: Chen, Haonan, et al.
Published: (2025) -
Heterogeneous Consensus-Progressive Reasoning for Efficient Multi-Agent Debate
by: Liu, Yiqing, et al.
Published: (2026) -
Optimize Wider, Not Deeper: Consensus Aggregation for Policy Optimization
by: Su, Zelal, et al.
Published: (2026) -
Generalizable Reasoning through Compositional Energy Minimization
by: Oarga, Alexandru, et al.
Published: (2025)