ToMPO: Training LLM Strategic Decision Making from a Multi-Agent Perspective
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yiwen, Chen, Ziang, Kong, Fanqi, Huang, Yizhe, Feng, Xue |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficient Adaptation in Mixed-Motive Environments via Hierarchical Opponent Modeling and Planning
par: Huang, Yizhe, et autres
Publié: (2024)
par: Huang, Yizhe, et autres
Publié: (2024)
AdaSociety: An Adaptive Environment with Social Structures for Multi-Agent Decision-Making
par: Huang, Yizhe, et autres
Publié: (2024)
par: Huang, Yizhe, et autres
Publié: (2024)
Adaptive Punishment for Cooperation in Mixed-Motive Games
par: Tang, Min, et autres
Publié: (2026)
par: Tang, Min, et autres
Publié: (2026)
A Comprehensive Survey on Multi-Agent Cooperative Decision-Making: Scenarios, Approaches, Challenges and Perspectives
par: Jin, Weiqiang, et autres
Publié: (2025)
par: Jin, Weiqiang, et autres
Publié: (2025)
DLM: Unified Decision Language Models for Offline Multi-Agent Sequential Decision Making
par: Zhang, Zhuohui, et autres
Publié: (2026)
par: Zhang, Zhuohui, et autres
Publié: (2026)
Multi-Agent Intelligence for Multidisciplinary Decision-Making in Gastrointestinal Oncology
par: Zhang, Rongzhao, et autres
Publié: (2025)
par: Zhang, Rongzhao, et autres
Publié: (2025)
Who's the Mole? Modeling and Detecting Intention-Hiding Malicious Agents in LLM-Based Multi-Agent Systems
par: Xie, Yizhe, et autres
Publié: (2025)
par: Xie, Yizhe, et autres
Publié: (2025)
Counterfactual Effect Decomposition in Multi-Agent Sequential Decision Making
par: Triantafyllou, Stelios, et autres
Publié: (2024)
par: Triantafyllou, Stelios, et autres
Publié: (2024)
MAFE: Enabling Equitable Algorithm Design in Multi-Agent Multi-Stage Decision-Making Systems
par: Lazri, Zachary McBride, et autres
Publié: (2025)
par: Lazri, Zachary McBride, et autres
Publié: (2025)
From Spark to Fire: Modeling and Mitigating Error Cascades in LLM-Based Multi-Agent Collaboration
par: Xie, Yizhe, et autres
Publié: (2026)
par: Xie, Yizhe, et autres
Publié: (2026)
RoundTable: Investigating Group Decision-Making Mechanism in Multi-Agent Collaboration
par: Cho, Young-Min, et autres
Publié: (2024)
par: Cho, Young-Min, et autres
Publié: (2024)
AgentCDM: Enhancing Multi-Agent Collaborative Decision-Making via ACH-Inspired Structured Reasoning
par: Zhao, Xuyang, et autres
Publié: (2025)
par: Zhao, Xuyang, et autres
Publié: (2025)
Simulating Multi-Stakeholder Decision-Making with Generative Agents in Urban Planning
par: Gao, Jin, et autres
Publié: (2024)
par: Gao, Jin, et autres
Publié: (2024)
Agent-as-Tool: A Study on the Hierarchical Decision Making with Reinforcement Learning
par: Zhang, Yanfei
Publié: (2025)
par: Zhang, Yanfei
Publié: (2025)
Harnessing Diverse Perspectives: A Multi-Agent Framework for Enhanced Error Detection in Knowledge Graphs
par: Li, Yu, et autres
Publié: (2025)
par: Li, Yu, et autres
Publié: (2025)
Constructive Conflict-Driven Multi-Agent Reinforcement Learning for Strategic Diversity
par: Mai, Yuxiang, et autres
Publié: (2025)
par: Mai, Yuxiang, et autres
Publié: (2025)
Voting or Consensus? Decision-Making in Multi-Agent Debate
par: Kaesberg, Lars Benedikt, et autres
Publié: (2025)
par: Kaesberg, Lars Benedikt, et autres
Publié: (2025)
Attention Mechanism for LLM-based Agents Dynamic Diffusion under Information Asymmetry
par: Zhang, Yiwen, et autres
Publié: (2025)
par: Zhang, Yiwen, et autres
Publié: (2025)
MO-MIX: Multi-Objective Multi-Agent Cooperative Decision-Making With Deep Reinforcement Learning
par: Hu, Tianmeng, et autres
Publié: (2026)
par: Hu, Tianmeng, et autres
Publié: (2026)
Explaining Strategic Decisions in Multi-Agent Reinforcement Learning for Aerial Combat Tactics
par: Selmonaj, Ardian, et autres
Publié: (2025)
par: Selmonaj, Ardian, et autres
Publié: (2025)
AgentSchool: An LLM-Powered Multi-Agent Simulation for Education
par: Ye, Yulei, et autres
Publié: (2026)
par: Ye, Yulei, et autres
Publié: (2026)
AgentArk: Distilling Multi-Agent Intelligence into a Single LLM Agent
par: Luo, Yinyi, et autres
Publié: (2026)
par: Luo, Yinyi, et autres
Publié: (2026)
PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making
par: Light, Jonathan, et autres
Publié: (2024)
par: Light, Jonathan, et autres
Publié: (2024)
Training Generalizable Collaborative Agents via Strategic Risk Aversion
par: Qu, Chengrui, et autres
Publié: (2026)
par: Qu, Chengrui, et autres
Publié: (2026)
LLM Multi-Agent Systems: Challenges and Open Problems
par: Han, Shanshan, et autres
Publié: (2024)
par: Han, Shanshan, et autres
Publié: (2024)
Context Learning for Multi-Agent Discussion
par: Hua, Xingyuan, et autres
Publié: (2026)
par: Hua, Xingyuan, et autres
Publié: (2026)
LLM Constitutional Multi-Agent Governance
par: de Curtò, J., et autres
Publié: (2026)
par: de Curtò, J., et autres
Publié: (2026)
Strategic Self-Improvement for Competitive Agents in AI Labour Markets
par: Chiu, Christopher, et autres
Publié: (2025)
par: Chiu, Christopher, et autres
Publié: (2025)
Enhancing Robustness of LLM-Driven Multi-Agent Systems through Randomized Smoothing
par: Hu, Jinwei, et autres
Publié: (2025)
par: Hu, Jinwei, et autres
Publié: (2025)
SafeSieve: From Heuristics to Experience in Progressive Pruning for LLM-based Multi-Agent Communication
par: Zhang, Ruijia, et autres
Publié: (2025)
par: Zhang, Ruijia, et autres
Publié: (2025)
Exploring Advanced LLM Multi-Agent Systems Based on Blackboard Architecture
par: Han, Bochen, et autres
Publié: (2025)
par: Han, Bochen, et autres
Publié: (2025)
DCMAC: Demand-aware Customized Multi-Agent Communication via Upper Bound Training
par: Huo, Dongkun, et autres
Publié: (2024)
par: Huo, Dongkun, et autres
Publié: (2024)
Multi-Agent Target Assignment and Path Finding for Intelligent Warehouse: A Cooperative Multi-Agent Deep Reinforcement Learning Perspective
par: Liu, Qi, et autres
Publié: (2024)
par: Liu, Qi, et autres
Publié: (2024)
Optimizing Sequential Multi-Step Tasks with Parallel LLM Agents
par: Zhang, Enhao, et autres
Publié: (2025)
par: Zhang, Enhao, et autres
Publié: (2025)
Holos: A Web-Scale LLM-Based Multi-Agent System for the Agentic Web
par: Nie, Xiaohang, et autres
Publié: (2026)
par: Nie, Xiaohang, et autres
Publié: (2026)
CONSCIENTIA: Can LLM Agents Learn to Strategize? Emergent Deception and Trust in a Multi-Agent NYC Simulation
par: Sinha, Aarush, et autres
Publié: (2026)
par: Sinha, Aarush, et autres
Publié: (2026)
Multi-Agent Reinforcement Learning for Market Making: Competition without Collusion
par: Wang, Ziyi, et autres
Publié: (2025)
par: Wang, Ziyi, et autres
Publié: (2025)
Aegis: Automated Error Generation and Attribution for Multi-Agent Systems
par: Kong, Fanqi, et autres
Publié: (2025)
par: Kong, Fanqi, et autres
Publié: (2025)
COOP$^2$: Defining, Observing, and Repairing Cooperation in LLM Multi-Agent Systems
par: Yang, Hanqing, et autres
Publié: (2026)
par: Yang, Hanqing, et autres
Publié: (2026)
Position: Towards a Responsible LLM-empowered Multi-Agent Systems
par: Hu, Jinwei, et autres
Publié: (2025)
par: Hu, Jinwei, et autres
Publié: (2025)
Documents similaires
-
Efficient Adaptation in Mixed-Motive Environments via Hierarchical Opponent Modeling and Planning
par: Huang, Yizhe, et autres
Publié: (2024) -
AdaSociety: An Adaptive Environment with Social Structures for Multi-Agent Decision-Making
par: Huang, Yizhe, et autres
Publié: (2024) -
Adaptive Punishment for Cooperation in Mixed-Motive Games
par: Tang, Min, et autres
Publié: (2026) -
A Comprehensive Survey on Multi-Agent Cooperative Decision-Making: Scenarios, Approaches, Challenges and Perspectives
par: Jin, Weiqiang, et autres
Publié: (2025) -
DLM: Unified Decision Language Models for Offline Multi-Agent Sequential Decision Making
par: Zhang, Zhuohui, et autres
Publié: (2026)