Safe Equilibrium Policy Optimization for Strategic Agent Policies
Fuente:
arXiv
Saved in:
| Main Authors: | Arumugam, Karthika, Manku, Kiran Kumar, Dhanda, Amit |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-Dimensional Summarization Agents with Context-Aware Reasoning over Enterprise Tables
by: Dhanda, Amit
Published: (2025)
by: Dhanda, Amit
Published: (2025)
Multi-Agent Guided Policy Optimization
by: Li, Yueheng, et al.
Published: (2025)
by: Li, Yueheng, et al.
Published: (2025)
Agent-GSPO: Communication-Efficient Multi-Agent Systems via Group Sequence Policy Optimization
by: Fan, Yijia, et al.
Published: (2025)
by: Fan, Yijia, et al.
Published: (2025)
Healthcare Mechanisms from Policy-as-Code Search under Strategic Provider Response
by: Wang, Zihan, et al.
Published: (2026)
by: Wang, Zihan, et al.
Published: (2026)
Counterfactual Multi-Agent Policy Gradients
by: Foerster, Jakob, et al.
Published: (2017)
by: Foerster, Jakob, et al.
Published: (2017)
AgentMixer: Multi-Agent Correlated Policy Factorization
by: Li, Zhiyuan, et al.
Published: (2024)
by: Li, Zhiyuan, et al.
Published: (2024)
Deep Reinforcement Learning Agents for Strategic Production Policies in Microeconomic Market Simulations
by: Garrido-Merchán, Eduardo C., et al.
Published: (2024)
by: Garrido-Merchán, Eduardo C., et al.
Published: (2024)
Maestro: Learning to Collaborate via Conditional Listwise Policy Optimization for Multi-Agent LLMs
by: Yang, Wei, et al.
Published: (2025)
by: Yang, Wei, et al.
Published: (2025)
TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
by: Lou, Xingzhou, et al.
Published: (2023)
by: Lou, Xingzhou, et al.
Published: (2023)
Measuring Policy Distance for Multi-Agent Reinforcement Learning
by: Hu, Tianyi, et al.
Published: (2024)
by: Hu, Tianyi, et al.
Published: (2024)
Multi-Agent Reinforcement Learning Simulation for Environmental Policy Synthesis
by: Rudd-Jones, James, et al.
Published: (2025)
by: Rudd-Jones, James, et al.
Published: (2025)
Influencing LLM Multi-Agent Dialogue via Policy-Parameterized Prompts
by: Bo, Hongbo, et al.
Published: (2026)
by: Bo, Hongbo, et al.
Published: (2026)
Can Poverty Be Reduced by Acting on Discrimination? An Agent-based Model for Policy Making
by: Aguilera, Alba, et al.
Published: (2024)
by: Aguilera, Alba, et al.
Published: (2024)
Scalable Safe Multi-Agent Reinforcement Learning for Multi-Agent System
by: Du, Haikuo, et al.
Published: (2025)
by: Du, Haikuo, et al.
Published: (2025)
EnergAIze: Multi Agent Deep Deterministic Policy Gradient for Vehicle to Grid Energy Management
by: Fonseca, Tiago, et al.
Published: (2024)
by: Fonseca, Tiago, et al.
Published: (2024)
Strategic Self-Improvement for Competitive Agents in AI Labour Markets
by: Chiu, Christopher, et al.
Published: (2025)
by: Chiu, Christopher, et al.
Published: (2025)
Budget Allocation Policies for Real-Time Multi-Agent Path Finding
by: Beck, Raz, et al.
Published: (2025)
by: Beck, Raz, et al.
Published: (2025)
Achieving Equilibrium under Utility Heterogeneity: An Agent-Attention Framework for Multi-Agent Multi-Objective Reinforcement Learning
by: Li, Zhuhui, et al.
Published: (2025)
by: Li, Zhuhui, et al.
Published: (2025)
SafeAgent: A Runtime Protection Architecture for Agentic Systems
by: Liu, Hailin, et al.
Published: (2026)
by: Liu, Hailin, et al.
Published: (2026)
Constructive Conflict-Driven Multi-Agent Reinforcement Learning for Strategic Diversity
by: Mai, Yuxiang, et al.
Published: (2025)
by: Mai, Yuxiang, et al.
Published: (2025)
Simulation-Based Optimistic Policy Iteration For Multi-Agent MDPs with Kullback-Leibler Control Cost
by: Nakhleh, Khaled, et al.
Published: (2024)
by: Nakhleh, Khaled, et al.
Published: (2024)
Assigning Credit with Partial Reward Decoupling in Multi-Agent Proximal Policy Optimization
by: Kapoor, Aditya, et al.
Published: (2024)
by: Kapoor, Aditya, et al.
Published: (2024)
Adaptive Event-Triggered Policy Gradient for Multi-Agent Reinforcement Learning
by: Siddique, Umer, et al.
Published: (2025)
by: Siddique, Umer, et al.
Published: (2025)
ToMPO: Training LLM Strategic Decision Making from a Multi-Agent Perspective
by: Zhang, Yiwen, et al.
Published: (2025)
by: Zhang, Yiwen, et al.
Published: (2025)
Agentic Hives: Equilibrium, Indeterminacy, and Endogenous Cycles in Self-Organizing Multi-Agent Systems
by: Garnier, Jean-Philippe
Published: (2026)
by: Garnier, Jean-Philippe
Published: (2026)
SafeSieve: From Heuristics to Experience in Progressive Pruning for LLM-based Multi-Agent Communication
by: Zhang, Ruijia, et al.
Published: (2025)
by: Zhang, Ruijia, et al.
Published: (2025)
Policy Optimization finds Nash Equilibrium in Regularized General-Sum LQ Games
by: Zaman, Muhammad Aneeq uz, et al.
Published: (2024)
by: Zaman, Muhammad Aneeq uz, et al.
Published: (2024)
Scalable Submodular Policy Optimization via Pruned Submodularity Graph
by: Anand, Aditi, et al.
Published: (2025)
by: Anand, Aditi, et al.
Published: (2025)
Descent-Guided Policy Gradient for Scalable Cooperative Multi-Agent Learning
by: Yang, Shan, et al.
Published: (2026)
by: Yang, Shan, et al.
Published: (2026)
Centralized Permutation Equivariant Policy for Cooperative Multi-Agent Reinforcement Learning
by: Xu, Zhuofan, et al.
Published: (2025)
by: Xu, Zhuofan, et al.
Published: (2025)
Beyond Context Sharing: A Unified Agent Communication Protocol (ACP) for Secure, Federated, and Autonomous Agent-to-Agent (A2A) Orchestration
by: Krishnan, Naveen Kumar
Published: (2026)
by: Krishnan, Naveen Kumar
Published: (2026)
Policies over Poses: Reinforcement Learning based Distributed Pose-Graph Optimization for Multi-Robot SLAM
by: Ghanta, Sai Krishna, et al.
Published: (2025)
by: Ghanta, Sai Krishna, et al.
Published: (2025)
Optimizing Agent Collaboration through Heuristic Multi-Agent Planning
by: Soffair, Nitsan
Published: (2023)
by: Soffair, Nitsan
Published: (2023)
Network-Constrained Policy Optimization for Adaptive Multi-agent Vehicle Routing
by: Arasteh, Fazel, et al.
Published: (2025)
by: Arasteh, Fazel, et al.
Published: (2025)
One Step is Enough: Multi-Agent Reinforcement Learning based on One-Step Policy Optimization for Order Dispatch on Ride-Sharing Platforms
by: Zhao, Zijian, et al.
Published: (2025)
by: Zhao, Zijian, et al.
Published: (2025)
Enhancing Traffic Signal Control through Model-based Reinforcement Learning and Policy Reuse
by: Li, Yihong, et al.
Published: (2025)
by: Li, Yihong, et al.
Published: (2025)
On Swarm Leader Identification using Probing Policies
by: Bachoumas, Stergios E., et al.
Published: (2025)
by: Bachoumas, Stergios E., et al.
Published: (2025)
ToMCAT: Theory-of-Mind for Cooperative Agents in Teams via Multiagent Diffusion Policies
by: Sequeira, Pedro, et al.
Published: (2025)
by: Sequeira, Pedro, et al.
Published: (2025)
A Role-Based LLM Framework for Structured Information Extraction from Healthy Food Policies
by: Zhang, Congjing, et al.
Published: (2026)
by: Zhang, Congjing, et al.
Published: (2026)
Counterfactual-based Agent Influence Ranker for Agentic AI Workflows
by: Giloni, Amit, et al.
Published: (2025)
by: Giloni, Amit, et al.
Published: (2025)
Similar Items
-
Multi-Dimensional Summarization Agents with Context-Aware Reasoning over Enterprise Tables
by: Dhanda, Amit
Published: (2025) -
Multi-Agent Guided Policy Optimization
by: Li, Yueheng, et al.
Published: (2025) -
Agent-GSPO: Communication-Efficient Multi-Agent Systems via Group Sequence Policy Optimization
by: Fan, Yijia, et al.
Published: (2025) -
Healthcare Mechanisms from Policy-as-Code Search under Strategic Provider Response
by: Wang, Zihan, et al.
Published: (2026) -
Counterfactual Multi-Agent Policy Gradients
by: Foerster, Jakob, et al.
Published: (2017)