Safe Multi-Agent Reinforcement Learning with Convergence to Generalized Nash Equilibrium
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Zeyang, Azizan, Navid |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Reverse Flow Matching: A Unified Framework for Online Reinforcement Learning with Diffusion and Flow Policies
von: Li, Zeyang, et al.
Veröffentlicht: (2026)
von: Li, Zeyang, et al.
Veröffentlicht: (2026)
HardFlow: Hard-Constrained Sampling for Flow-Matching Models via Trajectory Optimization
von: Li, Zeyang, et al.
Veröffentlicht: (2025)
von: Li, Zeyang, et al.
Veröffentlicht: (2025)
Personalized Collaborative Learning with Affinity-Based Variance Reduction
von: Zhang, Chenyu, et al.
Veröffentlicht: (2025)
von: Zhang, Chenyu, et al.
Veröffentlicht: (2025)
ECO: Energy-Constrained Operator Learning for Chaotic Dynamics with Boundedness Guarantees
von: Goertzen, Andrea, et al.
Veröffentlicht: (2025)
von: Goertzen, Andrea, et al.
Veröffentlicht: (2025)
ORFit: One-Pass Learning via Bridging Orthogonal Gradient Descent and Recursive Least-Squares
von: Min, Youngjae, et al.
Veröffentlicht: (2022)
von: Min, Youngjae, et al.
Veröffentlicht: (2022)
ATOM-CBF: Adaptive Safe Perception-Based Control under Out-of-Distribution Measurements
von: Yun, Kai S., et al.
Veröffentlicht: (2025)
von: Yun, Kai S., et al.
Veröffentlicht: (2025)
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning
von: Wang, Xuefeng, et al.
Veröffentlicht: (2024)
von: Wang, Xuefeng, et al.
Veröffentlicht: (2024)
Constraint Learning in Multi-Agent Dynamic Games from Demonstrations of Local Nash Interactions
von: Zhang, Zhouyu, et al.
Veröffentlicht: (2025)
von: Zhang, Zhouyu, et al.
Veröffentlicht: (2025)
On the Equilibrium between Feasible Zone and Uncertain Model in Safe Exploration
von: Yang, Yujie, et al.
Veröffentlicht: (2026)
von: Yang, Yujie, et al.
Veröffentlicht: (2026)
Wasserstein Distributionally Robust Nash Equilibrium Seeking with Heterogeneous Data: A Lagrangian Approach
von: Wang, Zifan, et al.
Veröffentlicht: (2025)
von: Wang, Zifan, et al.
Veröffentlicht: (2025)
Optimism as Risk-Seeking in Multi-Agent Reinforcement Learning
von: Zhang, Runyu, et al.
Veröffentlicht: (2025)
von: Zhang, Runyu, et al.
Veröffentlicht: (2025)
Feasible Policy Iteration for Safe Reinforcement Learning
von: Yang, Yujie, et al.
Veröffentlicht: (2023)
von: Yang, Yujie, et al.
Veröffentlicht: (2023)
Foundations of Safe Online Reinforcement Learning in the Linear Quadratic Regulator: Generalized Baselines
von: Schiffer, Benjamin, et al.
Veröffentlicht: (2024)
von: Schiffer, Benjamin, et al.
Veröffentlicht: (2024)
Safe and Robust Reinforcement Learning: Principles and Practice
von: Yamagata, Taku, et al.
Veröffentlicht: (2024)
von: Yamagata, Taku, et al.
Veröffentlicht: (2024)
LexiSafe: Offline Safe Reinforcement Learning with Lexicographic Safety-Reward Hierarchy
von: Yang, Hsin-Jung, et al.
Veröffentlicht: (2026)
von: Yang, Hsin-Jung, et al.
Veröffentlicht: (2026)
Model-free Reinforcement Learning for Model-based Control: Towards Safe, Interpretable and Sample-efficient Agents
von: Banker, Thomas, et al.
Veröffentlicht: (2025)
von: Banker, Thomas, et al.
Veröffentlicht: (2025)
C-STEP: Continuous Space-Time Empowerment for Physics-informed Safe Reinforcement Learning of Mobile Agents
von: Daubt, Guihlerme, et al.
Veröffentlicht: (2026)
von: Daubt, Guihlerme, et al.
Veröffentlicht: (2026)
Kernel-Based Safe Exploration in Deep Reinforcement Learning
von: Majumdar, Rupak, et al.
Veröffentlicht: (2026)
von: Majumdar, Rupak, et al.
Veröffentlicht: (2026)
Safe Reinforcement Learning with Minimal Supervision
von: Quessy, Alexander, et al.
Veröffentlicht: (2025)
von: Quessy, Alexander, et al.
Veröffentlicht: (2025)
Convergence and stability of Q-learning in Hierarchical Reinforcement Learning
von: Manenti, Massimiliano, et al.
Veröffentlicht: (2025)
von: Manenti, Massimiliano, et al.
Veröffentlicht: (2025)
Decentralized Event-Triggered Online Learning for Safe Consensus of Multi-Agent Systems with Gaussian Process Regression
von: Dai, Xiaobing, et al.
Veröffentlicht: (2024)
von: Dai, Xiaobing, et al.
Veröffentlicht: (2024)
Federated Multi-Agent Deep Reinforcement Learning Approach via Physics-Informed Reward for Multi-Microgrid Energy Management
von: Li, Yuanzheng, et al.
Veröffentlicht: (2022)
von: Li, Yuanzheng, et al.
Veröffentlicht: (2022)
Structured Cooperative Multi-Agent Reinforcement Learning: a Bayesian Network Perspective
von: Syed, Shahbaz P Qadri, et al.
Veröffentlicht: (2025)
von: Syed, Shahbaz P Qadri, et al.
Veröffentlicht: (2025)
How Does the Lagrangian Guide Safe Reinforcement Learning through Diffusion Models?
von: Cheng, Xiaoyuan, et al.
Veröffentlicht: (2026)
von: Cheng, Xiaoyuan, et al.
Veröffentlicht: (2026)
Multi-Agent Reinforcement Learning for Offloading Cellular Communications with Cooperating UAVs
von: Mondal, Abhishek, et al.
Veröffentlicht: (2024)
von: Mondal, Abhishek, et al.
Veröffentlicht: (2024)
Provable Traffic Rule Compliance in Safe Reinforcement Learning on the Open Sea
von: Krasowski, Hanna, et al.
Veröffentlicht: (2024)
von: Krasowski, Hanna, et al.
Veröffentlicht: (2024)
A Safe Reinforcement Learning Algorithm for Supervisory Control of Power Plants
von: Sun, Yixuan, et al.
Veröffentlicht: (2024)
von: Sun, Yixuan, et al.
Veröffentlicht: (2024)
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
von: Yan, Runze, et al.
Veröffentlicht: (2025)
von: Yan, Runze, et al.
Veröffentlicht: (2025)
The Synergy Between Optimal Transport Theory and Multi-Agent Reinforcement Learning
von: Baheri, Ali, et al.
Veröffentlicht: (2024)
von: Baheri, Ali, et al.
Veröffentlicht: (2024)
Nonuniqueness and Convergence to Equivalent Solutions in Observer-based Inverse Reinforcement Learning
von: Town, Jared, et al.
Veröffentlicht: (2022)
von: Town, Jared, et al.
Veröffentlicht: (2022)
Optimizing Operation Recipes with Reinforcement Learning for Safe and Interpretable Control of Chemical Processes
von: Brandner, Dean, et al.
Veröffentlicht: (2025)
von: Brandner, Dean, et al.
Veröffentlicht: (2025)
Foundations of Safe Online Reinforcement Learning in the Linear Quadratic Regulator: $\sqrt{T}$-Regret
von: Schiffer, Benjamin, et al.
Veröffentlicht: (2025)
von: Schiffer, Benjamin, et al.
Veröffentlicht: (2025)
WFCRL: A Multi-Agent Reinforcement Learning Benchmark for Wind Farm Control
von: Monroc, Claire Bizon, et al.
Veröffentlicht: (2025)
von: Monroc, Claire Bizon, et al.
Veröffentlicht: (2025)
Training Task Reasoning LLM Agents for Multi-turn Task Planning via Single-turn Reinforcement Learning
von: Hu, Hanjiang, et al.
Veröffentlicht: (2025)
von: Hu, Hanjiang, et al.
Veröffentlicht: (2025)
Learning Dissipative Chaotic Dynamics with Boundedness Guarantees
von: Tang, Sunbochen, et al.
Veröffentlicht: (2024)
von: Tang, Sunbochen, et al.
Veröffentlicht: (2024)
Alleviating Community Fear in Disasters via Multi-Agent Actor-Critic Reinforcement Learning
von: Hakke, Yashodhan D., et al.
Veröffentlicht: (2026)
von: Hakke, Yashodhan D., et al.
Veröffentlicht: (2026)
Learning Approximate Nash Equilibria in Cooperative Multi-Agent Reinforcement Learning via Mean-Field Subsampling
von: Anand, Emile, et al.
Veröffentlicht: (2026)
von: Anand, Emile, et al.
Veröffentlicht: (2026)
Meta-Learning for Adaptive Control with Automated Mirror Descent
von: Tang, Sunbochen, et al.
Veröffentlicht: (2024)
von: Tang, Sunbochen, et al.
Veröffentlicht: (2024)
Risk-Aware Safe Reinforcement Learning for Control of Stochastic Linear Systems
von: Esmaeili, Babak, et al.
Veröffentlicht: (2025)
von: Esmaeili, Babak, et al.
Veröffentlicht: (2025)
Safe Reinforcement Learning-Based Vibration Control: Overcoming Training Risks with LQR Guidance
von: Thorat, Rohan Vitthal, et al.
Veröffentlicht: (2025)
von: Thorat, Rohan Vitthal, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Reverse Flow Matching: A Unified Framework for Online Reinforcement Learning with Diffusion and Flow Policies
von: Li, Zeyang, et al.
Veröffentlicht: (2026) -
HardFlow: Hard-Constrained Sampling for Flow-Matching Models via Trajectory Optimization
von: Li, Zeyang, et al.
Veröffentlicht: (2025) -
Personalized Collaborative Learning with Affinity-Based Variance Reduction
von: Zhang, Chenyu, et al.
Veröffentlicht: (2025) -
ECO: Energy-Constrained Operator Learning for Chaotic Dynamics with Boundedness Guarantees
von: Goertzen, Andrea, et al.
Veröffentlicht: (2025) -
ORFit: One-Pass Learning via Bridging Orthogonal Gradient Descent and Recursive Least-Squares
von: Min, Youngjae, et al.
Veröffentlicht: (2022)