Scalable spectral representations for multi-agent reinforcement learning in network MDPs
Fuente:
arXiv
Guardado en:
| Autores principales: | Ren, Zhaolin, Zhang, Runyu, Dai, Bo, Li, Na |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Exploiting inter-agent coupling information for efficient reinforcement learning of cooperative LQR
por: Syed, Shahbaz P Qadri, et al.
Publicado: (2025)
por: Syed, Shahbaz P Qadri, et al.
Publicado: (2025)
An active learning method for solving competitive multi-agent decision-making and control problems
por: Fabiani, Filippo, et al.
Publicado: (2022)
por: Fabiani, Filippo, et al.
Publicado: (2022)
Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms
por: Ren, Zhenjie, et al.
Publicado: (2026)
por: Ren, Zhenjie, et al.
Publicado: (2026)
Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations
por: Ren, Zhenjie, et al.
Publicado: (2026)
por: Ren, Zhenjie, et al.
Publicado: (2026)
Principled Learning-to-Communicate with Quasi-Classical Information Structures
por: Liu, Xiangyu, et al.
Publicado: (2026)
por: Liu, Xiangyu, et al.
Publicado: (2026)
A cutting-surface consensus approach for distributed robust optimization of multi-agent systems
por: Fu, Jun, et al.
Publicado: (2023)
por: Fu, Jun, et al.
Publicado: (2023)
Approximate Linear Programming for Decentralized Policy Iteration in Cooperative Multi-agent Markov Decision Processes
por: Mandal, Lakshmi, et al.
Publicado: (2023)
por: Mandal, Lakshmi, et al.
Publicado: (2023)
Logarithmically Quantized Distributed Optimization over Dynamic Multi-Agent Networks
por: Doostmohammadian, Mohammadreza, et al.
Publicado: (2024)
por: Doostmohammadian, Mohammadreza, et al.
Publicado: (2024)
A Generalized Sinkhorn Algorithm for Mean-Field Schrödinger Bridge
por: Eldesoukey, Asmaa, et al.
Publicado: (2026)
por: Eldesoukey, Asmaa, et al.
Publicado: (2026)
Distributed Online Submodular Maximization under Communication Delays: A Simultaneous Decision-Making Approach
por: Xu, Zirui, et al.
Publicado: (2026)
por: Xu, Zirui, et al.
Publicado: (2026)
Hierarchical Decentralized Stochastic Control for Cyber-Physical Systems
por: Kaza, Kesav, et al.
Publicado: (2025)
por: Kaza, Kesav, et al.
Publicado: (2025)
Robust Online Learning over Networks
por: Bastianello, Nicola, et al.
Publicado: (2023)
por: Bastianello, Nicola, et al.
Publicado: (2023)
Formation Shape Control using the Gromov-Wasserstein Metric
por: Nakashima, Haruto, et al.
Publicado: (2025)
por: Nakashima, Haruto, et al.
Publicado: (2025)
Optimization and Learning in Open Multi-Agent Systems
por: Deplano, Diego, et al.
Publicado: (2025)
por: Deplano, Diego, et al.
Publicado: (2025)
Structured Cooperative Multi-Agent Reinforcement Learning: a Bayesian Network Perspective
por: Syed, Shahbaz P Qadri, et al.
Publicado: (2025)
por: Syed, Shahbaz P Qadri, et al.
Publicado: (2025)
Discrete GCBF Proximal Policy Optimization for Multi-agent Safe Optimal Control
por: Zhang, Songyuan, et al.
Publicado: (2025)
por: Zhang, Songyuan, et al.
Publicado: (2025)
DeMuon: A Decentralized Muon for Matrix Optimization over Graphs
por: He, Chuan, et al.
Publicado: (2025)
por: He, Chuan, et al.
Publicado: (2025)
Thinking Beyond Visibility: A Near-Optimal Policy Framework for Locally Interdependent Multi-Agent MDPs
por: DeWeese, Alex, et al.
Publicado: (2025)
por: DeWeese, Alex, et al.
Publicado: (2025)
Near-Optimal Online Learning for Multi-Agent Submodular Coordination: Tight Approximation and Communication Efficiency
por: Zhang, Qixin, et al.
Publicado: (2025)
por: Zhang, Qixin, et al.
Publicado: (2025)
SAFE--MA--RRT: Multi-Agent Motion Planning with Data-Driven Safety Certificates
por: Esmaeili, Babak, et al.
Publicado: (2025)
por: Esmaeili, Babak, et al.
Publicado: (2025)
Effective Policy Learning for Multi-Agent Online Coordination Beyond Submodular Objectives
por: Zhang, Qixin, et al.
Publicado: (2025)
por: Zhang, Qixin, et al.
Publicado: (2025)
Securing Equal Share: A Principled Approach for Learning Multiplayer Symmetric Games
por: Ge, Jiawei, et al.
Publicado: (2024)
por: Ge, Jiawei, et al.
Publicado: (2024)
Analysis of Multiscale Reinforcement Q-Learning Algorithms for Mean Field Control Games
por: Angiuli, Andrea, et al.
Publicado: (2024)
por: Angiuli, Andrea, et al.
Publicado: (2024)
Momentum for the Win: Collaborative Federated Reinforcement Learning across Heterogeneous Environments
por: Wang, Han, et al.
Publicado: (2024)
por: Wang, Han, et al.
Publicado: (2024)
Distributed Thompson sampling under constrained communication
por: Zerefa, Saba, et al.
Publicado: (2024)
por: Zerefa, Saba, et al.
Publicado: (2024)
Data/moment-driven approaches for fast predictive control of collective dynamics
por: Albi, Giacomo, et al.
Publicado: (2024)
por: Albi, Giacomo, et al.
Publicado: (2024)
Deep Distributed Optimization for Large-Scale Quadratic Programming
por: Saravanos, Augustinos D., et al.
Publicado: (2024)
por: Saravanos, Augustinos D., et al.
Publicado: (2024)
Linear Convergence of Independent Natural Policy Gradient in Games with Entropy Regularization
por: Sun, Youbang, et al.
Publicado: (2024)
por: Sun, Youbang, et al.
Publicado: (2024)
Community-based Multi-Agent Reinforcement Learning with Transfer and Active Exploration
por: Shi, Zhaoyang
Publicado: (2025)
por: Shi, Zhaoyang
Publicado: (2025)
On the Reliability Limits of LLM-Based Multi-Agent Planning
por: Ao, Ruicheng, et al.
Publicado: (2026)
por: Ao, Ruicheng, et al.
Publicado: (2026)
High-Probability Convergence in Decentralized Stochastic Optimization with Gradient Tracking
por: Armacki, Aleksandar, et al.
Publicado: (2026)
por: Armacki, Aleksandar, et al.
Publicado: (2026)
High-Probability Convergence Guarantees of Decentralized SGD
por: Armacki, Aleksandar, et al.
Publicado: (2025)
por: Armacki, Aleksandar, et al.
Publicado: (2025)
Distributed Random Reshuffling Methods with Improved Convergence
por: Huang, Kun, et al.
Publicado: (2023)
por: Huang, Kun, et al.
Publicado: (2023)
Diffusion Stochastic Learning Over Adaptive Competing Networks
por: Zhao, Yike, et al.
Publicado: (2025)
por: Zhao, Yike, et al.
Publicado: (2025)
Learning Decentralized Partially Observable Mean Field Control for Artificial Collective Behavior
por: Cui, Kai, et al.
Publicado: (2023)
por: Cui, Kai, et al.
Publicado: (2023)
Adaptive Decentralized Composite Optimization via Three-Operator Splitting
por: Chen, Xiaokai, et al.
Publicado: (2026)
por: Chen, Xiaokai, et al.
Publicado: (2026)
Decentralized Online Riemannian Optimization Beyond Hadamard Manifolds
por: Sahinoglu, Emre, et al.
Publicado: (2025)
por: Sahinoglu, Emre, et al.
Publicado: (2025)
Major-Minor Mean Field Multi-Agent Reinforcement Learning
por: Cui, Kai, et al.
Publicado: (2023)
por: Cui, Kai, et al.
Publicado: (2023)
Stochastic Approximation with Delayed Updates: Finite-Time Rates under Markovian Sampling
por: Adibi, Arman, et al.
Publicado: (2024)
por: Adibi, Arman, et al.
Publicado: (2024)
Fast algorithm for centralized multi-agent maze exploration
por: Crnković, Bojan, et al.
Publicado: (2023)
por: Crnković, Bojan, et al.
Publicado: (2023)
Ejemplares similares
-
Exploiting inter-agent coupling information for efficient reinforcement learning of cooperative LQR
por: Syed, Shahbaz P Qadri, et al.
Publicado: (2025) -
An active learning method for solving competitive multi-agent decision-making and control problems
por: Fabiani, Filippo, et al.
Publicado: (2022) -
Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms
por: Ren, Zhenjie, et al.
Publicado: (2026) -
Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations
por: Ren, Zhenjie, et al.
Publicado: (2026) -
Principled Learning-to-Communicate with Quasi-Classical Information Structures
por: Liu, Xiangyu, et al.
Publicado: (2026)