Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ren, Zhenjie, Wei, Xiaoli, Yu, Xiang, Zhou, Xun Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms
par: Ren, Zhenjie, et autres
Publié: (2026)
par: Ren, Zhenjie, et autres
Publié: (2026)
Continuous-time q-learning for mean-field control problems
par: Wei, Xiaoli, et autres
Publié: (2023)
par: Wei, Xiaoli, et autres
Publié: (2023)
Graphon Mean-Field Control for Cooperative Multi-Agent Reinforcement Learning
par: Hu, Yuanquan, et autres
Publié: (2022)
par: Hu, Yuanquan, et autres
Publié: (2022)
Hybrid topology control: a dynamic leader-based distributed edge-addition and deletion mechanism
par: Garg, Kunal, et autres
Publié: (2026)
par: Garg, Kunal, et autres
Publié: (2026)
Distributed Stochastic Zeroth-Order Optimization with Compressed Communication
par: Hua, Youqing, et autres
Publié: (2025)
par: Hua, Youqing, et autres
Publié: (2025)
Unified continuous-time q-learning for mean-field game and mean-field control problems
par: Wei, Xiaoli, et autres
Publié: (2024)
par: Wei, Xiaoli, et autres
Publié: (2024)
Scalable spectral representations for multi-agent reinforcement learning in network MDPs
par: Ren, Zhaolin, et autres
Publié: (2024)
par: Ren, Zhaolin, et autres
Publié: (2024)
Model predictive altitude and velocity control in ergodic potential field directed multi-UAV search
par: Lanča, Luka, et autres
Publié: (2024)
par: Lanča, Luka, et autres
Publié: (2024)
An active learning method for solving competitive multi-agent decision-making and control problems
par: Fabiani, Filippo, et autres
Publié: (2022)
par: Fabiani, Filippo, et autres
Publié: (2022)
On time-inconsistent extended mean-field control problems with common noise
par: Liang, Zongxia, et autres
Publié: (2024)
par: Liang, Zongxia, et autres
Publié: (2024)
Approximate constrained stochastic optimal control via parameterized input inference
par: Syed, Shahbaz P Qadri, et autres
Publié: (2025)
par: Syed, Shahbaz P Qadri, et autres
Publié: (2025)
Extended mean-field control problems with Poissonian common noise: Stochastic maximum principle and Hamiltonian-Jacobi-Bellman equation
par: Bo, Lijun, et autres
Publié: (2024)
par: Bo, Lijun, et autres
Publié: (2024)
Exploiting inter-agent coupling information for efficient reinforcement learning of cooperative LQR
par: Syed, Shahbaz P Qadri, et autres
Publié: (2025)
par: Syed, Shahbaz P Qadri, et autres
Publié: (2025)
Cooperative event-based rigid formation control
par: Sun, Zhiyong, et autres
Publié: (2019)
par: Sun, Zhiyong, et autres
Publié: (2019)
Consensus on Open Multi-Agent Systems Over Graphs Sampled from Graphons
par: Vizuete, Renato, et autres
Publié: (2025)
par: Vizuete, Renato, et autres
Publié: (2025)
Sequential Binary Hypothesis Testing with Competing Agents under Information Asymmetry
par: Raghavan, Aneesh, et autres
Publié: (2025)
par: Raghavan, Aneesh, et autres
Publié: (2025)
A Class of Distributed Event-Triggered Average Consensus Algorithms for Multi-Agent Systems
par: Xu, Ping, et autres
Publié: (2019)
par: Xu, Ping, et autres
Publié: (2019)
Hessian Riemannian Flow For Multi-Population Wardrop Equilibrium
par: Bakaryan, Tigran, et autres
Publié: (2025)
par: Bakaryan, Tigran, et autres
Publié: (2025)
Unique Ergodicity in the Interconnections of Ensembles with Applications to Two-Sided Markets
par: Griggs, Wynita M., et autres
Publié: (2021)
par: Griggs, Wynita M., et autres
Publié: (2021)
Nash equilibrium seeking for a class of quadratic-bilinear Wasserstein distributionally robust games
par: Pantazis, Georgios, et autres
Publié: (2024)
par: Pantazis, Georgios, et autres
Publié: (2024)
Distributed Traffic Signal Control via Coordinated Maximum Pressure-plus-Penalty
par: Tütsch, Vinzenz, et autres
Publié: (2024)
par: Tütsch, Vinzenz, et autres
Publié: (2024)
Distributed Non-Uniform Scaling Control of Multi-Agent Formation via Matrix-Valued Constraints
par: He, Tao, et autres
Publié: (2025)
par: He, Tao, et autres
Publié: (2025)
Collective decision-making dynamics in hypernetworks
par: Fontan, Angela, et autres
Publié: (2025)
par: Fontan, Angela, et autres
Publié: (2025)
Exact Leader Estimation: A New Approach for Distributed Differentiation
par: Aldana-Lopez, Rodrigo, et autres
Publié: (2025)
par: Aldana-Lopez, Rodrigo, et autres
Publié: (2025)
A novel load distribution strategy for aggregators using IoT-enabled mobile devices
par: Shivaraman, Nitin, et autres
Publié: (2024)
par: Shivaraman, Nitin, et autres
Publié: (2024)
Distributed Quasi-Newton Method for Multi-Agent Optimization
par: Shorinwa, Ola, et autres
Publié: (2024)
par: Shorinwa, Ola, et autres
Publié: (2024)
Non-Ergodic Convergence Algorithms for Distributed Consensus and Coupling-Constrained Optimization
par: Qiu, Chenyang, et autres
Publié: (2025)
par: Qiu, Chenyang, et autres
Publié: (2025)
Welfare and Cost Aggregation for Multi-Agent Control: When to Choose Which Social Cost Function, and Why?
par: Shilov, Ilia, et autres
Publié: (2025)
par: Shilov, Ilia, et autres
Publié: (2025)
Leader-following Consensus over Jointly Connected Switching Networks is Achievable for Exponentially Unstable Linear Systems
par: Chen, Yuhan, et autres
Publié: (2026)
par: Chen, Yuhan, et autres
Publié: (2026)
A cutting-surface consensus approach for distributed robust optimization of multi-agent systems
par: Fu, Jun, et autres
Publié: (2023)
par: Fu, Jun, et autres
Publié: (2023)
A Dynamically Weighted ADMM Framework for Byzantine Resilience
par: Vijay, Vishnu, et autres
Publié: (2025)
par: Vijay, Vishnu, et autres
Publié: (2025)
Homogeneous Distributed Observers for Quasilinear Systems
par: Li, Min, et autres
Publié: (2024)
par: Li, Min, et autres
Publié: (2024)
Alternating Direction Method of Multipliers-Based Parallel Optimization for Multi-Agent Collision-Free Model Predictive Control
par: Cheng, Zilong, et autres
Publié: (2021)
par: Cheng, Zilong, et autres
Publié: (2021)
Recomputing Solutions to Perturbed Multi-Commodity Pickup and Delivery Vehicle Routing Problems using Monte Carlo Tree Search
par: Goutham, Mithun, et autres
Publié: (2023)
par: Goutham, Mithun, et autres
Publié: (2023)
Variance-Reduced Gradient Estimator for Nonconvex Zeroth-Order Distributed Optimization
par: Mu, Huaiyi, et autres
Publié: (2024)
par: Mu, Huaiyi, et autres
Publié: (2024)
A Zeroth-Order Proximal Algorithm for Consensus Optimization
par: Wang, Chengan, et autres
Publié: (2024)
par: Wang, Chengan, et autres
Publié: (2024)
Pathfinders in the Sky: Formal Decision-Making Models for Collaborative Air Traffic Control in Convective Weather
par: Choi, Jimin, et autres
Publié: (2025)
par: Choi, Jimin, et autres
Publié: (2025)
Constructing Stochastic Matrices for Weighted Averaging in Gossip Networks
par: Bayram, Erkan, et autres
Publié: (2025)
par: Bayram, Erkan, et autres
Publié: (2025)
The $s$-Energy and Its Applications
par: Chazelle, Bernard, et autres
Publié: (2024)
par: Chazelle, Bernard, et autres
Publié: (2024)
Virtual Force-Based Routing of Modular Agents on a Graph
par: Casselman, Adam, et autres
Publié: (2025)
par: Casselman, Adam, et autres
Publié: (2025)
Documents similaires
-
Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms
par: Ren, Zhenjie, et autres
Publié: (2026) -
Continuous-time q-learning for mean-field control problems
par: Wei, Xiaoli, et autres
Publié: (2023) -
Graphon Mean-Field Control for Cooperative Multi-Agent Reinforcement Learning
par: Hu, Yuanquan, et autres
Publié: (2022) -
Hybrid topology control: a dynamic leader-based distributed edge-addition and deletion mechanism
par: Garg, Kunal, et autres
Publié: (2026) -
Distributed Stochastic Zeroth-Order Optimization with Compressed Communication
par: Hua, Youqing, et autres
Publié: (2025)