CMAD: Cooperative Multi-Agent Diffusion via Stochastic Optimal Control
Fuente:
arXiv
Salvato in:
| Autori principali: | Barbano, Riccardo, Denker, Alexander, Kereta, Zeljko, Li, Runchang, Vargas, Francisco |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Continuous Policy and Value Iteration for Stochastic Control Problems and Its Convergence
di: Feng, Qi, et al.
Pubblicazione: (2025)
di: Feng, Qi, et al.
Pubblicazione: (2025)
Globally Solving Unbalanced Optimal Transport and Density Control for Gaussian Distributions
di: Nakashima, Haruto, et al.
Pubblicazione: (2026)
di: Nakashima, Haruto, et al.
Pubblicazione: (2026)
Continuous-time Risk-sensitive Reinforcement Learning via Quadratic Variation Penalty
di: Jia, Yanwei
Pubblicazione: (2024)
di: Jia, Yanwei
Pubblicazione: (2024)
Stability and Sensitivity Analysis of Relative Temporal-Difference Learning: Extended Version
di: Sakha, Masoud S., et al.
Pubblicazione: (2026)
di: Sakha, Masoud S., et al.
Pubblicazione: (2026)
Optimistic Training and Convergence of Q-Learning -- Extended Version
di: Mehta, Prashant, et al.
Pubblicazione: (2026)
di: Mehta, Prashant, et al.
Pubblicazione: (2026)
Optimal Feedback Control in Social Networks in a McKean-Vlasov-Friedkin-Johnsen System
di: Pramanik, Paramahansa
Pubblicazione: (2025)
di: Pramanik, Paramahansa
Pubblicazione: (2025)
Discrete-Time Approximations of Controlled Diffusions with Infinite Horizon Discounted and Average Cost
di: Pradhan, Somnath, et al.
Pubblicazione: (2025)
di: Pradhan, Somnath, et al.
Pubblicazione: (2025)
Neural Policy Iteration for Stochastic Optimal Control: A Physics-Informed Approach
di: Kim, Yeongjong, et al.
Pubblicazione: (2025)
di: Kim, Yeongjong, et al.
Pubblicazione: (2025)
Beyond Bellman: High-Order Generator Regression for Continuous-Time Policy Evaluation
di: Zheng, Yaowei, et al.
Pubblicazione: (2026)
di: Zheng, Yaowei, et al.
Pubblicazione: (2026)
Turnpike Property of Stochastic Linear-Quadratic Optimal Control Problems in Large Horizons with Regime Switching I: Homogeneous Cases
di: Mei, Hongwei, et al.
Pubblicazione: (2025)
di: Mei, Hongwei, et al.
Pubblicazione: (2025)
Stochastic linear-quadratic differential game with Markovian jumps in an infinite horizon
di: Wu, Fan, et al.
Pubblicazione: (2024)
di: Wu, Fan, et al.
Pubblicazione: (2024)
The Ergodic Linear-Quadratic Optimal Control Problems for Stochastic Mean-Field Systems with Periodic Coefficients
di: Wu, Jiacheng, et al.
Pubblicazione: (2025)
di: Wu, Jiacheng, et al.
Pubblicazione: (2025)
Turnpike Property of a Linear-Quadratic Optimal Control Problem in Large Horizons with Regime Switching II: Non-Homogeneous Cases
di: Mei, Hongwei, et al.
Pubblicazione: (2025)
di: Mei, Hongwei, et al.
Pubblicazione: (2025)
Relationship between General MP and DPP for the Stochastic Recursive Optimal Control Problem With Jumps: Viscosity Solution Framework
di: Wang, Bin, et al.
Pubblicazione: (2024)
di: Wang, Bin, et al.
Pubblicazione: (2024)
Finite-Time Analysis of Projected Two-Time-Scale Stochastic Approximation
di: Bai, Yitao, et al.
Pubblicazione: (2026)
di: Bai, Yitao, et al.
Pubblicazione: (2026)
Robust Recurrence of Discrete-Time Infinite-Horizon Stochastic Optimal Control with Discounted Cost
di: Moldenhauer, Robert H., et al.
Pubblicazione: (2025)
di: Moldenhauer, Robert H., et al.
Pubblicazione: (2025)
Stochastic Control with Signatures
di: Bank, P., et al.
Pubblicazione: (2024)
di: Bank, P., et al.
Pubblicazione: (2024)
Asynchronous Stochastic Approximation with Applications to Average-Reward Reinforcement Learning
di: Yu, Huizhen, et al.
Pubblicazione: (2024)
di: Yu, Huizhen, et al.
Pubblicazione: (2024)
Multi-Agent Best Arm Identification in Stochastic Linear Bandits
di: Agrawal, Sanjana, et al.
Pubblicazione: (2024)
di: Agrawal, Sanjana, et al.
Pubblicazione: (2024)
Sample Complexity of Policy Gradient for Log-Growth Control
di: Pan, Qiuhua, et al.
Pubblicazione: (2026)
di: Pan, Qiuhua, et al.
Pubblicazione: (2026)
Stability and performance of stochastic economic MPC - Stochastic characterization of the closed-loop asymptotics
di: Schießl, Jonas, et al.
Pubblicazione: (2025)
di: Schießl, Jonas, et al.
Pubblicazione: (2025)
Reinforcement Learning, Optimal Control, and Bayesian Filtering in Data Assimilation
di: Hammoud, Abed
Pubblicazione: (2026)
di: Hammoud, Abed
Pubblicazione: (2026)
Signalling and Control in Nonlinear Stochastic Systems: An Information State Approach with Applications
di: Charalambous, Charalambos D., et al.
Pubblicazione: (2024)
di: Charalambous, Charalambos D., et al.
Pubblicazione: (2024)
Reconciling Discrete-Time Mixed Policies and Continuous-Time Relaxed Controls in Reinforcement Learning and Stochastic Control
di: Carmona, Rene, et al.
Pubblicazione: (2025)
di: Carmona, Rene, et al.
Pubblicazione: (2025)
Maximum Principle of Stochastic Optimal Control Problems with Model Uncertainty
di: Hao, Tao, et al.
Pubblicazione: (2023)
di: Hao, Tao, et al.
Pubblicazione: (2023)
Gradient Flows for Regularized Stochastic Control Problems
di: Šiška, David, et al.
Pubblicazione: (2020)
di: Šiška, David, et al.
Pubblicazione: (2020)
The Optimal Control Problem of Stochastic Differential System with Extended Mixed Delays and Applications
di: Li, Xinpo, et al.
Pubblicazione: (2026)
di: Li, Xinpo, et al.
Pubblicazione: (2026)
Stochastic Optimal Impulse Controls with Changing Running Costs
di: Cao, Yuchen, et al.
Pubblicazione: (2025)
di: Cao, Yuchen, et al.
Pubblicazione: (2025)
Optimal Control of Unbounded Functional Stochastic Evolution Systems in Hilbert Spaces: Second-Order Path-dependent HJB Equation
di: Tang, Shanjian, et al.
Pubblicazione: (2024)
di: Tang, Shanjian, et al.
Pubblicazione: (2024)
Soft-constrained Schrodinger Bridge: a Stochastic Control Approach
di: Garg, Jhanvi, et al.
Pubblicazione: (2024)
di: Garg, Jhanvi, et al.
Pubblicazione: (2024)
Relationships Between the Maximum Principle and Dynamic Programming for Infinite Dimensional Non-Markovian Stochastic Control Systems
di: Gao, Dingqian, et al.
Pubblicazione: (2025)
di: Gao, Dingqian, et al.
Pubblicazione: (2025)
Near Optimality of Lipschitz and Smooth Policies in Controlled Diffusions
di: Pradhan, Somnath, et al.
Pubblicazione: (2024)
di: Pradhan, Somnath, et al.
Pubblicazione: (2024)
Stochastic Singular Linear Systems and Related Linear-Quadratic Optimal Control Problems under Finite and Infinite Horizons
di: Li, Mengzhen, et al.
Pubblicazione: (2024)
di: Li, Mengzhen, et al.
Pubblicazione: (2024)
Indefinite Stochastic Linear-Quadratic Optimal Control Problems with Random Coefficients and Poisson Jumps: Closed-Loop Representation of Open-Loop Optimal Controls
di: Ding, Kai, et al.
Pubblicazione: (2026)
di: Ding, Kai, et al.
Pubblicazione: (2026)
Average Cost Optimality of Partially Observed MDPS: Contraction of Non-linear Filters, Optimal Solutions and Approximations
di: Demirci, Yunus Emre, et al.
Pubblicazione: (2023)
di: Demirci, Yunus Emre, et al.
Pubblicazione: (2023)
Automatic model training under restrictive time constraints
di: Cironis, Lukas, et al.
Pubblicazione: (2021)
di: Cironis, Lukas, et al.
Pubblicazione: (2021)
A Policy Gradient Framework for Stochastic Optimal Control Problems with Global Convergence Guarantee
di: Zhou, Mo, et al.
Pubblicazione: (2023)
di: Zhou, Mo, et al.
Pubblicazione: (2023)
Open-loop and closed-loop solvabilities for zero-sum stochastic linear quadratic differential games of Markovian regime switching system
di: Wu, Fan, et al.
Pubblicazione: (2024)
di: Wu, Fan, et al.
Pubblicazione: (2024)
Continuous time Stochastic optimal control under discrete time partial observations
di: Bayer, Christian, et al.
Pubblicazione: (2024)
di: Bayer, Christian, et al.
Pubblicazione: (2024)
Control randomisation approach for policy gradient and application to reinforcement learning in optimal switching
di: Denkert, Robert, et al.
Pubblicazione: (2024)
di: Denkert, Robert, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Continuous Policy and Value Iteration for Stochastic Control Problems and Its Convergence
di: Feng, Qi, et al.
Pubblicazione: (2025) -
Globally Solving Unbalanced Optimal Transport and Density Control for Gaussian Distributions
di: Nakashima, Haruto, et al.
Pubblicazione: (2026) -
Continuous-time Risk-sensitive Reinforcement Learning via Quadratic Variation Penalty
di: Jia, Yanwei
Pubblicazione: (2024) -
Stability and Sensitivity Analysis of Relative Temporal-Difference Learning: Extended Version
di: Sakha, Masoud S., et al.
Pubblicazione: (2026) -
Optimistic Training and Convergence of Q-Learning -- Extended Version
di: Mehta, Prashant, et al.
Pubblicazione: (2026)