Markov Decision Processes of the Third Kind: Learning Distributions by Policy Gradient Descent
Fuente:
arXiv
Salvato in:
| Autori principali: | Bäuerle, Nicole, Vasileiadis, Athanasios |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Bellman: High-Order Generator Regression for Continuous-Time Policy Evaluation
di: Zheng, Yaowei, et al.
Pubblicazione: (2026)
di: Zheng, Yaowei, et al.
Pubblicazione: (2026)
Policy stability and ultimate stationarity in discounted risk-sensitive stochastic control
di: Bäuerle, Nicole, et al.
Pubblicazione: (2026)
di: Bäuerle, Nicole, et al.
Pubblicazione: (2026)
Blackwell optimality and policy stability for long-run risk sensitive stochastic control
di: Bäuerle, Nicole, et al.
Pubblicazione: (2024)
di: Bäuerle, Nicole, et al.
Pubblicazione: (2024)
Policy Gradient for Continuous-Time Mean-Field Control
di: Bayraktar, Erhan, et al.
Pubblicazione: (2026)
di: Bayraktar, Erhan, et al.
Pubblicazione: (2026)
Continuous time Stochastic optimal control under discrete time partial observations
di: Bayer, Christian, et al.
Pubblicazione: (2024)
di: Bayer, Christian, et al.
Pubblicazione: (2024)
The landscape of deterministic and stochastic optimal control problems: One-shot Optimization versus Dynamic Programming
di: Kim, Jihun, et al.
Pubblicazione: (2024)
di: Kim, Jihun, et al.
Pubblicazione: (2024)
Rockafellian Relaxation for PDE-Constrained Optimization with Distributional Uncertainty
di: Antil, Harbir, et al.
Pubblicazione: (2024)
di: Antil, Harbir, et al.
Pubblicazione: (2024)
Convergence and turnpike properties of linear-quadratic mean field control problems with common noise
di: Bayraktar, Erhan, et al.
Pubblicazione: (2026)
di: Bayraktar, Erhan, et al.
Pubblicazione: (2026)
Operator-Theoretic Foundations and Policy Gradient Methods for General MDPs with Unbounded Costs
di: Gupta, Abhishek, et al.
Pubblicazione: (2026)
di: Gupta, Abhishek, et al.
Pubblicazione: (2026)
Optimal power procurement for green cellular wireless networks under uncertainty and chance constraints
di: Rached, Nadhir Ben, et al.
Pubblicazione: (2025)
di: Rached, Nadhir Ben, et al.
Pubblicazione: (2025)
Ergodicity and turnpike properties of linear-quadratic mean field control problems
di: Bayraktar, Erhan, et al.
Pubblicazione: (2025)
di: Bayraktar, Erhan, et al.
Pubblicazione: (2025)
Sample Complexity of Policy Gradient for Log-Growth Control
di: Pan, Qiuhua, et al.
Pubblicazione: (2026)
di: Pan, Qiuhua, et al.
Pubblicazione: (2026)
Deep Relaxation of Controlled Stochastic Gradient Descent via Singular Perturbations
di: Bardi, Martino, et al.
Pubblicazione: (2022)
di: Bardi, Martino, et al.
Pubblicazione: (2022)
Risk-averse optimization under distributional uncertainty with Rockafellian relaxation
di: Antil, Harbir, et al.
Pubblicazione: (2026)
di: Antil, Harbir, et al.
Pubblicazione: (2026)
Distributed Online Optimization for Multi-Agent Optimal Transport
di: Krishnan, Vishaal, et al.
Pubblicazione: (2018)
di: Krishnan, Vishaal, et al.
Pubblicazione: (2018)
Non-Convex Global Optimization as an Optimal Stabilization Problem: Convergence Rates
di: Huang, Yuyang, et al.
Pubblicazione: (2025)
di: Huang, Yuyang, et al.
Pubblicazione: (2025)
Non-Convex Global Optimization as an Optimal Stabilization Problem: Dynamical Properties
di: Huang, Yuyang, et al.
Pubblicazione: (2025)
di: Huang, Yuyang, et al.
Pubblicazione: (2025)
Asymptotically Optimal Policies for Weakly Coupled Markov Decision Processes
di: Goldsztajn, Diego, et al.
Pubblicazione: (2024)
di: Goldsztajn, Diego, et al.
Pubblicazione: (2024)
A multiscale Consensus-Based algorithm for multi-level optimization
di: Herty, Michael, et al.
Pubblicazione: (2024)
di: Herty, Michael, et al.
Pubblicazione: (2024)
Quantifying the Safety of Trajectories using Peak-Minimizing Control
di: Miller, Jared, et al.
Pubblicazione: (2023)
di: Miller, Jared, et al.
Pubblicazione: (2023)
A Moreau Envelope Approach for LQR Meta-Policy Estimation
di: Aravind, Ashwin, et al.
Pubblicazione: (2024)
di: Aravind, Ashwin, et al.
Pubblicazione: (2024)
Asymptotic Consistency for Nonconvex Risk-Averse Stochastic Optimization with Infinite Dimensional Decision Spaces
di: Milz, Johannes, et al.
Pubblicazione: (2022)
di: Milz, Johannes, et al.
Pubblicazione: (2022)
Convergence of Proximal Policy Gradient Method for Problems with Control Dependent Diffusion Coefficients
di: Davey, Ashley, et al.
Pubblicazione: (2025)
di: Davey, Ashley, et al.
Pubblicazione: (2025)
From Semi-Infinite Constraints to Structured Robust Policies: Optimal Gain Selection for Financial Systems
di: Hsieh, Chung-Han
Pubblicazione: (2022)
di: Hsieh, Chung-Han
Pubblicazione: (2022)
Optimality conditions in control problems with random state constraints in probabilistic or almost-sure form
di: Geiersbach, Caroline, et al.
Pubblicazione: (2023)
di: Geiersbach, Caroline, et al.
Pubblicazione: (2023)
Adjoint-based calibration of nonlinear stochastic differential equations
di: Bartsch, Jan, et al.
Pubblicazione: (2023)
di: Bartsch, Jan, et al.
Pubblicazione: (2023)
Optimality conditions for sparse optimal control of viscous Cahn-Hilliard systems with logarithmic potential
di: Colli, Pierluigi, et al.
Pubblicazione: (2024)
di: Colli, Pierluigi, et al.
Pubblicazione: (2024)
Second-order optimality conditions for the sparse optimal control of nonviscous Cahn-Hilliard systems
di: Colli, Pierluigi, et al.
Pubblicazione: (2024)
di: Colli, Pierluigi, et al.
Pubblicazione: (2024)
Distributionally Robust Markov Decision Processes and their Connection to Risk Measures
di: Bäuerle, Nicole, et al.
Pubblicazione: (2020)
di: Bäuerle, Nicole, et al.
Pubblicazione: (2020)
The Hard-Constraint PINNs for Interface Optimal Control Problems
di: Lai, Ming-Chih, et al.
Pubblicazione: (2023)
di: Lai, Ming-Chih, et al.
Pubblicazione: (2023)
Average Cost Optimality of Partially Observed MDPS: Contraction of Non-linear Filters, Optimal Solutions and Approximations
di: Demirci, Yunus Emre, et al.
Pubblicazione: (2023)
di: Demirci, Yunus Emre, et al.
Pubblicazione: (2023)
Optimal Control in Infinite Dimensional Spaces and Economic Modeling: State of the Art and Perspectives
di: Fabbri, Giorgio, et al.
Pubblicazione: (2025)
di: Fabbri, Giorgio, et al.
Pubblicazione: (2025)
QPLEX Decision Processes: Formulation via Nonlinear Markov Chains and Optimization via Policy Gradients
di: Dieker, Antonius B., et al.
Pubblicazione: (2026)
di: Dieker, Antonius B., et al.
Pubblicazione: (2026)
S-shaped Utility Maximization with VaR Constraint and Partial Information
di: Zhu, Dongmei, et al.
Pubblicazione: (2025)
di: Zhu, Dongmei, et al.
Pubblicazione: (2025)
Micro-Macro Decomposition of Particle Swarm Optimization Methods
di: Herty, Michael, et al.
Pubblicazione: (2025)
di: Herty, Michael, et al.
Pubblicazione: (2025)
Empirical risk minimization for risk-neutral composite optimal control with applications to bang-bang control
di: Milz, Johannes, et al.
Pubblicazione: (2024)
di: Milz, Johannes, et al.
Pubblicazione: (2024)
On the optimal control of viscous Cahn-Hilliard systems with hyperbolic relaxation of the chemical potential
di: Colli, Pierluigi, et al.
Pubblicazione: (2025)
di: Colli, Pierluigi, et al.
Pubblicazione: (2025)
Analysis and Control of Input-Affine Dynamical Systems using Infinite-Dimensional Robust Counterparts
di: Miller, Jared, et al.
Pubblicazione: (2021)
di: Miller, Jared, et al.
Pubblicazione: (2021)
A Primal-Dual Gradient Descent Approach to the Connectivity Constrained Sensor Coverage Problem
di: Agerman, Mathias Bock, et al.
Pubblicazione: (2025)
di: Agerman, Mathias Bock, et al.
Pubblicazione: (2025)
An Inexact Trust-Region Method for Structured Nonsmooth Optimization with Application to Risk-Averse Stochastic Programming
di: Kouri, Drew P.
Pubblicazione: (2026)
di: Kouri, Drew P.
Pubblicazione: (2026)
Documenti analoghi
-
Beyond Bellman: High-Order Generator Regression for Continuous-Time Policy Evaluation
di: Zheng, Yaowei, et al.
Pubblicazione: (2026) -
Policy stability and ultimate stationarity in discounted risk-sensitive stochastic control
di: Bäuerle, Nicole, et al.
Pubblicazione: (2026) -
Blackwell optimality and policy stability for long-run risk sensitive stochastic control
di: Bäuerle, Nicole, et al.
Pubblicazione: (2024) -
Policy Gradient for Continuous-Time Mean-Field Control
di: Bayraktar, Erhan, et al.
Pubblicazione: (2026) -
Continuous time Stochastic optimal control under discrete time partial observations
di: Bayer, Christian, et al.
Pubblicazione: (2024)