Physics-informed approach for exploratory Hamilton--Jacobi--Bellman equations via policy iterations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Yeongjong, Cho, Namkyeong, Kim, Minseok, Kim, Yeoneung |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Neural Policy Iteration for Stochastic Optimal Control: A Physics-Informed Approach
par: Kim, Yeongjong, et autres
Publié: (2025)
par: Kim, Yeongjong, et autres
Publié: (2025)
Neural Actor-Critic Methods for Hamilton-Jacobi-Bellman PDEs: Asymptotic Analysis and Numerical Studies
par: Cohen, Samuel N., et autres
Publié: (2025)
par: Cohen, Samuel N., et autres
Publié: (2025)
Solving nonconvex Hamilton--Jacobi--Isaacs equations with PINN-based policy iteration
par: Yang, Hee Jun, et autres
Publié: (2025)
par: Yang, Hee Jun, et autres
Publié: (2025)
Stabilized neural Hamilton--Jacobi--Bellman solvers: Error analysis and applications in model-based reinforcement learning
par: Kim, Minseok, et autres
Publié: (2026)
par: Kim, Minseok, et autres
Publié: (2026)
Smart leverage? Rethinking the role of Leveraged Exchange Traded Funds in constructing portfolios to beat a benchmark
par: van Staden, Pieter, et autres
Publié: (2024)
par: van Staden, Pieter, et autres
Publié: (2024)
On the Well-posedness of Hamilton-Jacobi-Bellman Equations of the Equilibrium Type
par: Lei, Qian, et autres
Publié: (2023)
par: Lei, Qian, et autres
Publié: (2023)
Optimal control of SDEs with merely measurable drift: an HJB approach
par: Du, Kai, et autres
Publié: (2025)
par: Du, Kai, et autres
Publié: (2025)
A Physics-Informed, Global-in-Time Neural Particle Method for the Spatially Homogeneous Landau Equation
par: Kim, Minseok, et autres
Publié: (2026)
par: Kim, Minseok, et autres
Publié: (2026)
Convergence of policy gradient methods for finite-horizon exploratory linear-quadratic control problems
par: Giegrich, Michael, et autres
Publié: (2022)
par: Giegrich, Michael, et autres
Publié: (2022)
Policy Iteration for Exploratory Hamilton--Jacobi--Bellman Equations
par: Tran, Hung Vinh, et autres
Publié: (2024)
par: Tran, Hung Vinh, et autres
Publié: (2024)
The deep multi-FBSDE method: a robust deep learning method for coupled FBSDEs
par: Andersson, Kristoffer, et autres
Publié: (2025)
par: Andersson, Kristoffer, et autres
Publié: (2025)
Coupled linear Schrödinger equations: Control and stabilization results
par: Bhandari, K., et autres
Publié: (2023)
par: Bhandari, K., et autres
Publié: (2023)
Controls insensitizing the norm of solution of a Schrödinger type system with mixed dispersion
par: Filho, Roberto de A. Capistrano, et autres
Publié: (2020)
par: Filho, Roberto de A. Capistrano, et autres
Publié: (2020)
DeepPAAC: A New Deep Galerkin Method for Principal-Agent Problems
par: Ludkovski, Michael, et autres
Publié: (2025)
par: Ludkovski, Michael, et autres
Publié: (2025)
Hamilton--Jacobi--Bellman equation for optimal control of stochastic Wasserstein--Hamiltonian system on graphs
par: Cui, Jianbo, et autres
Publié: (2025)
par: Cui, Jianbo, et autres
Publié: (2025)
Hamilton--Jacobi equations for controlled gradient flows: the comparison principle
par: Conforti, Giovanni, et autres
Publié: (2021)
par: Conforti, Giovanni, et autres
Publié: (2021)
Observability of dispersive equations from line segments on the torus
par: Wang, Yunlei, et autres
Publié: (2022)
par: Wang, Yunlei, et autres
Publié: (2022)
Finite Codimensionality Method in Infinite-dimensional Optimization Problems
par: Liu, Xu, et autres
Publié: (2021)
par: Liu, Xu, et autres
Publié: (2021)
Global Recovery from Local Data: Interior Nudging for 2D Navier-Stokes equations in a Physical Domain
par: Fang, Rui, et autres
Publié: (2026)
par: Fang, Rui, et autres
Publié: (2026)
Unique continuation and stabilization for nonlinear Schrödinger equations under the Geometric Control Condition
par: Loyola, Cristóbal
Publié: (2025)
par: Loyola, Cristóbal
Publié: (2025)
Controllability and Stabilizability of the Linearized Compressible Navier-Stokes System with Maxwell's Law
par: Ahamed, Sakil, et autres
Publié: (2023)
par: Ahamed, Sakil, et autres
Publié: (2023)
Causal Hamilton-Jacobi-Bellman Equations for Anticipative Stochastic Optimal Control
par: Bank, Peter, et autres
Publié: (2025)
par: Bank, Peter, et autres
Publié: (2025)
Stabilization via localized controls in nonlocal models of crowd dynamics
par: Pogodaev, Nikolay, et autres
Publié: (2024)
par: Pogodaev, Nikolay, et autres
Publié: (2024)
Control randomisation approach for policy gradient and application to reinforcement learning in optimal switching
par: Denkert, Robert, et autres
Publié: (2024)
par: Denkert, Robert, et autres
Publié: (2024)
Carleman estimates for the Korteweg-de Vries equation with piecewise constant main coefficient
par: Loyola, Cristóbal
Publié: (2025)
par: Loyola, Cristóbal
Publié: (2025)
Approximate controllability for 2D Euler equations
par: Rodrigues, Sérgio S.
Publié: (2024)
par: Rodrigues, Sérgio S.
Publié: (2024)
Hamilton-Jacobi Based Policy-Iteration via Deep Operator Learning
par: Lee, Jae Yong, et autres
Publié: (2024)
par: Lee, Jae Yong, et autres
Publié: (2024)
Mean--Variance Portfolio Selection by Continuous-Time Reinforcement Learning: Algorithms, Regret Analysis, and Empirical Study
par: Huang, Yilie, et autres
Publié: (2024)
par: Huang, Yilie, et autres
Publié: (2024)
Deep Relaxation of Controlled Stochastic Gradient Descent via Singular Perturbations
par: Bardi, Martino, et autres
Publié: (2022)
par: Bardi, Martino, et autres
Publié: (2022)
Hamilton--Jacobi equations for Wasserstein controlled gradient flows: existence of viscosity solutions
par: Conforti, Giovanni, et autres
Publié: (2024)
par: Conforti, Giovanni, et autres
Publié: (2024)
Stability and Sensitivity Analysis of Relative Temporal-Difference Learning: Extended Version
par: Sakha, Masoud S., et autres
Publié: (2026)
par: Sakha, Masoud S., et autres
Publié: (2026)
Optimistic Training and Convergence of Q-Learning -- Extended Version
par: Mehta, Prashant, et autres
Publié: (2026)
par: Mehta, Prashant, et autres
Publié: (2026)
Hamilton--Jacobi equations for controlled gradient flows: cylindrical test functions
par: Conforti, Giovanni, et autres
Publié: (2023)
par: Conforti, Giovanni, et autres
Publié: (2023)
Continuous-time Risk-sensitive Reinforcement Learning via Quadratic Variation Penalty
par: Jia, Yanwei
Publié: (2024)
par: Jia, Yanwei
Publié: (2024)
Theoretical and numerical indirect stabilization of coupled wave equations with a single time-delayed damping
par: Moumni, Alhabib, et autres
Publié: (2024)
par: Moumni, Alhabib, et autres
Publié: (2024)
Does DQN Learn?
par: Gopalan, Aditya, et autres
Publié: (2022)
par: Gopalan, Aditya, et autres
Publié: (2022)
Learning to steer with Brownian noise
par: Ankirchner, Stefan, et autres
Publié: (2024)
par: Ankirchner, Stefan, et autres
Publié: (2024)
Finite-Dimensional MOR-Based RHC for Steering 2D Navier-Stokes Equations to Desired Trajectories
par: Azmi, Behzad, et autres
Publié: (2026)
par: Azmi, Behzad, et autres
Publié: (2026)
Policy Iteration for Stationary Discounted Hamilton--Jacobi--Bellman Equations: A Viscosity Approach
par: Cho, Namkyeong, et autres
Publié: (2026)
par: Cho, Namkyeong, et autres
Publié: (2026)
Importance sampling for rare event tracking within the ensemble Kalman filtering framework
par: Rached, Nadhir Ben, et autres
Publié: (2024)
par: Rached, Nadhir Ben, et autres
Publié: (2024)
Documents similaires
-
Neural Policy Iteration for Stochastic Optimal Control: A Physics-Informed Approach
par: Kim, Yeongjong, et autres
Publié: (2025) -
Neural Actor-Critic Methods for Hamilton-Jacobi-Bellman PDEs: Asymptotic Analysis and Numerical Studies
par: Cohen, Samuel N., et autres
Publié: (2025) -
Solving nonconvex Hamilton--Jacobi--Isaacs equations with PINN-based policy iteration
par: Yang, Hee Jun, et autres
Publié: (2025) -
Stabilized neural Hamilton--Jacobi--Bellman solvers: Error analysis and applications in model-based reinforcement learning
par: Kim, Minseok, et autres
Publié: (2026) -
Smart leverage? Rethinking the role of Leveraged Exchange Traded Funds in constructing portfolios to beat a benchmark
par: van Staden, Pieter, et autres
Publié: (2024)