On the continuity and smoothness of the value function in reinforcement learning and optimal control
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Harder, Hans, Peitz, Sebastian |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Observable Neural ODEs for Identifiable Causal Forecasting in Continuous Time
par: Wendland, Jennifer, et autres
Publié: (2026)
par: Wendland, Jennifer, et autres
Publié: (2026)
From Features to States: Data-Driven Selection of Measured State Variables via RFE-DMDc
par: Wang, Haoyu, et autres
Publié: (2025)
par: Wang, Haoyu, et autres
Publié: (2025)
Data-driven optimal prediction with control
par: Katrutsa, Aleksandr, et autres
Publié: (2024)
par: Katrutsa, Aleksandr, et autres
Publié: (2024)
A Moreau Envelope Approach for LQR Meta-Policy Estimation
par: Aravind, Ashwin, et autres
Publié: (2024)
par: Aravind, Ashwin, et autres
Publié: (2024)
Determining Disturbance Recovery Conditions by Inverse Sensitivity Minimization
par: Fisher, Michael W., et autres
Publié: (2025)
par: Fisher, Michael W., et autres
Publié: (2025)
Curve-Induced Dynamical Systems on Riemannian Manifolds and Lie Groups
par: Bakker, Saray, et autres
Publié: (2026)
par: Bakker, Saray, et autres
Publié: (2026)
Dynamics and Computational Principles of Echo State Networks: A Mathematical Perspective
par: Singh, Pradeep, et autres
Publié: (2025)
par: Singh, Pradeep, et autres
Publié: (2025)
From geometry to dynamics: Learning overdamped Langevin dynamics from sparse observations with geometric constraints
par: Maoutsa, Dimitra
Publié: (2025)
par: Maoutsa, Dimitra
Publié: (2025)
Real-Time Learning of Predictive Dynamic Obstacle Models for Robotic Motion Planning
par: Kombo, Stella, et autres
Publié: (2025)
par: Kombo, Stella, et autres
Publié: (2025)
On Higher Order Drift and Diffusion Estimates for Stochastic SINDy
par: Wanner, Mathias, et autres
Publié: (2023)
par: Wanner, Mathias, et autres
Publié: (2023)
Stability of randomly switching stochastic reaction networks with asymptotically linear transition rates
par: Cappelletti, Daniele, et autres
Publié: (2025)
par: Cappelletti, Daniele, et autres
Publié: (2025)
Data-driven Control of T-Product-based Dynamical Systems
par: He, Ziqin, et autres
Publié: (2025)
par: He, Ziqin, et autres
Publié: (2025)
Optimal response for stochastic differential equations by local kernel perturbations
par: del Sarto, Gianmarco, et autres
Publié: (2025)
par: del Sarto, Gianmarco, et autres
Publié: (2025)
Interaction-Aware Model Predictive Decision-Making for Socially-Compliant Autonomous Driving in Mixed Urban Traffic Scenarios
par: Varga, Balint, et autres
Publié: (2025)
par: Varga, Balint, et autres
Publié: (2025)
On Unstable Fixed Points in Modern Continuous Hopfield Networks
par: Beise, Hans-Peter
Publié: (2026)
par: Beise, Hans-Peter
Publié: (2026)
Universal bounds on the entropy of toroidal attractors
par: Macías, P. Montealegre, et autres
Publié: (2024)
par: Macías, P. Montealegre, et autres
Publié: (2024)
Stability properties of Minimal Gated Unit neural networks
par: De Carli, Stefano, et autres
Publié: (2026)
par: De Carli, Stefano, et autres
Publié: (2026)
Chaos-Free Networks are Stable Recurrent Neural Networks
par: De Carli, Stefano, et autres
Publié: (2026)
par: De Carli, Stefano, et autres
Publié: (2026)
Echoes of the Past: A Unified Perspective on Fading memory and Echo States
par: Ortega, Juan-Pablo, et autres
Publié: (2025)
par: Ortega, Juan-Pablo, et autres
Publié: (2025)
Dynamic Hybrid Modeling: Incremental Identification and Model Predictive Control
par: Caspari, Adrian, et autres
Publié: (2025)
par: Caspari, Adrian, et autres
Publié: (2025)
Constrained Ergodic optimization for generic continuous functions
par: Motonaga, Shoya, et autres
Publié: (2022)
par: Motonaga, Shoya, et autres
Publié: (2022)
A criterion to detect a nontrivial homology of an invariant set of a flow in $\mathbb{R}^3$
par: Sánchez-Gabites, J. J.
Publié: (2024)
par: Sánchez-Gabites, J. J.
Publié: (2024)
Distributed State Estimation for Linear Time-invariant Systems with Aperiodic Sampled Measurement
par: Wang, Shimin, et autres
Publié: (2022)
par: Wang, Shimin, et autres
Publié: (2022)
Next Generation Equation-Free Multiscale Modelling of Crowd Dynamics via Machine Learning
par: Alvarez, Hector Vargas, et autres
Publié: (2025)
par: Alvarez, Hector Vargas, et autres
Publié: (2025)
A nonparametric learning framework for nonlinear robust output regulation
par: Wang, Shimin, et autres
Publié: (2023)
par: Wang, Shimin, et autres
Publié: (2023)
HRM-Agent: Training a recurrent reasoning model in dynamic environments using reinforcement learning
par: Dang, Long H, et autres
Publié: (2025)
par: Dang, Long H, et autres
Publié: (2025)
On the cardinality of measures of maximal relative entropy for smooth skew products
par: Castro, Matheus M., et autres
Publié: (2025)
par: Castro, Matheus M., et autres
Publié: (2025)
Computing Safety Margins of Parameterized Nonlinear Systems for Vulnerability Assessment via Trajectory Sensitivities
par: Fisher, Michael W.
Publié: (2025)
par: Fisher, Michael W.
Publié: (2025)
Full flexibility of entropies among ergodic measures for partially hyperbolic diffeomorphisms
par: Díaz, Lorenzo J., et autres
Publié: (2025)
par: Díaz, Lorenzo J., et autres
Publié: (2025)
Anti-classification for flows on two-tori
par: Goncharuk, Nataliya
Publié: (2025)
par: Goncharuk, Nataliya
Publié: (2025)
Formalising the intentional stance 2: a coinductive approach
par: McGregor, Simon, et autres
Publié: (2025)
par: McGregor, Simon, et autres
Publié: (2025)
Formalising the intentional stance 1: attributing goals and beliefs to stochastic processes
par: McGregor, Simon, et autres
Publié: (2024)
par: McGregor, Simon, et autres
Publié: (2024)
Hierarchical Cyclic Pursuit: Algebraic Curves Containing the Laplacian Spectra
par: Parsegov, Sergei E., et autres
Publié: (2022)
par: Parsegov, Sergei E., et autres
Publié: (2022)
A Fully Data-Driven Value Iteration for Stochastic LQR: Convergence, Robustness and Stability
par: Cui, Leilei, et autres
Publié: (2025)
par: Cui, Leilei, et autres
Publié: (2025)
Sliding motions on systems with non-Euclidean state spaces: A differential-geometric perspective
par: Castaños, Fernando
Publié: (2025)
par: Castaños, Fernando
Publié: (2025)
Optimal response for stochastic differential equations in $\mathbb{T}^d$ with perturbations on the drift term
par: Del Sarto, Gianmarco, et autres
Publié: (2026)
par: Del Sarto, Gianmarco, et autres
Publié: (2026)
SupplyGraph: A Benchmark Dataset for Supply Chain Planning using Graph Neural Networks
par: Wasi, Azmine Toushik, et autres
Publié: (2024)
par: Wasi, Azmine Toushik, et autres
Publié: (2024)
A Note on Semantic Diffusion
par: Ryjov, Alexander P., et autres
Publié: (2025)
par: Ryjov, Alexander P., et autres
Publié: (2025)
A Logvinenko-Sereda theorem for vector-valued functions and application to control theory
par: Bombach, Clemens, et autres
Publié: (2024)
par: Bombach, Clemens, et autres
Publié: (2024)
Simulating Fokker-Planck equations via mean field control of score-based normalizing flows
par: Zhou, Mo, et autres
Publié: (2025)
par: Zhou, Mo, et autres
Publié: (2025)
Documents similaires
-
Observable Neural ODEs for Identifiable Causal Forecasting in Continuous Time
par: Wendland, Jennifer, et autres
Publié: (2026) -
From Features to States: Data-Driven Selection of Measured State Variables via RFE-DMDc
par: Wang, Haoyu, et autres
Publié: (2025) -
Data-driven optimal prediction with control
par: Katrutsa, Aleksandr, et autres
Publié: (2024) -
A Moreau Envelope Approach for LQR Meta-Policy Estimation
par: Aravind, Ashwin, et autres
Publié: (2024) -
Determining Disturbance Recovery Conditions by Inverse Sensitivity Minimization
par: Fisher, Michael W., et autres
Publié: (2025)