Model approximation in MDPs with unbounded per-step cost
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bozkurt, Berk, Mahajan, Aditya, Nayyar, Ashutosh, Ouyang, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sub-optimality bounds for certainty equivalent policies in partially observed systems
par: Bozkurt, Berk, et autres
Publié: (2026)
par: Bozkurt, Berk, et autres
Publié: (2026)
Achieving Tractable Minimax Optimal Regret in Average Reward MDPs
par: Boone, Victor, et autres
Publié: (2024)
par: Boone, Victor, et autres
Publié: (2024)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
par: Ding, Dongsheng, et autres
Publié: (2023)
par: Ding, Dongsheng, et autres
Publié: (2023)
Scalable spectral representations for multi-agent reinforcement learning in network MDPs
par: Ren, Zhaolin, et autres
Publié: (2024)
par: Ren, Zhaolin, et autres
Publié: (2024)
Agent-state based policies in POMDPs: Beyond belief-state MDPs
par: Sinha, Amit, et autres
Publié: (2024)
par: Sinha, Amit, et autres
Publié: (2024)
Probabilistic Safety Guarantee for Stochastic Control Systems Using Average Reward MDPs
par: Omidi, Saber, et autres
Publié: (2025)
par: Omidi, Saber, et autres
Publié: (2025)
Action Recommendations for Sequentially Rational Strategic Agents
par: Sun, Renyan, et autres
Publié: (2026)
par: Sun, Renyan, et autres
Publié: (2026)
Optimal Messaging Strategy for Incentivizing Agents in Dynamic Systems
par: Sun, Renyan, et autres
Publié: (2025)
par: Sun, Renyan, et autres
Publié: (2025)
PACSBO: Probably approximately correct safe Bayesian optimization
par: Tokmak, Abdullah, et autres
Publié: (2024)
par: Tokmak, Abdullah, et autres
Publié: (2024)
Automatic nonlinear MPC approximation with closed-loop guarantees
par: Tokmak, Abdullah, et autres
Publié: (2023)
par: Tokmak, Abdullah, et autres
Publié: (2023)
Convergence and sample complexity of natural policy gradient primal-dual methods for constrained MDPs
par: Ding, Dongsheng, et autres
Publié: (2022)
par: Ding, Dongsheng, et autres
Publié: (2022)
Symplectic Inductive Bias for Data-Driven Target Reachability in Hamiltonian Systems
par: Ouyang, Zhuo, et autres
Publié: (2026)
par: Ouyang, Zhuo, et autres
Publié: (2026)
Robust Neural IDA-PBC: passivity-based stabilization under approximations
par: Sanchez-Escalonilla, Santiago, et autres
Publié: (2024)
par: Sanchez-Escalonilla, Santiago, et autres
Publié: (2024)
What price to pay? Auto-tuning a building MPC controller for optimal economic cost
par: Yu, Jiarui, et autres
Publié: (2025)
par: Yu, Jiarui, et autres
Publié: (2025)
Robust stabilization of polytopic systems via fast and reliable neural network-based approximations
par: Fabiani, Filippo, et autres
Publié: (2022)
par: Fabiani, Filippo, et autres
Publié: (2022)
Constraint-Generation Policy Optimization (CGPO): Nonlinear Programming for Policy Optimization in Mixed Discrete-Continuous MDPs
par: Gimelfarb, Michael, et autres
Publié: (2024)
par: Gimelfarb, Michael, et autres
Publié: (2024)
Model-Based Diffusion for Trajectory Optimization
par: Pan, Chaoyi, et autres
Publié: (2024)
par: Pan, Chaoyi, et autres
Publié: (2024)
Model-Based Reinforcement Learning Control of Reaction-Diffusion Problems
par: Schenk, Christina, et autres
Publié: (2024)
par: Schenk, Christina, et autres
Publié: (2024)
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part I
par: Tian, Yi, et autres
Publié: (2022)
par: Tian, Yi, et autres
Publié: (2022)
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part II
par: Tian, Yi, et autres
Publié: (2026)
par: Tian, Yi, et autres
Publié: (2026)
Dynamic Controlled Variables Based Dynamic Self-Optimizing Control
par: Zhou, Chenchen, et autres
Publié: (2026)
par: Zhou, Chenchen, et autres
Publié: (2026)
Differentiable Model Predictive Control on the GPU
par: Adabag, Emre, et autres
Publié: (2025)
par: Adabag, Emre, et autres
Publié: (2025)
PolyFormer: learning efficient reformulations for scalable optimization under complex physical constraints
par: Wen, Yilin, et autres
Publié: (2026)
par: Wen, Yilin, et autres
Publié: (2026)
Learning Exactly Linearizable Deep Dynamics Models
par: Moriyasu, Ryuta, et autres
Publié: (2023)
par: Moriyasu, Ryuta, et autres
Publié: (2023)
Heat Death of Generative Models in Closed-Loop Learning
par: Marchi, Matteo, et autres
Publié: (2024)
par: Marchi, Matteo, et autres
Publié: (2024)
Gradient Estimation and Variance Reduction in Stochastic and Deterministic Models
par: Keane, Ronan
Publié: (2024)
par: Keane, Ronan
Publié: (2024)
Operator Models for Continuous-Time Offline Reinforcement Learning
par: Hoischen, Nicolas, et autres
Publié: (2025)
par: Hoischen, Nicolas, et autres
Publié: (2025)
Physics-informed Gaussian Processes as Linear Model Predictive Controller
par: Tebbe, Jörn, et autres
Publié: (2024)
par: Tebbe, Jörn, et autres
Publié: (2024)
Tempering the Bayes Filter towards Improved Model-Based Estimation
par: van Zutphen, Menno, et autres
Publié: (2025)
par: van Zutphen, Menno, et autres
Publié: (2025)
Soft Robust MDPs and Risk-Sensitive MDPs: Equivalence, Policy Gradient, and Sample Complexity
par: Zhang, Runyu, et autres
Publié: (2023)
par: Zhang, Runyu, et autres
Publié: (2023)
Model-Free Output Feedback Stabilization via Policy Gradient Methods
par: Zhang, Ankang, et autres
Publié: (2026)
par: Zhang, Ankang, et autres
Publié: (2026)
Incremental Correction in Dynamic Systems Modelled with Neural Networks for Constraint Satisfaction
par: Cho, Namhoon, et autres
Publié: (2022)
par: Cho, Namhoon, et autres
Publié: (2022)
Efficient Model-Free Exploration in Low-Rank MDPs
par: Mhammedi, Zakaria, et autres
Publié: (2023)
par: Mhammedi, Zakaria, et autres
Publié: (2023)
Global Search of Optimal Spacecraft Trajectories using Amortization and Deep Generative Models
par: Beeson, Ryne, et autres
Publié: (2024)
par: Beeson, Ryne, et autres
Publié: (2024)
Model-Free Learning for the Linear Quadratic Regulator over Rate-Limited Channels
par: Ye, Lintao, et autres
Publié: (2024)
par: Ye, Lintao, et autres
Publié: (2024)
Bridging Autoencoders and Dynamic Mode Decomposition for Reduced-order Modeling and Control of PDEs
par: Saha, Priyabrata, et autres
Publié: (2024)
par: Saha, Priyabrata, et autres
Publié: (2024)
ReLU Networks for Model Predictive Control: Network Complexity and Performance Guarantees
par: Li, Xingchen, et autres
Publié: (2026)
par: Li, Xingchen, et autres
Publié: (2026)
Modeling and Control of Deep Sign-Definite Dynamics with Application to Hybrid Powertrain Control
par: Kato, Teruki, et autres
Publié: (2025)
par: Kato, Teruki, et autres
Publié: (2025)
Approximation with Random Shallow ReLU Networks with Applications to Model Reference Adaptive Control
par: Lamperski, Andrew, et autres
Publié: (2024)
par: Lamperski, Andrew, et autres
Publié: (2024)
Learning Optimal Control and Dynamical Structure of Global Trajectory Search Problems with Diffusion Models
par: Graebner, Jannik, et autres
Publié: (2024)
par: Graebner, Jannik, et autres
Publié: (2024)
Documents similaires
-
Sub-optimality bounds for certainty equivalent policies in partially observed systems
par: Bozkurt, Berk, et autres
Publié: (2026) -
Achieving Tractable Minimax Optimal Regret in Average Reward MDPs
par: Boone, Victor, et autres
Publié: (2024) -
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
par: Ding, Dongsheng, et autres
Publié: (2023) -
Scalable spectral representations for multi-agent reinforcement learning in network MDPs
par: Ren, Zhaolin, et autres
Publié: (2024) -
Agent-state based policies in POMDPs: Beyond belief-state MDPs
par: Sinha, Amit, et autres
Publié: (2024)