Probabilistic Framework of Howard's Policy Iteration: BML Evaluation and Robust Convergence Analysis
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yutian, Ni, Yuan-Hua, Chen, Zengqiang, Zhang, Ji-Feng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Optimization-Based Framework for Solving Forward-Backward Stochastic Differential Equations: Convergence Analysis and Error Bounds
di: Wang, Yutian, et al.
Pubblicazione: (2025)
di: Wang, Yutian, et al.
Pubblicazione: (2025)
Data-Enabled Policy and Value Iteration for Continuous-Time Linear Quadratic Output Feedback Control
di: Xie, Jun, et al.
Pubblicazione: (2026)
di: Xie, Jun, et al.
Pubblicazione: (2026)
A Convex Optimization Approach to Model-Free Inverse Optimal Control with Provable Convergence
di: Yu, Meiling, et al.
Pubblicazione: (2025)
di: Yu, Meiling, et al.
Pubblicazione: (2025)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Physics-Informed Neural Network Policy Iteration: Algorithms, Convergence, and Verification
di: Meng, Yiming, et al.
Pubblicazione: (2024)
di: Meng, Yiming, et al.
Pubblicazione: (2024)
Two-Timescale Optimization Framework for Sparse-Feedback Linear-Quadratic Optimal Control
di: Feng, Lechen, et al.
Pubblicazione: (2024)
di: Feng, Lechen, et al.
Pubblicazione: (2024)
Policy Optimization in the Linear Quadratic Gaussian Problem: A Frequency Domain Perspective
di: Li, Haoran, et al.
Pubblicazione: (2025)
di: Li, Haoran, et al.
Pubblicazione: (2025)
An Effective Iterative Solution for Independent Vector Analysis with Convergence Guarantees
di: Cosserat, Clément, et al.
Pubblicazione: (2024)
di: Cosserat, Clément, et al.
Pubblicazione: (2024)
Nonconvex Optimization Framework for Group-Sparse Feedback Linear-Quadratic Optimal Control: Penalty Approach
di: Feng, Lechen, et al.
Pubblicazione: (2025)
di: Feng, Lechen, et al.
Pubblicazione: (2025)
Nonconvex Optimization Framework for Group-Sparse Feedback Linear-Quadratic Optimal Control: Non-Penalty Approach
di: Feng, Lechen, et al.
Pubblicazione: (2025)
di: Feng, Lechen, et al.
Pubblicazione: (2025)
Robust Sublinear Convergence Rates for Iterative Bregman Projections
di: Peyré, Gabriel
Pubblicazione: (2026)
di: Peyré, Gabriel
Pubblicazione: (2026)
Global Convergence of Iteratively Reweighted Least Squares for Robust Subspace Recovery
di: Lerman, Gilad, et al.
Pubblicazione: (2025)
di: Lerman, Gilad, et al.
Pubblicazione: (2025)
On-Line Policy Iteration with Trajectory-Driven Policy Generation
di: Li, Yuchao, et al.
Pubblicazione: (2026)
di: Li, Yuchao, et al.
Pubblicazione: (2026)
On the Convergence of the Accelerated Riccati Iteration Method
di: Rajasingam, Prasanthan, et al.
Pubblicazione: (2017)
di: Rajasingam, Prasanthan, et al.
Pubblicazione: (2017)
Accelerated Optimization Landscape of Linear-Quadratic Regulator
di: Feng, Lechen, et al.
Pubblicazione: (2023)
di: Feng, Lechen, et al.
Pubblicazione: (2023)
Computing Competitive Equilibrium for Chores: Linear Convergence and Lightweight Iteration
di: Chen, He, et al.
Pubblicazione: (2024)
di: Chen, He, et al.
Pubblicazione: (2024)
An Efficient Data-Driven Framework for Linear Quadratic Output Feedback Control
di: Xie, Jun, et al.
Pubblicazione: (2025)
di: Xie, Jun, et al.
Pubblicazione: (2025)
Convergence of the Iterates of the Stochastic Proximal Gradient Method
di: Madariaga, Javier I.
Pubblicazione: (2026)
di: Madariaga, Javier I.
Pubblicazione: (2026)
Last-Iterate Convergence of Anchored Gradient Descent
di: Cai, Yang, et al.
Pubblicazione: (2026)
di: Cai, Yang, et al.
Pubblicazione: (2026)
Natural Policy Gradient as Doubly Smoothed Policy Iteration: A Bellman-Operator Framework
di: Nanda, Phalguni, et al.
Pubblicazione: (2026)
di: Nanda, Phalguni, et al.
Pubblicazione: (2026)
Policy Optimization with Differentiable MPC: Convergence Analysis under Uncertainty
di: Zuliani, Riccardo, et al.
Pubblicazione: (2026)
di: Zuliani, Riccardo, et al.
Pubblicazione: (2026)
On Convergence of the Iteratively Preconditioned Gradient-Descent (IPG) Observer
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2024)
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2024)
Stabilizing Rate of Stochastic Control Systems
di: Jia, Hui, et al.
Pubblicazione: (2025)
di: Jia, Hui, et al.
Pubblicazione: (2025)
Safety Control of Impulsive Systems with Control Barrier Functions and Adaptive Gains
di: Liu, Zihan, et al.
Pubblicazione: (2025)
di: Liu, Zihan, et al.
Pubblicazione: (2025)
The Iterates of Nesterov's Accelerated Algorithm Converge in The Critical Regimes
di: Bot, Radu Ioan, et al.
Pubblicazione: (2025)
di: Bot, Radu Ioan, et al.
Pubblicazione: (2025)
Probabilistic Robustness in the Gap Metric
di: Renganathan, Venkatraman
Pubblicazione: (2025)
di: Renganathan, Venkatraman
Pubblicazione: (2025)
Convergence Analysis of Distributed Optimization: A Dissipativity Framework
di: Karakai, Aron, et al.
Pubblicazione: (2025)
di: Karakai, Aron, et al.
Pubblicazione: (2025)
Policy Iteration Achieves Regularized Equilibrium under Time Inconsistency
di: Huang, Yu-Jui, et al.
Pubblicazione: (2026)
di: Huang, Yu-Jui, et al.
Pubblicazione: (2026)
Incremental Policy Iteration for Unknown Nonlinear Systems with Stability and Performance Guarantees
di: Meng, Qingkai, et al.
Pubblicazione: (2025)
di: Meng, Qingkai, et al.
Pubblicazione: (2025)
On the Convergence of Policy in Unregularized Policy Mirror Descent
di: Lin, Dachao, et al.
Pubblicazione: (2022)
di: Lin, Dachao, et al.
Pubblicazione: (2022)
A High-Speed Time-Optimal Trajectory Generation Strategy via a Two-layer Planning Model
di: Tan, Haotian, et al.
Pubblicazione: (2025)
di: Tan, Haotian, et al.
Pubblicazione: (2025)
Convergence of the Iterates for Momentum and RMSProp for Local Smooth Functions: Adaptation is the Key
di: Bensaid, Bilel, et al.
Pubblicazione: (2024)
di: Bensaid, Bilel, et al.
Pubblicazione: (2024)
Global Convergence of Natural Policy Gradient with Hessian-aided Momentum Variance Reduction
di: Feng, Jie, et al.
Pubblicazione: (2024)
di: Feng, Jie, et al.
Pubblicazione: (2024)
On the Convergence of Policy Mirror Descent with Temporal Difference Evaluation
di: Liu, Jiacai, et al.
Pubblicazione: (2025)
di: Liu, Jiacai, et al.
Pubblicazione: (2025)
Probabilistic Reachability Analysis of Stochastic Control Systems
di: Jafarpour, Saber, et al.
Pubblicazione: (2024)
di: Jafarpour, Saber, et al.
Pubblicazione: (2024)
Probabilistic Iterative Hard Thresholding for Sparse Learning
di: Bergamaschi, Matteo, et al.
Pubblicazione: (2024)
di: Bergamaschi, Matteo, et al.
Pubblicazione: (2024)
Tailoring Reproducing Kernels for Optimal Control via Policy Iteration
di: Niu, Shengyuan, et al.
Pubblicazione: (2025)
di: Niu, Shengyuan, et al.
Pubblicazione: (2025)
On the Convergence Analysis of an Inexact Preconditioned Stochastic Model-Based Algorithm
di: Bao, Chenglong, et al.
Pubblicazione: (2025)
di: Bao, Chenglong, et al.
Pubblicazione: (2025)
Robust Analysis of Almost Sure Convergence of Zeroth-Order Mirror Descent Algorithm
di: Paul, Anik Kumar, et al.
Pubblicazione: (2023)
di: Paul, Anik Kumar, et al.
Pubblicazione: (2023)
On the Convergence of Projected Policy Gradient for Any Constant Step Sizes
di: Liu, Jiacai, et al.
Pubblicazione: (2023)
di: Liu, Jiacai, et al.
Pubblicazione: (2023)
Documenti analoghi
-
An Optimization-Based Framework for Solving Forward-Backward Stochastic Differential Equations: Convergence Analysis and Error Bounds
di: Wang, Yutian, et al.
Pubblicazione: (2025) -
Data-Enabled Policy and Value Iteration for Continuous-Time Linear Quadratic Output Feedback Control
di: Xie, Jun, et al.
Pubblicazione: (2026) -
A Convex Optimization Approach to Model-Free Inverse Optimal Control with Provable Convergence
di: Yu, Meiling, et al.
Pubblicazione: (2025) -
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2023) -
Physics-Informed Neural Network Policy Iteration: Algorithms, Convergence, and Verification
di: Meng, Yiming, et al.
Pubblicazione: (2024)