Feasible Policy Iteration for Safe Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Yujie, Zheng, Zhilong, Li, Shengbo Eben, Xu, Wei, Liu, Jingjing, Zhan, Xianyuan, Zhang, Ya-Qin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the Equilibrium between Feasible Zone and Uncertain Model in Safe Exploration
di: Yang, Yujie, et al.
Pubblicazione: (2026)
di: Yang, Yujie, et al.
Pubblicazione: (2026)
The Feasibility Theory of Constrained Reinforcement Learning: A Tutorial Study
di: Yang, Yujie, et al.
Pubblicazione: (2024)
di: Yang, Yujie, et al.
Pubblicazione: (2024)
On the Stability of Datatic Control Systems
di: Yang, Yujie, et al.
Pubblicazione: (2024)
di: Yang, Yujie, et al.
Pubblicazione: (2024)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
Policy Bifurcation in Safe Reinforcement Learning
di: Zou, Wenjun, et al.
Pubblicazione: (2024)
di: Zou, Wenjun, et al.
Pubblicazione: (2024)
Predictive Lagrangian Optimization for Constrained Reinforcement Learning
di: Zhang, Tianqi, et al.
Pubblicazione: (2025)
di: Zhang, Tianqi, et al.
Pubblicazione: (2025)
Canonical Form of Datatic Description in Control Systems
di: Zhan, Guojian, et al.
Pubblicazione: (2024)
di: Zhan, Guojian, et al.
Pubblicazione: (2024)
Scalable Synthesis of Formally Verified Neural Value Function for Hamilton-Jacobi Reachability Analysis
di: Yang, Yujie, et al.
Pubblicazione: (2024)
di: Yang, Yujie, et al.
Pubblicazione: (2024)
Controllability Test for Nonlinear Datatic Systems
di: Yang, Yujie, et al.
Pubblicazione: (2024)
di: Yang, Yujie, et al.
Pubblicazione: (2024)
Exchange Policy Optimization Algorithm for Semi-Infinite Safe Reinforcement Learning
di: Zhang, Jiaming, et al.
Pubblicazione: (2025)
di: Zhang, Jiaming, et al.
Pubblicazione: (2025)
Distributional Soft Actor-Critic with Three Refinements
di: Duan, Jingliang, et al.
Pubblicazione: (2023)
di: Duan, Jingliang, et al.
Pubblicazione: (2023)
On the Foundation of Distributionally Robust Reinforcement Learning
di: Wang, Shengbo, et al.
Pubblicazione: (2023)
di: Wang, Shengbo, et al.
Pubblicazione: (2023)
Convolutional Bayesian Filtering
di: Cao, Wenhan, et al.
Pubblicazione: (2024)
di: Cao, Wenhan, et al.
Pubblicazione: (2024)
Zeroth-Order Actor-Critic: An Evolutionary Framework for Sequential Decision Problems
di: Lei, Yuheng, et al.
Pubblicazione: (2022)
di: Lei, Yuheng, et al.
Pubblicazione: (2022)
Recursively Feasible Probabilistic Safe Online Learning with Control Barrier Functions
di: Castañeda, Fernando, et al.
Pubblicazione: (2022)
di: Castañeda, Fernando, et al.
Pubblicazione: (2022)
LexiSafe: Offline Safe Reinforcement Learning with Lexicographic Safety-Reward Hierarchy
di: Yang, Hsin-Jung, et al.
Pubblicazione: (2026)
di: Yang, Hsin-Jung, et al.
Pubblicazione: (2026)
Algorithm Design and Comparative Test of Natural Gradient Gaussian Approximation Filter
di: Cao, Wenhan, et al.
Pubblicazione: (2025)
di: Cao, Wenhan, et al.
Pubblicazione: (2025)
Natural Gradient Gaussian Approximation Filter with Positive Definiteness Guarantee
di: Zhang, Tianyi, et al.
Pubblicazione: (2026)
di: Zhang, Tianyi, et al.
Pubblicazione: (2026)
Optimal Parameter Adaptation for Safety-Critical Control via Safe Barrier Bayesian Optimization
di: Wang, Shengbo, et al.
Pubblicazione: (2025)
di: Wang, Shengbo, et al.
Pubblicazione: (2025)
Data Center Cooling System Optimization Using Offline Reinforcement Learning
di: Zhan, Xianyuan, et al.
Pubblicazione: (2025)
di: Zhan, Xianyuan, et al.
Pubblicazione: (2025)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
How Does the Lagrangian Guide Safe Reinforcement Learning through Diffusion Models?
di: Cheng, Xiaoyuan, et al.
Pubblicazione: (2026)
di: Cheng, Xiaoyuan, et al.
Pubblicazione: (2026)
Safe and Robust Reinforcement Learning: Principles and Practice
di: Yamagata, Taku, et al.
Pubblicazione: (2024)
di: Yamagata, Taku, et al.
Pubblicazione: (2024)
Safe Reinforcement Learning with Minimal Supervision
di: Quessy, Alexander, et al.
Pubblicazione: (2025)
di: Quessy, Alexander, et al.
Pubblicazione: (2025)
Kernel-Based Safe Exploration in Deep Reinforcement Learning
di: Majumdar, Rupak, et al.
Pubblicazione: (2026)
di: Majumdar, Rupak, et al.
Pubblicazione: (2026)
An Explicit Discrete-Time Dynamic Vehicle Model with Assured Numerical Stability
di: Zhan, Guojian, et al.
Pubblicazione: (2024)
di: Zhan, Guojian, et al.
Pubblicazione: (2024)
Finite-Time Analysis of On-Policy Heterogeneous Federated Reinforcement Learning
di: Zhang, Chenyu, et al.
Pubblicazione: (2024)
di: Zhang, Chenyu, et al.
Pubblicazione: (2024)
From Optimization to Control: Quasi Policy Iteration
di: Kolarijani, Mohammad Amin Sharifi, et al.
Pubblicazione: (2023)
di: Kolarijani, Mohammad Amin Sharifi, et al.
Pubblicazione: (2023)
GenSafe: A Generalizable Safety Enhancer for Safe Reinforcement Learning Algorithms Based on Reduced Order Markov Decision Process Model
di: Zhou, Zhehua, et al.
Pubblicazione: (2024)
di: Zhou, Zhehua, et al.
Pubblicazione: (2024)
Safe Deep Model-Based Reinforcement Learning with Lyapunov Functions
di: Zhang, Harry
Pubblicazione: (2024)
di: Zhang, Harry
Pubblicazione: (2024)
Constrained Reinforcement Learning for Safe Heat Pump Control
di: Zhang, Baohe, et al.
Pubblicazione: (2024)
di: Zhang, Baohe, et al.
Pubblicazione: (2024)
Feasibility-aware Learning of Robust Temporal Logic Controllers using BarrierNet
di: Liu, Wenliang, et al.
Pubblicazione: (2025)
di: Liu, Wenliang, et al.
Pubblicazione: (2025)
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
di: Yan, Runze, et al.
Pubblicazione: (2025)
di: Yan, Runze, et al.
Pubblicazione: (2025)
Provable Traffic Rule Compliance in Safe Reinforcement Learning on the Open Sea
di: Krasowski, Hanna, et al.
Pubblicazione: (2024)
di: Krasowski, Hanna, et al.
Pubblicazione: (2024)
A Safe Reinforcement Learning Algorithm for Supervisory Control of Power Plants
di: Sun, Yixuan, et al.
Pubblicazione: (2024)
di: Sun, Yixuan, et al.
Pubblicazione: (2024)
Safe Multi-Agent Reinforcement Learning with Convergence to Generalized Nash Equilibrium
di: Li, Zeyang, et al.
Pubblicazione: (2024)
di: Li, Zeyang, et al.
Pubblicazione: (2024)
Risk-Aware Safe Reinforcement Learning for Control of Stochastic Linear Systems
di: Esmaeili, Babak, et al.
Pubblicazione: (2025)
di: Esmaeili, Babak, et al.
Pubblicazione: (2025)
Safely Learning Dynamical Systems
di: Ahmadi, Amir Ali, et al.
Pubblicazione: (2023)
di: Ahmadi, Amir Ali, et al.
Pubblicazione: (2023)
Optimizing Operation Recipes with Reinforcement Learning for Safe and Interpretable Control of Chemical Processes
di: Brandner, Dean, et al.
Pubblicazione: (2025)
di: Brandner, Dean, et al.
Pubblicazione: (2025)
Foundations of Safe Online Reinforcement Learning in the Linear Quadratic Regulator: Generalized Baselines
di: Schiffer, Benjamin, et al.
Pubblicazione: (2024)
di: Schiffer, Benjamin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
On the Equilibrium between Feasible Zone and Uncertain Model in Safe Exploration
di: Yang, Yujie, et al.
Pubblicazione: (2026) -
The Feasibility Theory of Constrained Reinforcement Learning: A Tutorial Study
di: Yang, Yujie, et al.
Pubblicazione: (2024) -
On the Stability of Datatic Control Systems
di: Yang, Yujie, et al.
Pubblicazione: (2024) -
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
di: Zheng, Yinan, et al.
Pubblicazione: (2024) -
Policy Bifurcation in Safe Reinforcement Learning
di: Zou, Wenjun, et al.
Pubblicazione: (2024)