SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Anisimov, Maksim, Belardinelli, Francesco, Wicker, Matthew |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Approximate Model-Based Shielding for Safe Reinforcement Learning
par: Goodall, Alexander W., et autres
Publié: (2023)
par: Goodall, Alexander W., et autres
Publié: (2023)
Probabilistic Shielding for Safe Reinforcement Learning
par: Court, Edwin Hamel-De le, et autres
Publié: (2025)
par: Court, Edwin Hamel-De le, et autres
Publié: (2025)
Safe Reinforcement Learning via Recovery-based Shielding with Gaussian Process Dynamics Models
par: Goodall, Alexander W., et autres
Publié: (2026)
par: Goodall, Alexander W., et autres
Publié: (2026)
Robust Shielding for Safe Reinforcement Learning
par: Court, Edwin Hamel-De le, et autres
Publié: (2026)
par: Court, Edwin Hamel-De le, et autres
Publié: (2026)
Provably Safe Model Updates
par: Elmecker-Plakolm, Leo, et autres
Publié: (2025)
par: Elmecker-Plakolm, Leo, et autres
Publié: (2025)
Behaviour Policy Optimization: Provably Lower Variance Return Estimates for Off-Policy Reinforcement Learning
par: Goodall, Alexander W., et autres
Publié: (2025)
par: Goodall, Alexander W., et autres
Publié: (2025)
Implicit Safe Set Algorithm for Provably Safe Reinforcement Learning
par: Zhao, Weiye, et autres
Publié: (2024)
par: Zhao, Weiye, et autres
Publié: (2024)
Leveraging Analytic Gradients in Provably Safe Reinforcement Learning
par: Walter, Tim, et autres
Publié: (2025)
par: Walter, Tim, et autres
Publié: (2025)
Dynamic Model Predictive Shielding for Provably Safe Reinforcement Learning
par: Banerjee, Arko, et autres
Publié: (2024)
par: Banerjee, Arko, et autres
Publié: (2024)
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
par: Tayal, Mumuksh, et autres
Publié: (2026)
par: Tayal, Mumuksh, et autres
Publié: (2026)
A Provable Approach for End-to-End Safe Reinforcement Learning
par: Wachi, Akifumi, et autres
Publié: (2025)
par: Wachi, Akifumi, et autres
Publié: (2025)
Enumerating Safe Regions in Deep Neural Networks with Provable Probabilistic Guarantees
par: Marzari, Luca, et autres
Publié: (2023)
par: Marzari, Luca, et autres
Publié: (2023)
Safe Deep Policy Adaptation
par: Xiao, Wenli, et autres
Publié: (2023)
par: Xiao, Wenli, et autres
Publié: (2023)
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
par: Yao, Yihang, et autres
Publié: (2023)
par: Yao, Yihang, et autres
Publié: (2023)
Constraint-Adaptive Policy Switching for Offline Safe Reinforcement Learning
par: Chemingui, Yassine, et autres
Publié: (2024)
par: Chemingui, Yassine, et autres
Publié: (2024)
Towards Fast Safe Online Reinforcement Learning via Policy Finetuning
par: Chen, Keru, et autres
Publié: (2024)
par: Chen, Keru, et autres
Publié: (2024)
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning
par: Wang, Xuefeng, et autres
Publié: (2024)
par: Wang, Xuefeng, et autres
Publié: (2024)
Reinforcement Learning by Guided Safe Exploration
par: Yang, Qisong, et autres
Publié: (2023)
par: Yang, Qisong, et autres
Publié: (2023)
SafeMIL: Learning Offline Safe Imitation Policy from Non-Preferred Trajectories
par: Burnwal, Returaj, et autres
Publié: (2025)
par: Burnwal, Returaj, et autres
Publié: (2025)
SafeAR: Safe Algorithmic Recourse by Risk-Aware Policies
par: Wu, Haochen, et autres
Publié: (2023)
par: Wu, Haochen, et autres
Publié: (2023)
Revisiting Safe Exploration in Safe Reinforcement learning
par: Eckel, David, et autres
Publié: (2024)
par: Eckel, David, et autres
Publié: (2024)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
par: Ji, Jiaming, et autres
Publié: (2025)
par: Ji, Jiaming, et autres
Publié: (2025)
Reinfier and Reintrainer: Verification and Interpretation-Driven Safe Deep Reinforcement Learning Frameworks
par: Yang, Zixuan, et autres
Publié: (2024)
par: Yang, Zixuan, et autres
Publié: (2024)
Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search
par: Najib, Amna, et autres
Publié: (2024)
par: Najib, Amna, et autres
Publié: (2024)
Deep SPI: Safe Policy Improvement via World Models
par: Delgrange, Florent, et autres
Publié: (2025)
par: Delgrange, Florent, et autres
Publié: (2025)
Online Optimization for Offline Safe Reinforcement Learning
par: Chemingui, Yassine, et autres
Publié: (2025)
par: Chemingui, Yassine, et autres
Publié: (2025)
Sampling-Based Safe Reinforcement Learning
par: Vignola, Luca, et autres
Publié: (2026)
par: Vignola, Luca, et autres
Publié: (2026)
Safe Deep Model-Based Reinforcement Learning with Lyapunov Functions
par: Zhang, Harry
Publié: (2024)
par: Zhang, Harry
Publié: (2024)
ProSh: Probabilistic Shielding for Model-free Reinforcement Learning
par: Court, Edwin Hamel-De le, et autres
Publié: (2025)
par: Court, Edwin Hamel-De le, et autres
Publié: (2025)
SafeSlice: Enabling SLA-Compliant O-RAN Slicing via Safe Deep Reinforcement Learning
par: Nagib, Ahmad M., et autres
Publié: (2025)
par: Nagib, Ahmad M., et autres
Publié: (2025)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
par: Galesloot, Maris F. L., et autres
Publié: (2026)
par: Galesloot, Maris F. L., et autres
Publié: (2026)
PNAct: Crafting Backdoor Attacks in Safe Reinforcement Learning
par: Guo, Weiran, et autres
Publié: (2025)
par: Guo, Weiran, et autres
Publié: (2025)
Safe Reinforcement Learning for Real-World Engine Control
par: Bedei, Julian, et autres
Publié: (2025)
par: Bedei, Julian, et autres
Publié: (2025)
Offline Safe Reinforcement Learning Using Trajectory Classification
par: Gong, Ze, et autres
Publié: (2024)
par: Gong, Ze, et autres
Publié: (2024)
Skill-based Safe Reinforcement Learning with Risk Planning
par: Zhang, Hanping, et autres
Publié: (2025)
par: Zhang, Hanping, et autres
Publié: (2025)
A Survey of Constraint Formulations in Safe Reinforcement Learning
par: Wachi, Akifumi, et autres
Publié: (2024)
par: Wachi, Akifumi, et autres
Publié: (2024)
Spectral-Risk Safe Reinforcement Learning with Convergence Guarantees
par: Kim, Dohyeong, et autres
Publié: (2024)
par: Kim, Dohyeong, et autres
Publié: (2024)
SafeDreamer: Safe Reinforcement Learning with World Models
par: Huang, Weidong, et autres
Publié: (2023)
par: Huang, Weidong, et autres
Publié: (2023)
Enhance Exploration in Safe Reinforcement Learning with Contrastive Representation Learning
par: Doan, Duc Kien, et autres
Publié: (2025)
par: Doan, Duc Kien, et autres
Publié: (2025)
Safe Reinforcement Learning with Learned Non-Markovian Safety Constraints
par: Low, Siow Meng, et autres
Publié: (2024)
par: Low, Siow Meng, et autres
Publié: (2024)
Documents similaires
-
Approximate Model-Based Shielding for Safe Reinforcement Learning
par: Goodall, Alexander W., et autres
Publié: (2023) -
Probabilistic Shielding for Safe Reinforcement Learning
par: Court, Edwin Hamel-De le, et autres
Publié: (2025) -
Safe Reinforcement Learning via Recovery-based Shielding with Gaussian Process Dynamics Models
par: Goodall, Alexander W., et autres
Publié: (2026) -
Robust Shielding for Safe Reinforcement Learning
par: Court, Edwin Hamel-De le, et autres
Publié: (2026) -
Provably Safe Model Updates
par: Elmecker-Plakolm, Leo, et autres
Publié: (2025)