A Review of Safe Reinforcement Learning: Methods, Theory and Applications
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gu, Shangding, Yang, Long, Du, Yali, Chen, Guang, Walter, Florian, Wang, Jun, Knoll, Alois |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
par: Gu, Shangding, et autres
Publié: (2024)
par: Gu, Shangding, et autres
Publié: (2024)
Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation
par: Gu, Shangding, et autres
Publié: (2024)
par: Gu, Shangding, et autres
Publié: (2024)
Multi-Agent Reinforcement Learning for Autonomous Driving: A Survey
par: Zhang, Ruiqi, et autres
Publié: (2024)
par: Zhang, Ruiqi, et autres
Publié: (2024)
Long Context, Less Focus: A Scaling Gap in LLMs Revealed through Privacy and Personalization
par: Gu, Shangding
Publié: (2026)
par: Gu, Shangding
Publié: (2026)
Enhancing Efficiency of Safe Reinforcement Learning via Sample Manipulation
par: Gu, Shangding, et autres
Publié: (2024)
par: Gu, Shangding, et autres
Publié: (2024)
STAS: Spatial-Temporal Return Decomposition for Multi-agent Reinforcement Learning
par: Chen, Sirui, et autres
Publié: (2023)
par: Chen, Sirui, et autres
Publié: (2023)
Data Uniformity Improves Training Efficiency and More, with a Convergence Framework Beyond the NTK Regime
par: Wang, Yuqing, et autres
Publié: (2025)
par: Wang, Yuqing, et autres
Publié: (2025)
AgenticPay: A Multi-Agent LLM Negotiation System for Buyer-Seller Transactions
par: Liu, Xianyang, et autres
Publié: (2026)
par: Liu, Xianyang, et autres
Publié: (2026)
Safe Multi-Agent Reinforcement Learning with Bilevel Optimization in Autonomous Driving
par: Zheng, Zhi, et autres
Publié: (2024)
par: Zheng, Zhi, et autres
Publié: (2024)
Safe Continual Domain Adaptation after Sim2Real Transfer of Reinforcement Learning Policies in Robotics
par: Josifovski, Josip, et autres
Publié: (2025)
par: Josifovski, Josip, et autres
Publié: (2025)
Adaptive Primal-Dual Method for Safe Reinforcement Learning
par: Chen, Weiqin, et autres
Publié: (2024)
par: Chen, Weiqin, et autres
Publié: (2024)
LEAD: Learning Decomposition for Source-free Universal Domain Adaptation
par: Qu, Sanqing, et autres
Publié: (2024)
par: Qu, Sanqing, et autres
Publié: (2024)
Robust Gymnasium: A Unified Modular Benchmark for Robust Reinforcement Learning
par: Gu, Shangding, et autres
Publié: (2025)
par: Gu, Shangding, et autres
Publié: (2025)
Leveraging Analytic Gradients in Provably Safe Reinforcement Learning
par: Walter, Tim, et autres
Publié: (2025)
par: Walter, Tim, et autres
Publié: (2025)
A Safety Modulator Actor-Critic Method in Model-Free Safe Reinforcement Learning and Application in UAV Hovering
par: Qi, Qihan, et autres
Publié: (2024)
par: Qi, Qihan, et autres
Publié: (2024)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
par: Chen, Rufeng, et autres
Publié: (2026)
par: Chen, Rufeng, et autres
Publié: (2026)
Reinforcement Learning by Guided Safe Exploration
par: Yang, Qisong, et autres
Publié: (2023)
par: Yang, Qisong, et autres
Publié: (2023)
Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk
par: Ying, Chengyang, et autres
Publié: (2022)
par: Ying, Chengyang, et autres
Publié: (2022)
Natural Language Reinforcement Learning
par: Feng, Xidong, et autres
Publié: (2024)
par: Feng, Xidong, et autres
Publié: (2024)
Long and Short-Term Constraints Driven Safe Reinforcement Learning for Autonomous Driving
par: Hu, Xuemin, et autres
Publié: (2024)
par: Hu, Xuemin, et autres
Publié: (2024)
Reinfier and Reintrainer: Verification and Interpretation-Driven Safe Deep Reinforcement Learning Frameworks
par: Yang, Zixuan, et autres
Publié: (2024)
par: Yang, Zixuan, et autres
Publié: (2024)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
par: Ji, Jiaming, et autres
Publié: (2025)
par: Ji, Jiaming, et autres
Publié: (2025)
Probabilistic Shielding for Safe Reinforcement Learning
par: Court, Edwin Hamel-De le, et autres
Publié: (2025)
par: Court, Edwin Hamel-De le, et autres
Publié: (2025)
FFHFlow: Diverse and Uncertainty-Aware Dexterous Grasp Generation via Flow Variational Inference
par: Feng, Qian, et autres
Publié: (2024)
par: Feng, Qian, et autres
Publié: (2024)
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
par: Anisimov, Maksim, et autres
Publié: (2026)
par: Anisimov, Maksim, et autres
Publié: (2026)
SocialJax: An Evaluation Suite for Multi-agent Reinforcement Learning in Sequential Social Dilemmas
par: Guo, Zihao, et autres
Publié: (2025)
par: Guo, Zihao, et autres
Publié: (2025)
Online Optimization for Offline Safe Reinforcement Learning
par: Chemingui, Yassine, et autres
Publié: (2025)
par: Chemingui, Yassine, et autres
Publié: (2025)
Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
par: Dai, Juntao, et autres
Publié: (2024)
par: Dai, Juntao, et autres
Publié: (2024)
GUARD: A Safe Reinforcement Learning Benchmark
par: Zhao, Weiye, et autres
Publié: (2023)
par: Zhao, Weiye, et autres
Publié: (2023)
NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning
par: Liu, Wei, et autres
Publié: (2025)
par: Liu, Wei, et autres
Publié: (2025)
M3HF: Multi-agent Reinforcement Learning from Multi-phase Human Feedback of Mixed Quality
par: Wang, Ziyan, et autres
Publié: (2025)
par: Wang, Ziyan, et autres
Publié: (2025)
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
par: Tayal, Mumuksh, et autres
Publié: (2026)
par: Tayal, Mumuksh, et autres
Publié: (2026)
Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
par: Ji, Jiaming, et autres
Publié: (2023)
par: Ji, Jiaming, et autres
Publié: (2023)
BiSeg-SAM: Weakly-Supervised Post-Processing Framework for Boosting Binary Segmentation in Segment Anything Models
par: Su, Encheng, et autres
Publié: (2025)
par: Su, Encheng, et autres
Publié: (2025)
Towards Fast Safe Online Reinforcement Learning via Policy Finetuning
par: Chen, Keru, et autres
Publié: (2024)
par: Chen, Keru, et autres
Publié: (2024)
Implicit Safe Set Algorithm for Provably Safe Reinforcement Learning
par: Zhao, Weiye, et autres
Publié: (2024)
par: Zhao, Weiye, et autres
Publié: (2024)
Are Transformers More Robust? Towards Exact Robustness Verification for Transformers
par: Liao, Brian Hsuan-Cheng, et autres
Publié: (2022)
par: Liao, Brian Hsuan-Cheng, et autres
Publié: (2022)
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning
par: Wang, Xuefeng, et autres
Publié: (2024)
par: Wang, Xuefeng, et autres
Publié: (2024)
Model-Based Safe Reinforcement Learning with Time-Varying State and Control Constraints: An Application to Intelligent Vehicles
par: Zhang, Xinglong, et autres
Publié: (2021)
par: Zhang, Xinglong, et autres
Publié: (2021)
StyleBench: Evaluating thinking styles in Large Language Models
par: Guo, Junyu, et autres
Publié: (2025)
par: Guo, Junyu, et autres
Publié: (2025)
Documents similaires
-
Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
par: Gu, Shangding, et autres
Publié: (2024) -
Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation
par: Gu, Shangding, et autres
Publié: (2024) -
Multi-Agent Reinforcement Learning for Autonomous Driving: A Survey
par: Zhang, Ruiqi, et autres
Publié: (2024) -
Long Context, Less Focus: A Scaling Gap in LLMs Revealed through Privacy and Personalization
par: Gu, Shangding
Publié: (2026) -
Enhancing Efficiency of Safe Reinforcement Learning via Sample Manipulation
par: Gu, Shangding, et autres
Publié: (2024)