A Survey of Constraint Formulations in Safe Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wachi, Akifumi, Shen, Xun, Sui, Yanan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Long-term Safe Reinforcement Learning with Binary Feedback
von: Wachi, Akifumi, et al.
Veröffentlicht: (2024)
von: Wachi, Akifumi, et al.
Veröffentlicht: (2024)
A Provable Approach for End-to-End Safe Reinforcement Learning
von: Wachi, Akifumi, et al.
Veröffentlicht: (2025)
von: Wachi, Akifumi, et al.
Veröffentlicht: (2025)
Target Return Optimizer for Multi-Game Decision Transformer
von: Tatematsu, Kensuke, et al.
Veröffentlicht: (2025)
von: Tatematsu, Kensuke, et al.
Veröffentlicht: (2025)
A Relative-Budget Theory for Reinforcement Learning with Verifiable Rewards in Large Language Model Reasoning
von: Wachi, Akifumi, et al.
Veröffentlicht: (2026)
von: Wachi, Akifumi, et al.
Veröffentlicht: (2026)
Sample-Efficient Hypergradient Estimation for Decentralized Bi-Level Reinforcement Learning
von: Kudo, Mikoto, et al.
Veröffentlicht: (2026)
von: Kudo, Mikoto, et al.
Veröffentlicht: (2026)
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
von: Yan, Runze, et al.
Veröffentlicht: (2025)
von: Yan, Runze, et al.
Veröffentlicht: (2025)
Cost-Minimized Label-Flipping Poisoning Attack to LLM Alignment
von: Kusaka, Shigeki, et al.
Veröffentlicht: (2025)
von: Kusaka, Shigeki, et al.
Veröffentlicht: (2025)
Safe Reinforcement Learning with Learned Non-Markovian Safety Constraints
von: Low, Siow Meng, et al.
Veröffentlicht: (2024)
von: Low, Siow Meng, et al.
Veröffentlicht: (2024)
Stepwise Alignment for Constrained Language Model Policy Optimization
von: Wachi, Akifumi, et al.
Veröffentlicht: (2024)
von: Wachi, Akifumi, et al.
Veröffentlicht: (2024)
Vulnerability Mitigation for Safety-Aligned Language Models via Debiasing
von: Tran, Thien Q., et al.
Veröffentlicht: (2025)
von: Tran, Thien Q., et al.
Veröffentlicht: (2025)
Constraint-Adaptive Policy Switching for Offline Safe Reinforcement Learning
von: Chemingui, Yassine, et al.
Veröffentlicht: (2024)
von: Chemingui, Yassine, et al.
Veröffentlicht: (2024)
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
von: Yao, Yihang, et al.
Veröffentlicht: (2023)
von: Yao, Yihang, et al.
Veröffentlicht: (2023)
SB-TRPO: Towards Safe Reinforcement Learning with Hard Constraints
von: Wagner, Dominik, et al.
Veröffentlicht: (2025)
von: Wagner, Dominik, et al.
Veröffentlicht: (2025)
Safe Offline Reinforcement Learning with Real-Time Budget Constraints
von: Lin, Qian, et al.
Veröffentlicht: (2023)
von: Lin, Qian, et al.
Veröffentlicht: (2023)
Long and Short-Term Constraints Driven Safe Reinforcement Learning for Autonomous Driving
von: Hu, Xuemin, et al.
Veröffentlicht: (2024)
von: Hu, Xuemin, et al.
Veröffentlicht: (2024)
Beyond Hard Constraints: Budget-Conditioned Reachability For Safe Offline Reinforcement Learning
von: Brahmanage, Janaka Chathuranga, et al.
Veröffentlicht: (2026)
von: Brahmanage, Janaka Chathuranga, et al.
Veröffentlicht: (2026)
Grid-Mapping Pseudo-Count Constraint for Offline Reinforcement Learning
von: Shen, Yi, et al.
Veröffentlicht: (2024)
von: Shen, Yi, et al.
Veröffentlicht: (2024)
Model-Based Safe Reinforcement Learning with Time-Varying State and Control Constraints: An Application to Intelligent Vehicles
von: Zhang, Xinglong, et al.
Veröffentlicht: (2021)
von: Zhang, Xinglong, et al.
Veröffentlicht: (2021)
Integrating LTL Constraints into PPO for Safe Reinforcement Learning
von: Zhang, Maifang, et al.
Veröffentlicht: (2026)
von: Zhang, Maifang, et al.
Veröffentlicht: (2026)
Reinforcement Learning by Guided Safe Exploration
von: Yang, Qisong, et al.
Veröffentlicht: (2023)
von: Yang, Qisong, et al.
Veröffentlicht: (2023)
Probabilistic Shielding for Safe Reinforcement Learning
von: Court, Edwin Hamel-De le, et al.
Veröffentlicht: (2025)
von: Court, Edwin Hamel-De le, et al.
Veröffentlicht: (2025)
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
von: Anisimov, Maksim, et al.
Veröffentlicht: (2026)
von: Anisimov, Maksim, et al.
Veröffentlicht: (2026)
Online Optimization for Offline Safe Reinforcement Learning
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
A Harmonic Mean Formulation of Average Reward Reinforcement Learning in SMDPs
von: Shtossel, Erel, et al.
Veröffentlicht: (2026)
von: Shtossel, Erel, et al.
Veröffentlicht: (2026)
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
von: Tayal, Mumuksh, et al.
Veröffentlicht: (2026)
von: Tayal, Mumuksh, et al.
Veröffentlicht: (2026)
Implicit Safe Set Algorithm for Provably Safe Reinforcement Learning
von: Zhao, Weiye, et al.
Veröffentlicht: (2024)
von: Zhao, Weiye, et al.
Veröffentlicht: (2024)
GUARD: A Safe Reinforcement Learning Benchmark
von: Zhao, Weiye, et al.
Veröffentlicht: (2023)
von: Zhao, Weiye, et al.
Veröffentlicht: (2023)
Do No Harm: A Counterfactual Approach to Safe Reinforcement Learning
von: Vaskov, Sean, et al.
Veröffentlicht: (2024)
von: Vaskov, Sean, et al.
Veröffentlicht: (2024)
Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
von: Ji, Jiaming, et al.
Veröffentlicht: (2023)
von: Ji, Jiaming, et al.
Veröffentlicht: (2023)
A Review of Safe Reinforcement Learning: Methods, Theory and Applications
von: Gu, Shangding, et al.
Veröffentlicht: (2022)
von: Gu, Shangding, et al.
Veröffentlicht: (2022)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
von: Ji, Jiaming, et al.
Veröffentlicht: (2025)
von: Ji, Jiaming, et al.
Veröffentlicht: (2025)
Enhance Exploration in Safe Reinforcement Learning with Contrastive Representation Learning
von: Doan, Duc Kien, et al.
Veröffentlicht: (2025)
von: Doan, Duc Kien, et al.
Veröffentlicht: (2025)
Sampling-Based Safe Reinforcement Learning
von: Vignola, Luca, et al.
Veröffentlicht: (2026)
von: Vignola, Luca, et al.
Veröffentlicht: (2026)
Policy Constraint by Only Support Constraint for Offline Reinforcement Learning
von: Gao, Yunkai, et al.
Veröffentlicht: (2025)
von: Gao, Yunkai, et al.
Veröffentlicht: (2025)
Offline Safe Reinforcement Learning Using Trajectory Classification
von: Gong, Ze, et al.
Veröffentlicht: (2024)
von: Gong, Ze, et al.
Veröffentlicht: (2024)
Spectral-Risk Safe Reinforcement Learning with Convergence Guarantees
von: Kim, Dohyeong, et al.
Veröffentlicht: (2024)
von: Kim, Dohyeong, et al.
Veröffentlicht: (2024)
PNAct: Crafting Backdoor Attacks in Safe Reinforcement Learning
von: Guo, Weiran, et al.
Veröffentlicht: (2025)
von: Guo, Weiran, et al.
Veröffentlicht: (2025)
Safe Reinforcement Learning for Real-World Engine Control
von: Bedei, Julian, et al.
Veröffentlicht: (2025)
von: Bedei, Julian, et al.
Veröffentlicht: (2025)
Skill-based Safe Reinforcement Learning with Risk Planning
von: Zhang, Hanping, et al.
Veröffentlicht: (2025)
von: Zhang, Hanping, et al.
Veröffentlicht: (2025)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
von: Galesloot, Maris F. L., et al.
Veröffentlicht: (2026)
von: Galesloot, Maris F. L., et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Long-term Safe Reinforcement Learning with Binary Feedback
von: Wachi, Akifumi, et al.
Veröffentlicht: (2024) -
A Provable Approach for End-to-End Safe Reinforcement Learning
von: Wachi, Akifumi, et al.
Veröffentlicht: (2025) -
Target Return Optimizer for Multi-Game Decision Transformer
von: Tatematsu, Kensuke, et al.
Veröffentlicht: (2025) -
A Relative-Budget Theory for Reinforcement Learning with Verifiable Rewards in Large Language Model Reasoning
von: Wachi, Akifumi, et al.
Veröffentlicht: (2026) -
Sample-Efficient Hypergradient Estimation for Decentralized Bi-Level Reinforcement Learning
von: Kudo, Mikoto, et al.
Veröffentlicht: (2026)