Safety Modulation: Enhancing Safety in Reinforcement Learning through Cost-Modulated Rewards
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Hanping, Guo, Yuhong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Diffusion Modulation via Environment Mechanism Modeling for Planning
von: Zhang, Hanping, et al.
Veröffentlicht: (2026)
von: Zhang, Hanping, et al.
Veröffentlicht: (2026)
Skill-Enhanced Reinforcement Learning Acceleration from Heterogeneous Demonstrations
von: Zhang, Hanping, et al.
Veröffentlicht: (2024)
von: Zhang, Hanping, et al.
Veröffentlicht: (2024)
LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning
von: Zhang, Hanping, et al.
Veröffentlicht: (2025)
von: Zhang, Hanping, et al.
Veröffentlicht: (2025)
Skill-based Safe Reinforcement Learning with Risk Planning
von: Zhang, Hanping, et al.
Veröffentlicht: (2025)
von: Zhang, Hanping, et al.
Veröffentlicht: (2025)
Bridging Dynamics Gaps via Diffusion Schrödinger Bridge for Cross-Domain Reinforcement Learning
von: Zhang, Hanping, et al.
Veröffentlicht: (2026)
von: Zhang, Hanping, et al.
Veröffentlicht: (2026)
Reinforcement Learning-Guided Semi-Supervised Learning
von: Heidari, Marzi, et al.
Veröffentlicht: (2024)
von: Heidari, Marzi, et al.
Veröffentlicht: (2024)
Learning to Clean: Reinforcement Learning for Noisy Label Correction
von: Heidari, Marzi, et al.
Veröffentlicht: (2025)
von: Heidari, Marzi, et al.
Veröffentlicht: (2025)
Prompt-Driven Feature Diffusion for Open-World Semi-Supervised Learning
von: Heidari, Marzi, et al.
Veröffentlicht: (2024)
von: Heidari, Marzi, et al.
Veröffentlicht: (2024)
Breaking the Safety-Capability Tradeoff: Reinforcement Learning with Verifiable Rewards Maintains Safety Guardrails in LLMs
von: Cho, Dongkyu Derek, et al.
Veröffentlicht: (2025)
von: Cho, Dongkyu Derek, et al.
Veröffentlicht: (2025)
Zero-Shot Action Generalization with Limited Observations
von: Alchihabi, Abdullah, et al.
Veröffentlicht: (2025)
von: Alchihabi, Abdullah, et al.
Veröffentlicht: (2025)
Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation
von: Gu, Shangding, et al.
Veröffentlicht: (2024)
von: Gu, Shangding, et al.
Veröffentlicht: (2024)
PREFINE: Preference-Based Implicit Reward and Cost Fine-Tuning for Safety Alignment
von: Verma, Richa, et al.
Veröffentlicht: (2026)
von: Verma, Richa, et al.
Veröffentlicht: (2026)
A Safety Modulator Actor-Critic Method in Model-Free Safe Reinforcement Learning and Application in UAV Hovering
von: Qi, Qihan, et al.
Veröffentlicht: (2024)
von: Qi, Qihan, et al.
Veröffentlicht: (2024)
Anomalous State Sequence Modeling to Enhance Safety in Reinforcement Learning
von: Kweider, Leen, et al.
Veröffentlicht: (2024)
von: Kweider, Leen, et al.
Veröffentlicht: (2024)
Learning Safety Constraints from Demonstrations with Unknown Rewards
von: Lindner, David, et al.
Veröffentlicht: (2023)
von: Lindner, David, et al.
Veröffentlicht: (2023)
Bi-Level Optimization for Single Domain Generalization
von: Heidari, Marzi, et al.
Veröffentlicht: (2026)
von: Heidari, Marzi, et al.
Veröffentlicht: (2026)
Conservative Distributional Reinforcement Learning with Safety Constraints
von: Zhang, Hengrui, et al.
Veröffentlicht: (2022)
von: Zhang, Hengrui, et al.
Veröffentlicht: (2022)
Enhancing Safety in Reinforcement Learning with Human Feedback via Rectified Policy Optimization
von: Peng, Xiyue, et al.
Veröffentlicht: (2024)
von: Peng, Xiyue, et al.
Veröffentlicht: (2024)
Guardian: Decoupling Exploration from Safety in Reinforcement Learning
von: Cai, Kaitong, et al.
Veröffentlicht: (2025)
von: Cai, Kaitong, et al.
Veröffentlicht: (2025)
LLM-Guided Reinforcement Learning: Addressing Training Bottlenecks through Policy Modulation
von: Tan, Heng, et al.
Veröffentlicht: (2025)
von: Tan, Heng, et al.
Veröffentlicht: (2025)
Probabilistic Constraint for Safety-Critical Reinforcement Learning
von: Chen, Weiqin, et al.
Veröffentlicht: (2023)
von: Chen, Weiqin, et al.
Veröffentlicht: (2023)
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2024)
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2024)
Augmented Lagrangian Multiplier Network for State-wise Safety in Reinforcement Learning
von: Zhang, Jiaming, et al.
Veröffentlicht: (2026)
von: Zhang, Jiaming, et al.
Veröffentlicht: (2026)
Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
von: Ji, Jiaming, et al.
Veröffentlicht: (2023)
von: Ji, Jiaming, et al.
Veröffentlicht: (2023)
Safe Reinforcement Learning with Learned Non-Markovian Safety Constraints
von: Low, Siow Meng, et al.
Veröffentlicht: (2024)
von: Low, Siow Meng, et al.
Veröffentlicht: (2024)
HISR: Hindsight Information Modulated Segmental Process Rewards For Multi-turn Agentic Reinforcement Learning
von: Lu, Zhicong, et al.
Veröffentlicht: (2026)
von: Lu, Zhicong, et al.
Veröffentlicht: (2026)
Large Language Model-Enhanced Reinforcement Learning for Generic Bus Holding Control Strategies
von: Yu, Jiajie, et al.
Veröffentlicht: (2024)
von: Yu, Jiajie, et al.
Veröffentlicht: (2024)
LongSafety: Enhance Safety for Long-Context LLMs
von: Huang, Mianqiu, et al.
Veröffentlicht: (2024)
von: Huang, Mianqiu, et al.
Veröffentlicht: (2024)
Stacked Universal Successor Feature Approximators for Safety in Reinforcement Learning
von: Cannon, Ian, et al.
Veröffentlicht: (2024)
von: Cannon, Ian, et al.
Veröffentlicht: (2024)
Sparsity-based Safety Conservatism for Constrained Offline Reinforcement Learning
von: Cho, Minjae, et al.
Veröffentlicht: (2024)
von: Cho, Minjae, et al.
Veröffentlicht: (2024)
Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
von: Ma, Guozheng, et al.
Veröffentlicht: (2023)
von: Ma, Guozheng, et al.
Veröffentlicht: (2023)
Hierarchical Reinforcement Learning with Runtime Safety Shielding for Power Grid Operation
von: Malik, Gitesh
Veröffentlicht: (2026)
von: Malik, Gitesh
Veröffentlicht: (2026)
NeuronTune: Fine-Grained Neuron Modulation for Balanced Safety-Utility Alignment in LLMs
von: Pan, Birong, et al.
Veröffentlicht: (2025)
von: Pan, Birong, et al.
Veröffentlicht: (2025)
Efficient Reinforcement Learning in Probabilistic Reward Machines
von: Lin, Xiaofeng, et al.
Veröffentlicht: (2024)
von: Lin, Xiaofeng, et al.
Veröffentlicht: (2024)
AlphaAlign: Incentivizing Safety Alignment with Extremely Simplified Reinforcement Learning
von: Zhang, Yi, et al.
Veröffentlicht: (2025)
von: Zhang, Yi, et al.
Veröffentlicht: (2025)
Hierarchical Multi-Agent Reinforcement Learning with Control Barrier Functions for Safety-Critical Autonomous Systems
von: Ahmad, H. M. Sabbir, et al.
Veröffentlicht: (2025)
von: Ahmad, H. M. Sabbir, et al.
Veröffentlicht: (2025)
Unbiased GNN Learning via Fairness-Aware Subgraph Diffusion
von: Alchihabi, Abdullah, et al.
Veröffentlicht: (2024)
von: Alchihabi, Abdullah, et al.
Veröffentlicht: (2024)
Which Rewards Matter? Reward Selection for Reinforcement Learning under Limited Feedback
von: Chaudhari, Shreyas, et al.
Veröffentlicht: (2025)
von: Chaudhari, Shreyas, et al.
Veröffentlicht: (2025)
TriPlay-RL: Tri-Role Self-Play Reinforcement Learning for LLM Safety Alignment
von: Tan, Zhewen, et al.
Veröffentlicht: (2026)
von: Tan, Zhewen, et al.
Veröffentlicht: (2026)
Enhancing Building Safety Design for Active Shooter Incidents: Exploration of Building Exit Parameters using Reinforcement Learning-Based Simulations
von: Liu, Ruying, et al.
Veröffentlicht: (2024)
von: Liu, Ruying, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Diffusion Modulation via Environment Mechanism Modeling for Planning
von: Zhang, Hanping, et al.
Veröffentlicht: (2026) -
Skill-Enhanced Reinforcement Learning Acceleration from Heterogeneous Demonstrations
von: Zhang, Hanping, et al.
Veröffentlicht: (2024) -
LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning
von: Zhang, Hanping, et al.
Veröffentlicht: (2025) -
Skill-based Safe Reinforcement Learning with Risk Planning
von: Zhang, Hanping, et al.
Veröffentlicht: (2025) -
Bridging Dynamics Gaps via Diffusion Schrödinger Bridge for Cross-Domain Reinforcement Learning
von: Zhang, Hanping, et al.
Veröffentlicht: (2026)