Uniformly Safe RL with Objective Suppression for Multi-Constraint Safety-Critical Applications
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Zihan, Booher, Jonathan, Rohanimanesh, Khashayar, Liu, Wei, Petiushko, Aleksandr, Garg, Animesh |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CIMRL: Combining IMitation and Reinforcement Learning for Safe Autonomous Driving
por: Booher, Jonathan, et al.
Publicado: (2024)
por: Booher, Jonathan, et al.
Publicado: (2024)
SafeAuto: Knowledge-Enhanced Safe Autonomous Driving with Multimodal Foundation Models
por: Zhang, Jiawei, et al.
Publicado: (2025)
por: Zhang, Jiawei, et al.
Publicado: (2025)
ReinforceGen: Hybrid Skill Policies with Automated Data Generation and Reinforcement Learning
por: Zhou, Zihan, et al.
Publicado: (2025)
por: Zhou, Zihan, et al.
Publicado: (2025)
Adaptive Horizon Actor-Critic for Policy Learning in Contact-Rich Differentiable Simulation
por: Georgiev, Ignat, et al.
Publicado: (2024)
por: Georgiev, Ignat, et al.
Publicado: (2024)
Safe Reinforcement Learning with Learned Non-Markovian Safety Constraints
por: Low, Siow Meng, et al.
Publicado: (2024)
por: Low, Siow Meng, et al.
Publicado: (2024)
Probabilistic Constraint for Safety-Critical Reinforcement Learning
por: Chen, Weiqin, et al.
Publicado: (2023)
por: Chen, Weiqin, et al.
Publicado: (2023)
Cooperative Multi-agent RL with Communication Constraints
por: Xiong, Nuoya, et al.
Publicado: (2026)
por: Xiong, Nuoya, et al.
Publicado: (2026)
PWM: Policy Learning with Multi-Task World Models
por: Georgiev, Ignat, et al.
Publicado: (2024)
por: Georgiev, Ignat, et al.
Publicado: (2024)
SPIRE: Synergistic Planning, Imitation, and Reinforcement Learning for Long-Horizon Manipulation
por: Zhou, Zihan, et al.
Publicado: (2024)
por: Zhou, Zihan, et al.
Publicado: (2024)
Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
por: Gu, Shangding, et al.
Publicado: (2024)
por: Gu, Shangding, et al.
Publicado: (2024)
Multi-Objective Instruction-Aware Representation Learning in Procedural Content Generation RL
por: Kim, Sung-Hyun, et al.
Publicado: (2025)
por: Kim, Sung-Hyun, et al.
Publicado: (2025)
A Safety Modulator Actor-Critic Method in Model-Free Safe Reinforcement Learning and Application in UAV Hovering
por: Qi, Qihan, et al.
Publicado: (2024)
por: Qi, Qihan, et al.
Publicado: (2024)
Blockwise Advantage Estimation for Multi-Objective RL with Verifiable Rewards
por: Pavlenko, Kirill, et al.
Publicado: (2026)
por: Pavlenko, Kirill, et al.
Publicado: (2026)
Training RL Agents for Multi-Objective Network Defense Tasks
por: Molina-Markham, Andres, et al.
Publicado: (2025)
por: Molina-Markham, Andres, et al.
Publicado: (2025)
Rethinking RL Evaluation: Can Benchmarks Truly Reveal Failures of RL Methods?
por: Chen, Zihan, et al.
Publicado: (2025)
por: Chen, Zihan, et al.
Publicado: (2025)
FBOS-RL: Feedback-Driven Bi-Objective Synergistic Reinforcement Learning
por: Zhang, Xikai, et al.
Publicado: (2026)
por: Zhang, Xikai, et al.
Publicado: (2026)
Offline Inverse Constrained Reinforcement Learning for Safe-Critical Decision Making in Healthcare
por: Fang, Nan, et al.
Publicado: (2024)
por: Fang, Nan, et al.
Publicado: (2024)
Model-Based Safe Reinforcement Learning with Time-Varying State and Control Constraints: An Application to Intelligent Vehicles
por: Zhang, Xinglong, et al.
Publicado: (2021)
por: Zhang, Xinglong, et al.
Publicado: (2021)
SafeCoT: Improving VLM Safety with Minimal Reasoning
por: Ma, Jiachen, et al.
Publicado: (2025)
por: Ma, Jiachen, et al.
Publicado: (2025)
Opir: Efficient Multi-Task Safety Classification for Toxicity, Jailbreaks, Hate Speech, and Harmful Content
por: Stepanov, Ihor, et al.
Publicado: (2026)
por: Stepanov, Ihor, et al.
Publicado: (2026)
DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems
por: Yoo, Se-Wook, et al.
Publicado: (2025)
por: Yoo, Se-Wook, et al.
Publicado: (2025)
AviaSafe: A Physics-Informed Data-Driven Model for Aviation Safety-Critical Cloud Forecasts
por: Zhu, Zijian, et al.
Publicado: (2026)
por: Zhu, Zijian, et al.
Publicado: (2026)
Constraint-Adaptive Policy Switching for Offline Safe Reinforcement Learning
por: Chemingui, Yassine, et al.
Publicado: (2024)
por: Chemingui, Yassine, et al.
Publicado: (2024)
Your Reward Function for RL is Your Best PRM for Search: Unifying RL and Search-Based TTS
por: Jin, Can, et al.
Publicado: (2025)
por: Jin, Can, et al.
Publicado: (2025)
GAS: Enhancing Reward-Cost Balance of Generative Model-assisted Offline Safe RL
por: Liu, Zifan, et al.
Publicado: (2026)
por: Liu, Zifan, et al.
Publicado: (2026)
Provable Last-Iterate Convergence for Multi-Objective Safe LLM Alignment via Optimistic Primal-Dual
por: Li, Yining, et al.
Publicado: (2026)
por: Li, Yining, et al.
Publicado: (2026)
Multi-Objective Constraint Inference using Inverse reinforcement learning
por: Shah, Syed Ihtesham Hussain, et al.
Publicado: (2026)
por: Shah, Syed Ihtesham Hussain, et al.
Publicado: (2026)
Reinforcement Learning with $ω$-Regular Objectives and Constraints
por: Wagner, Dominik, et al.
Publicado: (2025)
por: Wagner, Dominik, et al.
Publicado: (2025)
Robust Evolutionary Multi-Objective Network Architecture Search for Reinforcement Learning (EMNAS-RL)
por: Adde, Nihal Acharya, et al.
Publicado: (2025)
por: Adde, Nihal Acharya, et al.
Publicado: (2025)
SafeSeek: Universal Attribution of Safety Circuits in Language Models
por: Yu, Miao, et al.
Publicado: (2026)
por: Yu, Miao, et al.
Publicado: (2026)
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
por: Yao, Yihang, et al.
Publicado: (2023)
por: Yao, Yihang, et al.
Publicado: (2023)
Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
por: Ji, Jiaming, et al.
Publicado: (2023)
por: Ji, Jiaming, et al.
Publicado: (2023)
Unraveling the Complexity of Memory in RL Agents: an Approach for Classification and Evaluation
por: Cherepanov, Egor, et al.
Publicado: (2024)
por: Cherepanov, Egor, et al.
Publicado: (2024)
COSMO-RL: Towards Trustworthy LMRMs via Joint Safety and Stability
por: Ding, Yizhuo, et al.
Publicado: (2025)
por: Ding, Yizhuo, et al.
Publicado: (2025)
ELMUR: External Layer Memory with Update/Rewrite for Long-Horizon RL Problems
por: Cherepanov, Egor, et al.
Publicado: (2025)
por: Cherepanov, Egor, et al.
Publicado: (2025)
Reinforce-Ada: An Adaptive Sampling Framework under Non-linear RL Objectives
por: Xiong, Wei, et al.
Publicado: (2025)
por: Xiong, Wei, et al.
Publicado: (2025)
A Survey of Constraint Formulations in Safe Reinforcement Learning
por: Wachi, Akifumi, et al.
Publicado: (2024)
por: Wachi, Akifumi, et al.
Publicado: (2024)
Pruning the Way to Reliable Policies: A Multi-Objective Deep Q-Learning Approach to Critical Care
por: Shirali, Ali, et al.
Publicado: (2023)
por: Shirali, Ali, et al.
Publicado: (2023)
MATE: LLM-Powered Multi-Agent Translation Environment for Accessibility Applications
por: Algazinov, Aleksandr, et al.
Publicado: (2025)
por: Algazinov, Aleksandr, et al.
Publicado: (2025)
CLIMB: Language-Guided Continual Learning for Task Planning with Iterative Model Building
por: Byrnes, Walker, et al.
Publicado: (2024)
por: Byrnes, Walker, et al.
Publicado: (2024)
Ejemplares similares
-
CIMRL: Combining IMitation and Reinforcement Learning for Safe Autonomous Driving
por: Booher, Jonathan, et al.
Publicado: (2024) -
SafeAuto: Knowledge-Enhanced Safe Autonomous Driving with Multimodal Foundation Models
por: Zhang, Jiawei, et al.
Publicado: (2025) -
ReinforceGen: Hybrid Skill Policies with Automated Data Generation and Reinforcement Learning
por: Zhou, Zihan, et al.
Publicado: (2025) -
Adaptive Horizon Actor-Critic for Policy Learning in Contact-Rich Differentiable Simulation
por: Georgiev, Ignat, et al.
Publicado: (2024) -
Safe Reinforcement Learning with Learned Non-Markovian Safety Constraints
por: Low, Siow Meng, et al.
Publicado: (2024)