Reinfier and Reintrainer: Verification and Interpretation-Driven Safe Deep Reinforcement Learning Frameworks
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Zixuan, Zheng, Jiaqi, Chen, Guihai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
You Need an Encoder for Native Position-Independent Caching
por: Zhao, Shiju, et al.
Publicado: (2026)
por: Zhao, Shiju, et al.
Publicado: (2026)
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
por: Anisimov, Maksim, et al.
Publicado: (2026)
por: Anisimov, Maksim, et al.
Publicado: (2026)
TranDRL: A Transformer-Driven Deep Reinforcement Learning Enabled Prescriptive Maintenance Framework
por: Zhao, Yang, et al.
Publicado: (2023)
por: Zhao, Yang, et al.
Publicado: (2023)
Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
por: Dai, Juntao, et al.
Publicado: (2024)
por: Dai, Juntao, et al.
Publicado: (2024)
Long and Short-Term Constraints Driven Safe Reinforcement Learning for Autonomous Driving
por: Hu, Xuemin, et al.
Publicado: (2024)
por: Hu, Xuemin, et al.
Publicado: (2024)
Interpretable Modeling of Deep Reinforcement Learning Driven Scheduling
por: Li, Boyang, et al.
Publicado: (2024)
por: Li, Boyang, et al.
Publicado: (2024)
Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning
por: Xie, Sean, et al.
Publicado: (2022)
por: Xie, Sean, et al.
Publicado: (2022)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
por: Chen, Rufeng, et al.
Publicado: (2026)
por: Chen, Rufeng, et al.
Publicado: (2026)
Interpretable Deep Reinforcement Learning for Element-level Bridge Life-cycle Optimization
por: Moayyedi, Seyyed Amirhossein, et al.
Publicado: (2026)
por: Moayyedi, Seyyed Amirhossein, et al.
Publicado: (2026)
Reinforcement Learning by Guided Safe Exploration
por: Yang, Qisong, et al.
Publicado: (2023)
por: Yang, Qisong, et al.
Publicado: (2023)
BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning
por: Xu, Yuhang, et al.
Publicado: (2026)
por: Xu, Yuhang, et al.
Publicado: (2026)
Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
por: Gu, Shangding, et al.
Publicado: (2024)
por: Gu, Shangding, et al.
Publicado: (2024)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
por: Ji, Jiaming, et al.
Publicado: (2025)
por: Ji, Jiaming, et al.
Publicado: (2025)
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning
por: Wang, Xuefeng, et al.
Publicado: (2024)
por: Wang, Xuefeng, et al.
Publicado: (2024)
A Review of Safe Reinforcement Learning: Methods, Theory and Applications
por: Gu, Shangding, et al.
Publicado: (2022)
por: Gu, Shangding, et al.
Publicado: (2022)
DeepCDCL: An CDCL-based Neural Network Verification Framework
por: Liu, Zongxin, et al.
Publicado: (2024)
por: Liu, Zongxin, et al.
Publicado: (2024)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
por: Zheng, Yinan, et al.
Publicado: (2024)
por: Zheng, Yinan, et al.
Publicado: (2024)
LiteInception: A Lightweight and Interpretable Deep Learning Framework for General Aviation Fault Diagnosis
por: Wei, Zhihuan, et al.
Publicado: (2026)
por: Wei, Zhihuan, et al.
Publicado: (2026)
Probabilistic Shielding for Safe Reinforcement Learning
por: Court, Edwin Hamel-De le, et al.
Publicado: (2025)
por: Court, Edwin Hamel-De le, et al.
Publicado: (2025)
Physics-Assisted and Topology-Informed Deep Learning for Weather Prediction
por: Zheng, Jiaqi, et al.
Publicado: (2025)
por: Zheng, Jiaqi, et al.
Publicado: (2025)
A Safe Deep Reinforcement Learning Approach for Energy Efficient Federated Learning in Wireless Communication Networks
por: Koursioumpas, Nikolaos, et al.
Publicado: (2023)
por: Koursioumpas, Nikolaos, et al.
Publicado: (2023)
Safe Deep Model-Based Reinforcement Learning with Lyapunov Functions
por: Zhang, Harry
Publicado: (2024)
por: Zhang, Harry
Publicado: (2024)
Is Optimal Transport Necessary for Inverse Reinforcement Learning?
por: Dong, Zixuan, et al.
Publicado: (2025)
por: Dong, Zixuan, et al.
Publicado: (2025)
Safe-SAIL: Towards a Fine-grained Safety Landscape of Large Language Models via Sparse Autoencoder Interpretation Framework
por: Weng, Jiaqi, et al.
Publicado: (2025)
por: Weng, Jiaqi, et al.
Publicado: (2025)
A Unified Deep Reinforcement Learning Approach for Close Enough Traveling Salesman Problem
por: Fan, Mingfeng, et al.
Publicado: (2025)
por: Fan, Mingfeng, et al.
Publicado: (2025)
Online Optimization for Offline Safe Reinforcement Learning
por: Chemingui, Yassine, et al.
Publicado: (2025)
por: Chemingui, Yassine, et al.
Publicado: (2025)
GUARD: A Safe Reinforcement Learning Benchmark
por: Zhao, Weiye, et al.
Publicado: (2023)
por: Zhao, Weiye, et al.
Publicado: (2023)
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
por: Tayal, Mumuksh, et al.
Publicado: (2026)
por: Tayal, Mumuksh, et al.
Publicado: (2026)
K-Score: Kalman Filter as a Principled Alternative to Reward Normalization in Reinforcement Learning
por: Xia, Zixuan, et al.
Publicado: (2026)
por: Xia, Zixuan, et al.
Publicado: (2026)
DeepEN: A Deep Reinforcement Learning Framework for Personalized Enteral Nutrition in Critical Care
por: Tan, Daniel Jason, et al.
Publicado: (2025)
por: Tan, Daniel Jason, et al.
Publicado: (2025)
Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
por: Ji, Jiaming, et al.
Publicado: (2023)
por: Ji, Jiaming, et al.
Publicado: (2023)
Towards Fast Safe Online Reinforcement Learning via Policy Finetuning
por: Chen, Keru, et al.
Publicado: (2024)
por: Chen, Keru, et al.
Publicado: (2024)
Implicit Safe Set Algorithm for Provably Safe Reinforcement Learning
por: Zhao, Weiye, et al.
Publicado: (2024)
por: Zhao, Weiye, et al.
Publicado: (2024)
Safe Reinforcement Learning with Learned Non-Markovian Safety Constraints
por: Low, Siow Meng, et al.
Publicado: (2024)
por: Low, Siow Meng, et al.
Publicado: (2024)
Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk
por: Ying, Chengyang, et al.
Publicado: (2022)
por: Ying, Chengyang, et al.
Publicado: (2022)
Enhance Exploration in Safe Reinforcement Learning with Contrastive Representation Learning
por: Doan, Duc Kien, et al.
Publicado: (2025)
por: Doan, Duc Kien, et al.
Publicado: (2025)
Sampling-Based Safe Reinforcement Learning
por: Vignola, Luca, et al.
Publicado: (2026)
por: Vignola, Luca, et al.
Publicado: (2026)
Offline Safe Reinforcement Learning Using Trajectory Classification
por: Gong, Ze, et al.
Publicado: (2024)
por: Gong, Ze, et al.
Publicado: (2024)
A Survey of Constraint Formulations in Safe Reinforcement Learning
por: Wachi, Akifumi, et al.
Publicado: (2024)
por: Wachi, Akifumi, et al.
Publicado: (2024)
Spectral-Risk Safe Reinforcement Learning with Convergence Guarantees
por: Kim, Dohyeong, et al.
Publicado: (2024)
por: Kim, Dohyeong, et al.
Publicado: (2024)
Ejemplares similares
-
You Need an Encoder for Native Position-Independent Caching
por: Zhao, Shiju, et al.
Publicado: (2026) -
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
por: Anisimov, Maksim, et al.
Publicado: (2026) -
TranDRL: A Transformer-Driven Deep Reinforcement Learning Enabled Prescriptive Maintenance Framework
por: Zhao, Yang, et al.
Publicado: (2023) -
Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
por: Dai, Juntao, et al.
Publicado: (2024) -
Long and Short-Term Constraints Driven Safe Reinforcement Learning for Autonomous Driving
por: Hu, Xuemin, et al.
Publicado: (2024)