Co-Activation Graph Analysis of Safety-Verified and Explainable Deep Reinforcement Learning Policies
Fuente:
arXiv
Saved in:
| Main Authors: | Gross, Dennis, Spieker, Helge |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Safety-Oriented Pruning and Interpretation of Reinforcement Learning Policies
by: Gross, Dennis, et al.
Published: (2024)
by: Gross, Dennis, et al.
Published: (2024)
Probabilistic Model Checking of Stochastic Reinforcement Learning Policies
by: Gross, Dennis, et al.
Published: (2024)
by: Gross, Dennis, et al.
Published: (2024)
Translating the Rashomon Effect to Sequential Decision-Making Tasks
by: Gross, Dennis, et al.
Published: (2025)
by: Gross, Dennis, et al.
Published: (2025)
Enhancing Manufacturing Quality Prediction Models through the Integration of Explainability Methods
by: Gross, Dennis, et al.
Published: (2024)
by: Gross, Dennis, et al.
Published: (2024)
Formally Verifying and Explaining Sepsis Treatment Policies with COOL-MC
by: Gross, Dennis
Published: (2026)
by: Gross, Dennis
Published: (2026)
COOL-MC: Verifying and Explaining RL Policies for Platelet Inventory Management
by: Gross, Dennis
Published: (2026)
by: Gross, Dennis
Published: (2026)
COOL-MC: Verifying and Explaining RL Policies for Multi-bridge Network Maintenance
by: Gross, Dennis
Published: (2026)
by: Gross, Dennis
Published: (2026)
Enhancing RL Safety with Counterfactual LLM Reasoning
by: Gross, Dennis, et al.
Published: (2024)
by: Gross, Dennis, et al.
Published: (2024)
Verifying Memoryless Sequential Decision-making of Large Language Models
by: Gross, Dennis, et al.
Published: (2025)
by: Gross, Dennis, et al.
Published: (2025)
Semi-supervised CAPP Transformer Learning via Pseudo-labeling
by: Gross, Dennis, et al.
Published: (2026)
by: Gross, Dennis, et al.
Published: (2026)
Turn-based Multi-Agent Reinforcement Learning Model Checking
by: Gross, Dennis
Published: (2025)
by: Gross, Dennis
Published: (2025)
Efficient Milling Quality Prediction with Explainable Machine Learning
by: Gross, Dennis, et al.
Published: (2024)
by: Gross, Dennis, et al.
Published: (2024)
Breaking the Safety-Capability Tradeoff: Reinforcement Learning with Verifiable Rewards Maintains Safety Guardrails in LLMs
by: Cho, Dongkyu Derek, et al.
Published: (2025)
by: Cho, Dongkyu Derek, et al.
Published: (2025)
Explainable Reinforcement Learning via Temporal Policy Decomposition
by: Ruggeri, Franco, et al.
Published: (2025)
by: Ruggeri, Franco, et al.
Published: (2025)
A Survey on Explainable Deep Reinforcement Learning
by: Cheng, Zelei, et al.
Published: (2025)
by: Cheng, Zelei, et al.
Published: (2025)
Bounded PCTL Model Checking of Large Language Model Outputs
by: Gross, Dennis, et al.
Published: (2025)
by: Gross, Dennis, et al.
Published: (2025)
Using Part-based Representations for Explainable Deep Reinforcement Learning
by: Kirtas, Manos, et al.
Published: (2024)
by: Kirtas, Manos, et al.
Published: (2024)
Deep Graph Learning for Industrial Carbon Emission Analysis and Policy Impact
by: Zhang, Xuanming
Published: (2025)
by: Zhang, Xuanming
Published: (2025)
Verifying Machine Unlearning with Explainable AI
by: Vidal, Àlex Pujol, et al.
Published: (2024)
by: Vidal, Àlex Pujol, et al.
Published: (2024)
Reinforcement Learning with Verifiable yet Noisy Rewards under Imperfect Verifiers
by: Cai, Xin-Qiang, et al.
Published: (2025)
by: Cai, Xin-Qiang, et al.
Published: (2025)
Explainable RL Policies by Distilling to Locally-Specialized Linear Policies with Voronoi State Partitioning
by: Deproost, Senne, et al.
Published: (2025)
by: Deproost, Senne, et al.
Published: (2025)
Rashomon in the Streets: Explanation Ambiguity in Scene Understanding
by: Spieker, Helge, et al.
Published: (2025)
by: Spieker, Helge, et al.
Published: (2025)
xSRL: Safety-Aware Explainable Reinforcement Learning -- Safety as a Product of Explainability
by: Shefin, Risal Shahriar, et al.
Published: (2024)
by: Shefin, Risal Shahriar, et al.
Published: (2024)
Formally Verifying Deep Reinforcement Learning Controllers with Lyapunov Barrier Certificates
by: Mandal, Udayan, et al.
Published: (2024)
by: Mandal, Udayan, et al.
Published: (2024)
DeepStock: Reinforcement Learning with Policy Regularizations for Inventory Management
by: Xie, Yaqi, et al.
Published: (2026)
by: Xie, Yaqi, et al.
Published: (2026)
A Study of Plasticity Loss in On-Policy Deep Reinforcement Learning
by: Juliani, Arthur, et al.
Published: (2024)
by: Juliani, Arthur, et al.
Published: (2024)
Contextual Rollout Bandits for Reinforcement Learning with Verifiable Rewards
by: Lu, Xiaodong, et al.
Published: (2026)
by: Lu, Xiaodong, et al.
Published: (2026)
Learning to Explore with Parameter-Space Noise: A Deep Dive into Parameter-Space Noise for Reinforcement Learning with Verifiable Rewards
by: Bai, Bizhe, et al.
Published: (2026)
by: Bai, Bizhe, et al.
Published: (2026)
SkillTree: Explainable Skill-Based Deep Reinforcement Learning for Long-Horizon Control Tasks
by: Wen, Yongyan, et al.
Published: (2024)
by: Wen, Yongyan, et al.
Published: (2024)
The Impact of On-Policy Parallelized Data Collection on Deep Reinforcement Learning Networks
by: Mayor, Walter, et al.
Published: (2025)
by: Mayor, Walter, et al.
Published: (2025)
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
by: Anisimov, Maksim, et al.
Published: (2026)
by: Anisimov, Maksim, et al.
Published: (2026)
Efficient Deep Reinforcement Learning with Predictive Processing Proximal Policy Optimization
by: Küçükoğlu, Burcu, et al.
Published: (2022)
by: Küçükoğlu, Burcu, et al.
Published: (2022)
Optimal Policy Sparsification and Low Rank Decomposition for Deep Reinforcement Learning
by: Goddla, Vikram
Published: (2024)
by: Goddla, Vikram
Published: (2024)
Deep Reinforcement Learning for Inventory Networks: Toward Reliable Policy Optimization
by: Alvo, Matias, et al.
Published: (2023)
by: Alvo, Matias, et al.
Published: (2023)
Verified Safe Reinforcement Learning for Neural Network Dynamic Models
by: Wu, Junlin, et al.
Published: (2024)
by: Wu, Junlin, et al.
Published: (2024)
From Explainability to Interpretability: Interpretable Policies in Reinforcement Learning Via Model Explanation
by: Li, Peilang, et al.
Published: (2025)
by: Li, Peilang, et al.
Published: (2025)
SAFE-RL: Saliency-Aware Counterfactual Explainer for Deep Reinforcement Learning Policies
by: Samadi, Amir, et al.
Published: (2024)
by: Samadi, Amir, et al.
Published: (2024)
Relative Importance Sampling for off-Policy Actor-Critic in Deep Reinforcement Learning
by: Humayoo, Mahammad, et al.
Published: (2018)
by: Humayoo, Mahammad, et al.
Published: (2018)
Improving Deep Reinforcement Learning by Reducing the Chain Effect of Value and Policy Churn
by: Tang, Hongyao, et al.
Published: (2024)
by: Tang, Hongyao, et al.
Published: (2024)
Solving Deep Reinforcement Learning Tasks with Evolution Strategies and Linear Policy Networks
by: Wong, Annie, et al.
Published: (2024)
by: Wong, Annie, et al.
Published: (2024)
Similar Items
-
Safety-Oriented Pruning and Interpretation of Reinforcement Learning Policies
by: Gross, Dennis, et al.
Published: (2024) -
Probabilistic Model Checking of Stochastic Reinforcement Learning Policies
by: Gross, Dennis, et al.
Published: (2024) -
Translating the Rashomon Effect to Sequential Decision-Making Tasks
by: Gross, Dennis, et al.
Published: (2025) -
Enhancing Manufacturing Quality Prediction Models through the Integration of Explainability Methods
by: Gross, Dennis, et al.
Published: (2024) -
Formally Verifying and Explaining Sepsis Treatment Policies with COOL-MC
by: Gross, Dennis
Published: (2026)