Safety-Oriented Pruning and Interpretation of Reinforcement Learning Policies
Fuente:
arXiv
Salvato in:
| Autori principali: | Gross, Dennis, Spieker, Helge |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Co-Activation Graph Analysis of Safety-Verified and Explainable Deep Reinforcement Learning Policies
di: Gross, Dennis, et al.
Pubblicazione: (2025)
di: Gross, Dennis, et al.
Pubblicazione: (2025)
Enhancing RL Safety with Counterfactual LLM Reasoning
di: Gross, Dennis, et al.
Pubblicazione: (2024)
di: Gross, Dennis, et al.
Pubblicazione: (2024)
Probabilistic Model Checking of Stochastic Reinforcement Learning Policies
di: Gross, Dennis, et al.
Pubblicazione: (2024)
di: Gross, Dennis, et al.
Pubblicazione: (2024)
Translating the Rashomon Effect to Sequential Decision-Making Tasks
di: Gross, Dennis, et al.
Pubblicazione: (2025)
di: Gross, Dennis, et al.
Pubblicazione: (2025)
Efficient Milling Quality Prediction with Explainable Machine Learning
di: Gross, Dennis, et al.
Pubblicazione: (2024)
di: Gross, Dennis, et al.
Pubblicazione: (2024)
Enhancing Manufacturing Quality Prediction Models through the Integration of Explainability Methods
di: Gross, Dennis, et al.
Pubblicazione: (2024)
di: Gross, Dennis, et al.
Pubblicazione: (2024)
Semi-supervised CAPP Transformer Learning via Pseudo-labeling
di: Gross, Dennis, et al.
Pubblicazione: (2026)
di: Gross, Dennis, et al.
Pubblicazione: (2026)
Turn-based Multi-Agent Reinforcement Learning Model Checking
di: Gross, Dennis
Pubblicazione: (2025)
di: Gross, Dennis
Pubblicazione: (2025)
Formally Verifying and Explaining Sepsis Treatment Policies with COOL-MC
di: Gross, Dennis
Pubblicazione: (2026)
di: Gross, Dennis
Pubblicazione: (2026)
COOL-MC: Verifying and Explaining RL Policies for Platelet Inventory Management
di: Gross, Dennis
Pubblicazione: (2026)
di: Gross, Dennis
Pubblicazione: (2026)
COOL-MC: Verifying and Explaining RL Policies for Multi-bridge Network Maintenance
di: Gross, Dennis
Pubblicazione: (2026)
di: Gross, Dennis
Pubblicazione: (2026)
Optimizing Interpretable Decision Tree Policies for Reinforcement Learning
di: Vos, Daniël, et al.
Pubblicazione: (2024)
di: Vos, Daniël, et al.
Pubblicazione: (2024)
Efficient Policy Evaluation with Safety Constraint for Reinforcement Learning
di: Chen, Claire, et al.
Pubblicazione: (2024)
di: Chen, Claire, et al.
Pubblicazione: (2024)
Understanding Annotator Safety Policy with Interpretability
di: Oesterling, Alex, et al.
Pubblicazione: (2026)
di: Oesterling, Alex, et al.
Pubblicazione: (2026)
Interpretable and Editable Programmatic Tree Policies for Reinforcement Learning
di: Kohler, Hector, et al.
Pubblicazione: (2024)
di: Kohler, Hector, et al.
Pubblicazione: (2024)
Evaluating Interpretable Reinforcement Learning by Distilling Policies into Programs
di: Kohler, Hector, et al.
Pubblicazione: (2025)
di: Kohler, Hector, et al.
Pubblicazione: (2025)
Concurrent Learning of Policy and Unknown Safety Constraints in Reinforcement Learning
di: Yifru, Lunet, et al.
Pubblicazione: (2024)
di: Yifru, Lunet, et al.
Pubblicazione: (2024)
Latent Safety-Constrained Policy Approach for Safe Offline Reinforcement Learning
di: Koirala, Prajwal, et al.
Pubblicazione: (2024)
di: Koirala, Prajwal, et al.
Pubblicazione: (2024)
Towards Interpretable Reinforcement Learning with Constrained Normalizing Flow Policies
di: Rietz, Finn, et al.
Pubblicazione: (2024)
di: Rietz, Finn, et al.
Pubblicazione: (2024)
Reusable Test Suites for Reinforcement Learning
di: Betten, Jørn Eirik, et al.
Pubblicazione: (2025)
di: Betten, Jørn Eirik, et al.
Pubblicazione: (2025)
Verifying Memoryless Sequential Decision-making of Large Language Models
di: Gross, Dennis, et al.
Pubblicazione: (2025)
di: Gross, Dennis, et al.
Pubblicazione: (2025)
Bounded PCTL Model Checking of Large Language Model Outputs
di: Gross, Dennis, et al.
Pubblicazione: (2025)
di: Gross, Dennis, et al.
Pubblicazione: (2025)
From Explainability to Interpretability: Interpretable Policies in Reinforcement Learning Via Model Explanation
di: Li, Peilang, et al.
Pubblicazione: (2025)
di: Li, Peilang, et al.
Pubblicazione: (2025)
Three Pathways to Neurosymbolic Reinforcement Learning with Interpretable Model and Policy Networks
di: Graf, Peter, et al.
Pubblicazione: (2024)
di: Graf, Peter, et al.
Pubblicazione: (2024)
Prism: Policy Reuse via Interpretable Strategy Mapping in Reinforcement Learning
di: Pravetz, Thomas
Pubblicazione: (2026)
di: Pravetz, Thomas
Pubblicazione: (2026)
Learning Interpretable Policies in Hindsight-Observable POMDPs through Partially Supervised Reinforcement Learning
di: Lanier, Michael, et al.
Pubblicazione: (2024)
di: Lanier, Michael, et al.
Pubblicazione: (2024)
Rashomon in the Streets: Explanation Ambiguity in Scene Understanding
di: Spieker, Helge, et al.
Pubblicazione: (2025)
di: Spieker, Helge, et al.
Pubblicazione: (2025)
Exploiting Hybrid Policy in Reinforcement Learning for Interpretable Temporal Logic Manipulation
di: Zhang, Hao, et al.
Pubblicazione: (2024)
di: Zhang, Hao, et al.
Pubblicazione: (2024)
Safety Representations for Safer Policy Learning
di: Mani, Kaustubh, et al.
Pubblicazione: (2025)
di: Mani, Kaustubh, et al.
Pubblicazione: (2025)
Interpretable Learning Dynamics in Unsupervised Reinforcement Learning
di: Pandey, Shashwat
Pubblicazione: (2025)
di: Pandey, Shashwat
Pubblicazione: (2025)
ObjectRL: An Object-Oriented Reinforcement Learning Codebase
di: Baykal, Gulcin, et al.
Pubblicazione: (2025)
di: Baykal, Gulcin, et al.
Pubblicazione: (2025)
Mechanistic Interpretability of Reinforcement Learning Agents
di: Trim, Tristan, et al.
Pubblicazione: (2024)
di: Trim, Tristan, et al.
Pubblicazione: (2024)
Interpreting Reinforcement Learning Agents with Susceptibilities
di: Elliott, Chris, et al.
Pubblicazione: (2026)
di: Elliott, Chris, et al.
Pubblicazione: (2026)
Pruning Cannot Hurt Robustness: Certified Trade-offs in Reinforcement Learning
di: Pedley, James, et al.
Pubblicazione: (2025)
di: Pedley, James, et al.
Pubblicazione: (2025)
The Impact of Quantization and Pruning on Deep Reinforcement Learning Models
di: Lu, Heng, et al.
Pubblicazione: (2024)
di: Lu, Heng, et al.
Pubblicazione: (2024)
On-Policy Policy Gradient Reinforcement Learning Without On-Policy Sampling
di: Corrado, Nicholas E., et al.
Pubblicazione: (2023)
di: Corrado, Nicholas E., et al.
Pubblicazione: (2023)
Policy Improvement Reinforcement Learning
di: Wang, Huaiyang, et al.
Pubblicazione: (2026)
di: Wang, Huaiyang, et al.
Pubblicazione: (2026)
Safety Optimized Reinforcement Learning via Multi-Objective Policy Optimization
di: Honari, Homayoun, et al.
Pubblicazione: (2024)
di: Honari, Homayoun, et al.
Pubblicazione: (2024)
Online Training and Pruning of Deep Reinforcement Learning Networks
di: Guenter, Valentin Frank Ingmar, et al.
Pubblicazione: (2025)
di: Guenter, Valentin Frank Ingmar, et al.
Pubblicazione: (2025)
Enhancing Safety in Reinforcement Learning with Human Feedback via Rectified Policy Optimization
di: Peng, Xiyue, et al.
Pubblicazione: (2024)
di: Peng, Xiyue, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Co-Activation Graph Analysis of Safety-Verified and Explainable Deep Reinforcement Learning Policies
di: Gross, Dennis, et al.
Pubblicazione: (2025) -
Enhancing RL Safety with Counterfactual LLM Reasoning
di: Gross, Dennis, et al.
Pubblicazione: (2024) -
Probabilistic Model Checking of Stochastic Reinforcement Learning Policies
di: Gross, Dennis, et al.
Pubblicazione: (2024) -
Translating the Rashomon Effect to Sequential Decision-Making Tasks
di: Gross, Dennis, et al.
Pubblicazione: (2025) -
Efficient Milling Quality Prediction with Explainable Machine Learning
di: Gross, Dennis, et al.
Pubblicazione: (2024)