An Explainable Deep Reinforcement Learning Model for Warfarin Maintenance Dosing Using Policy Distillation and Action Forging
Fuente:
arXiv
Salvato in:
| Autori principali: | Zadeh, Sadjad Anzabi, Street, W. Nick, Thomas, Barrett W. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Optimizing Warfarin Dosing Using Contextual Bandit: An Offline Policy Learning and Evaluation Method
di: Huang, Yong, et al.
Pubblicazione: (2024)
di: Huang, Yong, et al.
Pubblicazione: (2024)
FedDES: Graph-Based Dynamic Ensemble Selection for Personalized Federated Learning
di: Mueller, Brianna, et al.
Pubblicazione: (2026)
di: Mueller, Brianna, et al.
Pubblicazione: (2026)
Continual Deep Reinforcement Learning with Task-Agnostic Policy Distillation
di: Hafez, Muhammad Burhan, et al.
Pubblicazione: (2024)
di: Hafez, Muhammad Burhan, et al.
Pubblicazione: (2024)
FedPAE: Peer-Adaptive Ensemble Learning for Asynchronous and Model-Heterogeneous Federated Learning
di: Mueller, Brianna, et al.
Pubblicazione: (2024)
di: Mueller, Brianna, et al.
Pubblicazione: (2024)
To Start Up a Start-Up$-$Embedding Strategic Demand Development in Operational On-Demand Fulfillment via Reinforcement Learning with Information Shaping
di: Chen, Xinwei, et al.
Pubblicazione: (2025)
di: Chen, Xinwei, et al.
Pubblicazione: (2025)
Critic-Driven Voronoi-Quantization for Distilling Deep RL Policies to Explainable Models
di: Deproost, Senne, et al.
Pubblicazione: (2026)
di: Deproost, Senne, et al.
Pubblicazione: (2026)
Development and Validation of Heparin Dosing Policies Using an Offline Reinforcement Learning Algorithm
di: Lim, Yooseok, et al.
Pubblicazione: (2024)
di: Lim, Yooseok, et al.
Pubblicazione: (2024)
Causal State Distillation for Explainable Reinforcement Learning
di: Lu, Wenhao, et al.
Pubblicazione: (2023)
di: Lu, Wenhao, et al.
Pubblicazione: (2023)
Using Part-based Representations for Explainable Deep Reinforcement Learning
di: Kirtas, Manos, et al.
Pubblicazione: (2024)
di: Kirtas, Manos, et al.
Pubblicazione: (2024)
Co-Activation Graph Analysis of Safety-Verified and Explainable Deep Reinforcement Learning Policies
di: Gross, Dennis, et al.
Pubblicazione: (2025)
di: Gross, Dennis, et al.
Pubblicazione: (2025)
Action-Graph Policies: Learning Action Co-dependencies in Multi-Agent Reinforcement Learning
di: Gupta, Nikunj, et al.
Pubblicazione: (2026)
di: Gupta, Nikunj, et al.
Pubblicazione: (2026)
Explainable Reinforcement Learning via Temporal Policy Decomposition
di: Ruggeri, Franco, et al.
Pubblicazione: (2025)
di: Ruggeri, Franco, et al.
Pubblicazione: (2025)
A Survey on Explainable Deep Reinforcement Learning
di: Cheng, Zelei, et al.
Pubblicazione: (2025)
di: Cheng, Zelei, et al.
Pubblicazione: (2025)
Continual Policy Distillation from Distributed Reinforcement Learning Teachers
di: Li, Yuxuan, et al.
Pubblicazione: (2026)
di: Li, Yuxuan, et al.
Pubblicazione: (2026)
Practical Policy Distillation for Reinforcement Learning in Radio Access Networks
di: Khosravi, Sara, et al.
Pubblicazione: (2025)
di: Khosravi, Sara, et al.
Pubblicazione: (2025)
BraVE: Offline Reinforcement Learning for Discrete Combinatorial Action Spaces
di: Landers, Matthew, et al.
Pubblicazione: (2024)
di: Landers, Matthew, et al.
Pubblicazione: (2024)
"So, Tell Me About Your Policy...": Distillation of interpretable policies from Deep Reinforcement Learning agents
di: Dispoto, Giovanni, et al.
Pubblicazione: (2025)
di: Dispoto, Giovanni, et al.
Pubblicazione: (2025)
Internalize the Temperature: On-Policy Self-Distillation as Policy Reheater for Reinforcement Learning
di: Yang, Xuewei, et al.
Pubblicazione: (2026)
di: Yang, Xuewei, et al.
Pubblicazione: (2026)
Evaluating Interpretable Reinforcement Learning by Distilling Policies into Programs
di: Kohler, Hector, et al.
Pubblicazione: (2025)
di: Kohler, Hector, et al.
Pubblicazione: (2025)
Deep Multi-Objective Reinforcement Learning for Utility-Based Infrastructural Maintenance Optimization
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024)
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024)
Efficiently Training Deep-Learning Parametric Policies using Lagrangian Duality
di: Rosemberg, Andrew, et al.
Pubblicazione: (2024)
di: Rosemberg, Andrew, et al.
Pubblicazione: (2024)
Latent Spherical Flow Policy for Reinforcement Learning with Combinatorial Actions
di: Kong, Lingkai, et al.
Pubblicazione: (2026)
di: Kong, Lingkai, et al.
Pubblicazione: (2026)
Constrained Latent Action Policies for Model-Based Offline Reinforcement Learning
di: Alles, Marvin, et al.
Pubblicazione: (2024)
di: Alles, Marvin, et al.
Pubblicazione: (2024)
Where to Intervene: Action Selection in Deep Reinforcement Learning
di: Zhang, Wenbo, et al.
Pubblicazione: (2025)
di: Zhang, Wenbo, et al.
Pubblicazione: (2025)
Safe Reinforcement Learning using Action Projection: Safeguard the Policy or the Environment?
di: Markgraf, Hannah, et al.
Pubblicazione: (2025)
di: Markgraf, Hannah, et al.
Pubblicazione: (2025)
Improving Policy Exploitation in Online Reinforcement Learning with Instant Retrospect Action
di: Gao, Gong, et al.
Pubblicazione: (2026)
di: Gao, Gong, et al.
Pubblicazione: (2026)
How Ensembles of Distilled Policies Improve Generalisation in Reinforcement Learning
di: Weltevrede, Max, et al.
Pubblicazione: (2025)
di: Weltevrede, Max, et al.
Pubblicazione: (2025)
From Explainability to Interpretability: Interpretable Policies in Reinforcement Learning Via Model Explanation
di: Li, Peilang, et al.
Pubblicazione: (2025)
di: Li, Peilang, et al.
Pubblicazione: (2025)
Explainable AI for Radar Resource Management: Modified LIME in Deep Reinforcement Learning
di: Lu, Ziyang, et al.
Pubblicazione: (2025)
di: Lu, Ziyang, et al.
Pubblicazione: (2025)
TrojanForge: Generating Adversarial Hardware Trojan Examples Using Reinforcement Learning
di: Sarihi, Amin, et al.
Pubblicazione: (2024)
di: Sarihi, Amin, et al.
Pubblicazione: (2024)
Explainable RL Policies by Distilling to Locally-Specialized Linear Policies with Voronoi State Partitioning
di: Deproost, Senne, et al.
Pubblicazione: (2025)
di: Deproost, Senne, et al.
Pubblicazione: (2025)
LISA: Learning-Integrated Space Partitioning Framework for Traffic Accident Forecasting on Heterogeneous Spatiotemporal Data
di: An, Bang, et al.
Pubblicazione: (2024)
di: An, Bang, et al.
Pubblicazione: (2024)
TranDRL: A Transformer-Driven Deep Reinforcement Learning Enabled Prescriptive Maintenance Framework
di: Zhao, Yang, et al.
Pubblicazione: (2023)
di: Zhao, Yang, et al.
Pubblicazione: (2023)
RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning
di: Xu, Charles, et al.
Pubblicazione: (2024)
di: Xu, Charles, et al.
Pubblicazione: (2024)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
Incentivizing Safer Actions in Policy Optimization for Constrained Reinforcement Learning
di: Hazra, Somnath, et al.
Pubblicazione: (2025)
di: Hazra, Somnath, et al.
Pubblicazione: (2025)
Action Robust Reinforcement Learning via Optimal Adversary Aware Policy Optimization
di: Nie, Buqing, et al.
Pubblicazione: (2025)
di: Nie, Buqing, et al.
Pubblicazione: (2025)
Actor-Accelerated Policy Dual Averaging for Reinforcement Learning in Continuous Action Spaces
di: Gao, Ji, et al.
Pubblicazione: (2026)
di: Gao, Ji, et al.
Pubblicazione: (2026)
Glinthawk: A Two-Tiered Architecture for Offline LLM Inference
di: Hamadanian, Pouya, et al.
Pubblicazione: (2025)
di: Hamadanian, Pouya, et al.
Pubblicazione: (2025)
Neuro-symbolic Action Masking for Deep Reinforcement Learning
di: Han, Shuai, et al.
Pubblicazione: (2026)
di: Han, Shuai, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Optimizing Warfarin Dosing Using Contextual Bandit: An Offline Policy Learning and Evaluation Method
di: Huang, Yong, et al.
Pubblicazione: (2024) -
FedDES: Graph-Based Dynamic Ensemble Selection for Personalized Federated Learning
di: Mueller, Brianna, et al.
Pubblicazione: (2026) -
Continual Deep Reinforcement Learning with Task-Agnostic Policy Distillation
di: Hafez, Muhammad Burhan, et al.
Pubblicazione: (2024) -
FedPAE: Peer-Adaptive Ensemble Learning for Asynchronous and Model-Heterogeneous Federated Learning
di: Mueller, Brianna, et al.
Pubblicazione: (2024) -
To Start Up a Start-Up$-$Embedding Strategic Demand Development in Operational On-Demand Fulfillment via Reinforcement Learning with Information Shaping
di: Chen, Xinwei, et al.
Pubblicazione: (2025)