Near-Equivalent Q-learning Policies for Dynamic Treatment Regimes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yazzourh, Sophia, Moodie, Erica E. M. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Medical Knowledge Integration into Reinforcement Learning Algorithms for Dynamic Treatment Regimes
par: Yazzourh, Sophia, et autres
Publié: (2024)
par: Yazzourh, Sophia, et autres
Publié: (2024)
Information Borrowing from Partially Compatible Trajectories for Estimation of Dynamic Treatment Regimes
par: Si, Chloe, et autres
Publié: (2025)
par: Si, Chloe, et autres
Publié: (2025)
Policy Learning for Optimal Dynamic Treatment Regimes with Observational Data
par: Sakaguchi, Shosei
Publié: (2024)
par: Sakaguchi, Shosei
Publié: (2024)
Kernel-Based Distributed Q-Learning: A Scalable Reinforcement Learning Approach for Dynamic Treatment Regimes
par: Wang, Di, et autres
Publié: (2023)
par: Wang, Di, et autres
Publié: (2023)
POLAR: A Pessimistic Model-based Policy Learning Algorithm for Dynamic Treatment Regimes
par: Zhang, Ruijia, et autres
Publié: (2025)
par: Zhang, Ruijia, et autres
Publié: (2025)
On Multiple Robustness of Proximal Dynamic Treatment Regimes
par: Gao, Yuanshan, et autres
Publié: (2025)
par: Gao, Yuanshan, et autres
Publié: (2025)
Reinforcement Learning in Dynamic Treatment Regimes Needs Critical Reexamination
par: Luo, Zhiyao, et autres
Publié: (2024)
par: Luo, Zhiyao, et autres
Publié: (2024)
Evaluating and Learning Optimal Dynamic Treatment Regimes under Truncation by Death
par: Park, Sihyung, et autres
Publié: (2025)
par: Park, Sihyung, et autres
Publié: (2025)
Treatment Effects in Extreme Regimes
par: Aloui, Ahmed, et autres
Publié: (2023)
par: Aloui, Ahmed, et autres
Publié: (2023)
SAFER: A Calibrated Risk-Aware Multimodal Recommendation Model for Dynamic Treatment Regimes
par: Shen, Yishan, et autres
Publié: (2025)
par: Shen, Yishan, et autres
Publié: (2025)
G-Transformer: Counterfactual Outcome Prediction under Dynamic and Time-varying Treatment Regimes
par: Xiong, Hong, et autres
Publié: (2024)
par: Xiong, Hong, et autres
Publié: (2024)
Safe and Interpretable Estimation of Optimal Treatment Regimes
par: Parikh, Harsh, et autres
Publié: (2023)
par: Parikh, Harsh, et autres
Publié: (2023)
Regularized Q-learning
par: Lim, Han-Dong, et autres
Publié: (2022)
par: Lim, Han-Dong, et autres
Publié: (2022)
HyperQ-Opt: Q-learning for Hyperparameter Optimization
par: Hasan, Md. Tarek
Publié: (2024)
par: Hasan, Md. Tarek
Publié: (2024)
Q-Distribution guided Q-learning for offline reinforcement learning: Uncertainty penalized Q-value via consistency model
par: Zhang, Jing, et autres
Publié: (2024)
par: Zhang, Jing, et autres
Publié: (2024)
Multi-Timescale Ensemble Q-learning for Markov Decision Process Policy Optimization
par: Bozkus, Talha, et autres
Publié: (2024)
par: Bozkus, Talha, et autres
Publié: (2024)
An Index Policy Based on Sarsa and Q-learning for Heterogeneous Smart Target Tracking
par: Hao, Yuhang, et autres
Publié: (2024)
par: Hao, Yuhang, et autres
Publié: (2024)
Near-Future Policy Optimization
par: Qin, Chuanyu, et autres
Publié: (2026)
par: Qin, Chuanyu, et autres
Publié: (2026)
Personalized Treatment Hierarchies in Bayesian Network Meta-Analysis
par: Wigle, Augustine, et autres
Publié: (2026)
par: Wigle, Augustine, et autres
Publié: (2026)
Q-learning with Posterior Sampling
par: Agrawal, Priyank, et autres
Publié: (2025)
par: Agrawal, Priyank, et autres
Publié: (2025)
Transfer Q-learning
par: Chen, Elynn, et autres
Publié: (2022)
par: Chen, Elynn, et autres
Publié: (2022)
Generalisation in Multitask Fitted Q-Iteration and Offline Q-learning
par: Manda, Kausthubh, et autres
Publié: (2025)
par: Manda, Kausthubh, et autres
Publié: (2025)
Structural Equivalence and Learning Dynamics in Delayed MARL
par: Sintes, Jules, et autres
Publié: (2026)
par: Sintes, Jules, et autres
Publié: (2026)
DTR-Bench: An in silico Environment and Benchmark Platform for Reinforcement Learning Based Dynamic Treatment Regime
par: Luo, Zhiyao, et autres
Publié: (2024)
par: Luo, Zhiyao, et autres
Publié: (2024)
Identifying Equivalent Training Dynamics
par: Redman, William T., et autres
Publié: (2023)
par: Redman, William T., et autres
Publié: (2023)
Q-learning as a monotone scheme
par: Yang, Lingyi
Publié: (2024)
par: Yang, Lingyi
Publié: (2024)
Regime-aware financial volatility forecasting via in-context learning
par: Asaad, Saba, et autres
Publié: (2026)
par: Asaad, Saba, et autres
Publié: (2026)
VA-learning as a more efficient alternative to Q-learning
par: Tang, Yunhao, et autres
Publié: (2023)
par: Tang, Yunhao, et autres
Publié: (2023)
Optimistic Q-learning for average reward and episodic reinforcement learning
par: Agrawal, Priyank, et autres
Publié: (2024)
par: Agrawal, Priyank, et autres
Publié: (2024)
Frozen Policy Iteration: Computationally Efficient RL under Linear $Q^π$ Realizability for Deterministic Dynamics
par: Ke, Yijing, et autres
Publié: (2026)
par: Ke, Yijing, et autres
Publié: (2026)
Dynamical Regimes of Diffusion Models
par: Biroli, Giulio, et autres
Publié: (2024)
par: Biroli, Giulio, et autres
Publié: (2024)
Censoring-Aware Tree-Based Reinforcement Learning for Estimating Dynamic Treatment Regimes with Censored Outcomes
par: Paul, Animesh Kumar, et autres
Publié: (2025)
par: Paul, Animesh Kumar, et autres
Publié: (2025)
Doubly-Robust Bayesian Estimation of Optimal Individualized Treatment Rules using Network Meta-Analysis
par: Wigle, Augustine, et autres
Publié: (2026)
par: Wigle, Augustine, et autres
Publié: (2026)
Kernel Renormalization in Bayesian Deep Neural Networks: the Equivalent Wishart Ansatz in the Proportional Regime
par: Baglioni, Paolo, et autres
Publié: (2026)
par: Baglioni, Paolo, et autres
Publié: (2026)
Aligning Flow Map Policies with Optimal Q-Guidance
par: Ziakas, Christos, et autres
Publié: (2026)
par: Ziakas, Christos, et autres
Publié: (2026)
Gap-Dependent Bounds for Federated $Q$-learning
par: Zhang, Haochen, et autres
Publié: (2025)
par: Zhang, Haochen, et autres
Publié: (2025)
Gaussian Approximation for Asynchronous Q-learning
par: Rubtsov, Artemy, et autres
Publié: (2026)
par: Rubtsov, Artemy, et autres
Publié: (2026)
Deep Double Q-learning
par: Nagarajan, Prabhat, et autres
Publié: (2025)
par: Nagarajan, Prabhat, et autres
Publié: (2025)
An Equivalence Between Static and Dynamic Regret Minimization
par: Jacobsen, Andrew, et autres
Publié: (2024)
par: Jacobsen, Andrew, et autres
Publié: (2024)
Estimation of Optimal Dynamic Treatment Assignment Rules under Policy Constraints
par: Sakaguchi, Shosei
Publié: (2021)
par: Sakaguchi, Shosei
Publié: (2021)
Documents similaires
-
Medical Knowledge Integration into Reinforcement Learning Algorithms for Dynamic Treatment Regimes
par: Yazzourh, Sophia, et autres
Publié: (2024) -
Information Borrowing from Partially Compatible Trajectories for Estimation of Dynamic Treatment Regimes
par: Si, Chloe, et autres
Publié: (2025) -
Policy Learning for Optimal Dynamic Treatment Regimes with Observational Data
par: Sakaguchi, Shosei
Publié: (2024) -
Kernel-Based Distributed Q-Learning: A Scalable Reinforcement Learning Approach for Dynamic Treatment Regimes
par: Wang, Di, et autres
Publié: (2023) -
POLAR: A Pessimistic Model-based Policy Learning Algorithm for Dynamic Treatment Regimes
par: Zhang, Ruijia, et autres
Publié: (2025)