Off-Policy Evaluation in Markov Decision Processes under Weak Distributional Overlap
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mehrabi, Mohammad, Wager, Stefan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Conformal Off-Policy Evaluation in Markov Decision Processes
par: Foffano, Daniele, et autres
Publié: (2023)
par: Foffano, Daniele, et autres
Publié: (2023)
Efficient and Sharp Off-Policy Evaluation in Robust Markov Decision Processes
par: Bennett, Andrew, et autres
Publié: (2024)
par: Bennett, Andrew, et autres
Publié: (2024)
Policy Learning with Competing Agents
par: Sahoo, Roshni, et autres
Publié: (2022)
par: Sahoo, Roshni, et autres
Publié: (2022)
Policy Testing in Markov Decision Processes
par: Ariu, Kaito, et autres
Publié: (2025)
par: Ariu, Kaito, et autres
Publié: (2025)
Fair Resource Allocation in Weakly Coupled Markov Decision Processes
par: Tu, Xiaohui, et autres
Publié: (2024)
par: Tu, Xiaohui, et autres
Publié: (2024)
Distributional Off-Policy Evaluation with Deep Quantile Process Regression
par: Kuang, Qi, et autres
Publié: (2026)
par: Kuang, Qi, et autres
Publié: (2026)
Weakly Time-Coupled Approximation of Markov Decision Processes
par: Soheili, Negar, et autres
Publié: (2026)
par: Soheili, Negar, et autres
Publié: (2026)
Optimal Decision Tree Policies for Markov Decision Processes
par: Vos, Daniël, et autres
Publié: (2023)
par: Vos, Daniël, et autres
Publié: (2023)
Policy Regularized Distributionally Robust Markov Decision Processes with Linear Function Approximation
par: Gu, Jingwen, et autres
Publié: (2025)
par: Gu, Jingwen, et autres
Publié: (2025)
Learning Deterministic Policies with Policy Gradients in Constrained Markov Decision Processes
par: Montenegro, Alessandro, et autres
Publié: (2025)
par: Montenegro, Alessandro, et autres
Publié: (2025)
Policy Gradient for Robust Markov Decision Processes
par: Wang, Qiuhao, et autres
Publié: (2024)
par: Wang, Qiuhao, et autres
Publié: (2024)
Initial Distribution Sensitivity of Constrained Markov Decision Processes
par: Tercan, Alperen, et autres
Publié: (2025)
par: Tercan, Alperen, et autres
Publié: (2025)
Markov Decision Processes under External Temporal Processes
par: Ayyagari, Ranga Shaarad, et autres
Publié: (2023)
par: Ayyagari, Ranga Shaarad, et autres
Publié: (2023)
Rate-Optimal Policy Optimization for Linear Markov Decision Processes
par: Sherman, Uri, et autres
Publié: (2023)
par: Sherman, Uri, et autres
Publié: (2023)
Off-Policy Evaluation for Ranking Policies under Deterministic Logging Policies
par: Tanaka, Koichi, et autres
Publié: (2026)
par: Tanaka, Koichi, et autres
Publié: (2026)
Learning Markov Decision Processes under Fully Bandit Feedback
par: Zhuo, Zhengjia, et autres
Publié: (2026)
par: Zhuo, Zhengjia, et autres
Publié: (2026)
Optimistic Actor-Critic with Parametric Policies for Linear Markov Decision Processes
par: Lin, Max Qiushi, et autres
Publié: (2026)
par: Lin, Max Qiushi, et autres
Publié: (2026)
Optimal Posterior Sampling for Policy Identification in Tabular Markov Decision Processes
par: Kone, Cyrille, et autres
Publié: (2026)
par: Kone, Cyrille, et autres
Publié: (2026)
An Orthogonal Learner for Individualized Outcomes in Markov Decision Processes
par: Javurek, Emil, et autres
Publié: (2025)
par: Javurek, Emil, et autres
Publié: (2025)
Flipping-based Policy for Chance-Constrained Markov Decision Processes
par: Shen, Xun, et autres
Publié: (2024)
par: Shen, Xun, et autres
Publié: (2024)
SPOT: Scalable Policy Optimization with Trees for Markov Decision Processes
par: Xiong, Xuyuan, et autres
Publié: (2025)
par: Xiong, Xuyuan, et autres
Publié: (2025)
On Convergence of Average-Reward Q-Learning in Weakly Communicating Markov Decision Processes
par: Wan, Yi, et autres
Publié: (2024)
par: Wan, Yi, et autres
Publié: (2024)
Monitored Markov Decision Processes
par: Parisi, Simone, et autres
Publié: (2024)
par: Parisi, Simone, et autres
Publié: (2024)
Linear Mixture Distributionally Robust Markov Decision Processes
par: Liu, Zhishuai, et autres
Publié: (2025)
par: Liu, Zhishuai, et autres
Publié: (2025)
Efficient and Sharp Off-Policy Learning under Unobserved Confounding
par: Hess, Konstantin, et autres
Publié: (2025)
par: Hess, Konstantin, et autres
Publié: (2025)
On the Global Convergence of Policy Gradient in Average Reward Markov Decision Processes
par: Kumar, Navdeep, et autres
Publié: (2024)
par: Kumar, Navdeep, et autres
Publié: (2024)
Warm-up Free Policy Optimization: Improved Regret in Linear Markov Decision Processes
par: Cassel, Asaf, et autres
Publié: (2024)
par: Cassel, Asaf, et autres
Publié: (2024)
Federated Control in Markov Decision Processes
par: Jin, Hao, et autres
Publié: (2024)
par: Jin, Hao, et autres
Publié: (2024)
Generalized Linear Markov Decision Process
par: Zhang, Sinian, et autres
Publié: (2025)
par: Zhang, Sinian, et autres
Publié: (2025)
Mirror Descent Policy Optimisation for Robust Constrained Markov Decision Processes
par: Bossens, David M., et autres
Publié: (2025)
par: Bossens, David M., et autres
Publié: (2025)
Sample Complexity of Offline Distributionally Robust Linear Markov Decision Processes
par: Wang, He, et autres
Publié: (2024)
par: Wang, He, et autres
Publié: (2024)
Multi-Timescale Ensemble Q-learning for Markov Decision Process Policy Optimization
par: Bozkus, Talha, et autres
Publié: (2024)
par: Bozkus, Talha, et autres
Publié: (2024)
Off-Policy Evaluation and Learning for the Future under Non-Stationarity
par: Shimizu, Tatsuhiro, et autres
Publié: (2025)
par: Shimizu, Tatsuhiro, et autres
Publié: (2025)
Learning in Markov Decision Processes with Exogenous Dynamics
par: Maran, Davide, et autres
Publié: (2026)
par: Maran, Davide, et autres
Publié: (2026)
Risk-sensitive Markov Decision Process and Learning under General Utility Functions
par: Wu, Zhengqi, et autres
Publié: (2023)
par: Wu, Zhengqi, et autres
Publié: (2023)
Policy Gradient Algorithms with Monte Carlo Tree Learning for Non-Markov Decision Processes
par: Morimura, Tetsuro, et autres
Publié: (2022)
par: Morimura, Tetsuro, et autres
Publié: (2022)
Bayesian Learning of Optimal Policies in Markov Decision Processes with Countably Infinite State-Space
par: Adler, Saghar, et autres
Publié: (2023)
par: Adler, Saghar, et autres
Publié: (2023)
Uncertainty Quantification and Causal Considerations for Off-Policy Decision Making
par: Taufiq, Muhammad Faaiz
Publié: (2025)
par: Taufiq, Muhammad Faaiz
Publié: (2025)
Cross-Validated Off-Policy Evaluation
par: Cief, Matej, et autres
Publié: (2024)
par: Cief, Matej, et autres
Publié: (2024)
Off-Policy Evaluation and Learning for Survival Outcomes under Censoring
par: Kubota, Kohsuke, et autres
Publié: (2026)
par: Kubota, Kohsuke, et autres
Publié: (2026)
Documents similaires
-
Conformal Off-Policy Evaluation in Markov Decision Processes
par: Foffano, Daniele, et autres
Publié: (2023) -
Efficient and Sharp Off-Policy Evaluation in Robust Markov Decision Processes
par: Bennett, Andrew, et autres
Publié: (2024) -
Policy Learning with Competing Agents
par: Sahoo, Roshni, et autres
Publié: (2022) -
Policy Testing in Markov Decision Processes
par: Ariu, Kaito, et autres
Publié: (2025) -
Fair Resource Allocation in Weakly Coupled Markov Decision Processes
par: Tu, Xiaohui, et autres
Publié: (2024)