Distributional Offline Policy Evaluation with Predictive Error Guarantees
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Runzhe, Uehara, Masatoshi, Sun, Wen |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Functional Graphical Models: Structure Enables Offline Data-Driven Optimization
par: Kuba, Jakub Grudzien, et autres
Publié: (2024)
par: Kuba, Jakub Grudzien, et autres
Publié: (2024)
Making RL with Preference-based Feedback Efficient via Randomization
par: Wu, Runzhe, et autres
Publié: (2023)
par: Wu, Runzhe, et autres
Publié: (2023)
Distorted Distributional Policy Evaluation for Offline Reinforcement Learning
par: Iwaki, Ryo, et autres
Publié: (2026)
par: Iwaki, Ryo, et autres
Publié: (2026)
Provable Reward-Agnostic Preference-Based Reinforcement Learning
par: Zhan, Wenhao, et autres
Publié: (2023)
par: Zhan, Wenhao, et autres
Publié: (2023)
Classification with Reject Option: Distribution-free Error Guarantees via Conformal Prediction
par: Szabadváry, Johan Hallberg, et autres
Publié: (2025)
par: Szabadváry, Johan Hallberg, et autres
Publié: (2025)
Robust Offline Reinforcement learning with Heavy-Tailed Rewards
par: Zhu, Jin, et autres
Publié: (2023)
par: Zhu, Jin, et autres
Publié: (2023)
Computationally Efficient RL under Linear Bellman Completeness for Deterministic Dynamics
par: Wu, Runzhe, et autres
Publié: (2024)
par: Wu, Runzhe, et autres
Publié: (2024)
Diffusing States and Matching Scores: A New Framework for Imitation Learning
par: Wu, Runzhe, et autres
Publié: (2024)
par: Wu, Runzhe, et autres
Publié: (2024)
Statistical Guarantees for Offline Domain Randomization
par: Fickinger, Arnaud, et autres
Publié: (2025)
par: Fickinger, Arnaud, et autres
Publié: (2025)
Efficient Policy Evaluation with Offline Data Informed Behavior Policy Design
par: Liu, Shuze, et autres
Publié: (2023)
par: Liu, Shuze, et autres
Publié: (2023)
Mildly Constrained Evaluation Policy for Offline Reinforcement Learning
par: Xu, Linjie, et autres
Publié: (2023)
par: Xu, Linjie, et autres
Publié: (2023)
Algorithmic Guarantees for Distilling Supervised and Offline RL Datasets
par: Gupta, Aaryan, et autres
Publié: (2025)
par: Gupta, Aaryan, et autres
Publié: (2025)
Coverage-Guaranteed Prediction Sets for Out-of-Distribution Data
par: Zou, Xin, et autres
Publié: (2024)
par: Zou, Xin, et autres
Publié: (2024)
Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review
par: Uehara, Masatoshi, et autres
Publié: (2024)
par: Uehara, Masatoshi, et autres
Publié: (2024)
Evaluation-Time Policy Switching for Offline Reinforcement Learning
par: Neggatu, Natinael Solomon, et autres
Publié: (2025)
par: Neggatu, Natinael Solomon, et autres
Publié: (2025)
Conformal Prediction Beyond the Horizon: Distribution-Free Inference for Policy Evaluation
par: Gan, Feichen, et autres
Publié: (2025)
par: Gan, Feichen, et autres
Publié: (2025)
Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data
par: Madhow, Sunil, et autres
Publié: (2023)
par: Madhow, Sunil, et autres
Publié: (2023)
Offline Reinforcement Learning in Large State Spaces: Algorithms and Guarantees
par: Jiang, Nan, et autres
Publié: (2025)
par: Jiang, Nan, et autres
Publié: (2025)
Regularized DeepIV with Model Selection
par: Li, Zihao, et autres
Publié: (2024)
par: Li, Zihao, et autres
Publié: (2024)
Calibrated Inference for the Conditional Average Treatment Effect in the Few-Placebo Regime via Gaussian Processes
par: Uehara, Eichi
Publié: (2026)
par: Uehara, Eichi
Publié: (2026)
Stop Suppressing the Tail: Causal Inference for Extreme Events
par: Uehara, Eichi
Publié: (2026)
par: Uehara, Eichi
Publié: (2026)
Efficient Evaluation of LLM Performance with Statistical Guarantees
par: Wu, Skyler, et autres
Publié: (2026)
par: Wu, Skyler, et autres
Publié: (2026)
Fat-to-Thin Policy Optimization: Offline RL with Sparse Policies
par: Zhu, Lingwei, et autres
Publié: (2025)
par: Zhu, Lingwei, et autres
Publié: (2025)
Efficient Federated Conformal Prediction with Group-Conditional Guarantees
par: Wen, Haifeng, et autres
Publié: (2026)
par: Wen, Haifeng, et autres
Publié: (2026)
Enhancing Generative Auto-bidding with Offline Reward Evaluation and Policy Search
par: Mou, Zhiyu, et autres
Publié: (2025)
par: Mou, Zhiyu, et autres
Publié: (2025)
Frequentist Guarantees of Distributed (Non)-Bayesian Inference
par: Wu, Bohan, et autres
Publié: (2023)
par: Wu, Bohan, et autres
Publié: (2023)
Model-Based Offline Reinforcement Learning with Reliability-Guaranteed Sequence Modeling
par: He, Shenghong
Publié: (2025)
par: He, Shenghong
Publié: (2025)
Policy-regularized Offline Multi-objective Reinforcement Learning
par: Lin, Qian, et autres
Publié: (2024)
par: Lin, Qian, et autres
Publié: (2024)
Cross-Domain Offline Policy Adaptation via Selective Transition Correction
par: Yan, Mengbei, et autres
Publié: (2026)
par: Yan, Mengbei, et autres
Publié: (2026)
Online Policy Learning from Offline Preferences
par: Zhang, Guoxi, et autres
Publié: (2024)
par: Zhang, Guoxi, et autres
Publié: (2024)
Towards Establishing Guaranteed Error for Learned Database Operations
par: Zeighami, Sepanta, et autres
Publié: (2024)
par: Zeighami, Sepanta, et autres
Publié: (2024)
OPERA: Automatic Offline Policy Evaluation with Re-weighted Aggregates of Multiple Estimators
par: Nie, Allen, et autres
Publié: (2024)
par: Nie, Allen, et autres
Publié: (2024)
Policy Constraint by Only Support Constraint for Offline Reinforcement Learning
par: Gao, Yunkai, et autres
Publié: (2025)
par: Gao, Yunkai, et autres
Publié: (2025)
Theoretically Guaranteed Distribution Adaptable Learning
par: Xu, Chao, et autres
Publié: (2024)
par: Xu, Chao, et autres
Publié: (2024)
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning
par: Ada, Suzan Ece, et autres
Publié: (2023)
par: Ada, Suzan Ece, et autres
Publié: (2023)
Optimistic Model Rollouts for Pessimistic Offline Policy Optimization
par: Zhai, Yuanzhao, et autres
Publié: (2024)
par: Zhai, Yuanzhao, et autres
Publié: (2024)
Active Reinforcement Learning Strategies for Offline Policy Improvement
par: Dukkipati, Ambedkar, et autres
Publié: (2024)
par: Dukkipati, Ambedkar, et autres
Publié: (2024)
Hypercube Policy Regularization Framework for Offline Reinforcement Learning
par: Shen, Yi, et autres
Publié: (2024)
par: Shen, Yi, et autres
Publié: (2024)
Adaptive Scaling of Policy Constraints for Offline Reinforcement Learning
par: Jing, Tan, et autres
Publié: (2025)
par: Jing, Tan, et autres
Publié: (2025)
Hierarchical Subspaces of Policies for Continual Offline Reinforcement Learning
par: Kobanda, Anthony, et autres
Publié: (2024)
par: Kobanda, Anthony, et autres
Publié: (2024)
Documents similaires
-
Functional Graphical Models: Structure Enables Offline Data-Driven Optimization
par: Kuba, Jakub Grudzien, et autres
Publié: (2024) -
Making RL with Preference-based Feedback Efficient via Randomization
par: Wu, Runzhe, et autres
Publié: (2023) -
Distorted Distributional Policy Evaluation for Offline Reinforcement Learning
par: Iwaki, Ryo, et autres
Publié: (2026) -
Provable Reward-Agnostic Preference-Based Reinforcement Learning
par: Zhan, Wenhao, et autres
Publié: (2023) -
Classification with Reject Option: Distribution-free Error Guarantees via Conformal Prediction
par: Szabadváry, Johan Hallberg, et autres
Publié: (2025)