PAC Off-Policy Prediction of Contextual Bandits
Fuente:
arXiv
Guardado en:
| Autores principales: | Wan, Yilong, Li, Yuqiang, Wu, Xianyi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Pessimistic Risk-Aware Policy Learning in Contextual Bandits
por: Wan, Yilong, et al.
Publicado: (2026)
por: Wan, Yilong, et al.
Publicado: (2026)
Optimal Baseline Corrections for Off-Policy Contextual Bandits
por: Gupta, Shashank, et al.
Publicado: (2024)
por: Gupta, Shashank, et al.
Publicado: (2024)
Context-Action Embedding Learning for Off-Policy Evaluation in Contextual Bandits
por: Chandak, Kushagra, et al.
Publicado: (2025)
por: Chandak, Kushagra, et al.
Publicado: (2025)
Effective Off-Policy Evaluation and Learning in Contextual Combinatorial Bandits
por: Shimizu, Tatsuhiro, et al.
Publicado: (2024)
por: Shimizu, Tatsuhiro, et al.
Publicado: (2024)
Off-Policy Evaluation via Adaptive Weighting with Data from Contextual Bandits
por: Zhan, Ruohan, et al.
Publicado: (2021)
por: Zhan, Ruohan, et al.
Publicado: (2021)
Optimal Regret for Policy Optimization in Contextual Bandits
por: Levy, Orin, et al.
Publicado: (2026)
por: Levy, Orin, et al.
Publicado: (2026)
Improved Model-based Reinforcement Learning with Smooth Kernels
por: Long, Kun, et al.
Publicado: (2026)
por: Long, Kun, et al.
Publicado: (2026)
When is Off-Policy Evaluation (Reward Modeling) Useful in Contextual Bandits? A Data-Centric Perspective
por: Sun, Hao, et al.
Publicado: (2023)
por: Sun, Hao, et al.
Publicado: (2023)
Off-OAB: Off-Policy Policy Gradient Method with Optimal Action-Dependent Baseline
por: Meng, Wenjia, et al.
Publicado: (2024)
por: Meng, Wenjia, et al.
Publicado: (2024)
Off-Policy Evaluation of Slate Bandit Policies via Optimizing Abstraction
por: Kiyohara, Haruka, et al.
Publicado: (2024)
por: Kiyohara, Haruka, et al.
Publicado: (2024)
Refined PAC-Bayes Bounds for Offline Bandits
por: Gouverneur, Amaury, et al.
Publicado: (2025)
por: Gouverneur, Amaury, et al.
Publicado: (2025)
Certified Policy Optimisation for Nested Causal Bandits via PAC-Bayes Risk
por: Woydt, Tim, et al.
Publicado: (2026)
por: Woydt, Tim, et al.
Publicado: (2026)
Wasserstein Distributionally Robust Policy Evaluation and Learning for Contextual Bandits
por: Shen, Yi, et al.
Publicado: (2023)
por: Shen, Yi, et al.
Publicado: (2023)
Bayesian Inference of Contextual Bandit Policies via Empirical Likelihood
por: Ouyang, Jiangrong, et al.
Publicado: (2026)
por: Ouyang, Jiangrong, et al.
Publicado: (2026)
Fast Rates for Bandit PAC Multiclass Classification
por: Erez, Liad, et al.
Publicado: (2024)
por: Erez, Liad, et al.
Publicado: (2024)
Distributionally Robust Policy Evaluation under General Covariate Shift in Contextual Bandits
por: Guo, Yihong, et al.
Publicado: (2024)
por: Guo, Yihong, et al.
Publicado: (2024)
Contextual Bandits for Unbounded Context Distributions
por: Zhao, Puning, et al.
Publicado: (2024)
por: Zhao, Puning, et al.
Publicado: (2024)
PAC-Bayes Meets Online Contextual Optimization
por: Xie, Zhuojun, et al.
Publicado: (2025)
por: Xie, Zhuojun, et al.
Publicado: (2025)
Sparse Nonparametric Contextual Bandits
por: Flynn, Hamish, et al.
Publicado: (2025)
por: Flynn, Hamish, et al.
Publicado: (2025)
Active Learning for Stochastic Contextual Linear Bandits
por: Brunskill, Emma, et al.
Publicado: (2026)
por: Brunskill, Emma, et al.
Publicado: (2026)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
por: Goyal, Tanmay, et al.
Publicado: (2025)
por: Goyal, Tanmay, et al.
Publicado: (2025)
Single Index Bandits: Generalized Linear Contextual Bandits with Unknown Reward Functions
por: Kang, Yue, et al.
Publicado: (2025)
por: Kang, Yue, et al.
Publicado: (2025)
Linear Contextual Bandits with Interference
por: Xu, Yang, et al.
Publicado: (2024)
por: Xu, Yang, et al.
Publicado: (2024)
Episodic Contextual Bandits with Knapsacks under Conversion Models
por: Cheung, Wang Chi, et al.
Publicado: (2025)
por: Cheung, Wang Chi, et al.
Publicado: (2025)
Contextual Linear Bandits with Delay as Payoff
por: Zhang, Mengxiao, et al.
Publicado: (2025)
por: Zhang, Mengxiao, et al.
Publicado: (2025)
Group-Sensitive Offline Contextual Bandits
por: Guo, Yihong, et al.
Publicado: (2025)
por: Guo, Yihong, et al.
Publicado: (2025)
Multiplayer Information Asymmetric Contextual Bandits
por: Chang, William, et al.
Publicado: (2025)
por: Chang, William, et al.
Publicado: (2025)
Differentially Private Kernelized Contextual Bandits
por: Pavlovic, Nikola, et al.
Publicado: (2025)
por: Pavlovic, Nikola, et al.
Publicado: (2025)
Neural Exploitation and Exploration of Contextual Bandits
por: Ban, Yikun, et al.
Publicado: (2023)
por: Ban, Yikun, et al.
Publicado: (2023)
Uncertainty of Joint Neural Contextual Bandit
por: Guo, Hongbo, et al.
Publicado: (2024)
por: Guo, Hongbo, et al.
Publicado: (2024)
Contextual Bandits with Stage-wise Constraints
por: Pacchiano, Aldo, et al.
Publicado: (2024)
por: Pacchiano, Aldo, et al.
Publicado: (2024)
Constrained Contextual Bandits with Adversarial Contexts
por: Sarkar, Dhruv, et al.
Publicado: (2026)
por: Sarkar, Dhruv, et al.
Publicado: (2026)
Designing an Interpretable Interface for Contextual Bandits
por: Maher, Andrew, et al.
Publicado: (2024)
por: Maher, Andrew, et al.
Publicado: (2024)
Calibrated Recommendations with Contextual Bandits
por: Feijer, Diego, et al.
Publicado: (2025)
por: Feijer, Diego, et al.
Publicado: (2025)
Batched Nonparametric Contextual Bandits
por: Jiang, Rong, et al.
Publicado: (2024)
por: Jiang, Rong, et al.
Publicado: (2024)
Tree Ensembles for Contextual Bandits
por: Nilsson, Hannes, et al.
Publicado: (2024)
por: Nilsson, Hannes, et al.
Publicado: (2024)
Exploiting Concavity Information in Gaussian Process Contextual Bandit Optimization
por: Li, Kevin, et al.
Publicado: (2025)
por: Li, Kevin, et al.
Publicado: (2025)
Transfer Learning for Contextual Multi-armed Bandits
por: Cai, Changxiao, et al.
Publicado: (2022)
por: Cai, Changxiao, et al.
Publicado: (2022)
A Contextual Combinatorial Bandit Approach to Negotiation
por: Li, Yexin, et al.
Publicado: (2024)
por: Li, Yexin, et al.
Publicado: (2024)
Federated Linear Contextual Bandits with Heterogeneous Clients
por: Blaser, Ethan, et al.
Publicado: (2024)
por: Blaser, Ethan, et al.
Publicado: (2024)
Ejemplares similares
-
Pessimistic Risk-Aware Policy Learning in Contextual Bandits
por: Wan, Yilong, et al.
Publicado: (2026) -
Optimal Baseline Corrections for Off-Policy Contextual Bandits
por: Gupta, Shashank, et al.
Publicado: (2024) -
Context-Action Embedding Learning for Off-Policy Evaluation in Contextual Bandits
por: Chandak, Kushagra, et al.
Publicado: (2025) -
Effective Off-Policy Evaluation and Learning in Contextual Combinatorial Bandits
por: Shimizu, Tatsuhiro, et al.
Publicado: (2024) -
Off-Policy Evaluation via Adaptive Weighting with Data from Contextual Bandits
por: Zhan, Ruohan, et al.
Publicado: (2021)