Exploiting Concavity Information in Gaussian Process Contextual Bandit Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Kevin, Laber, Eric |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Empirical Bound Information-Directed Sampling for Norm-Agnostic Bandits
di: Suder, Piotr M., et al.
Pubblicazione: (2025)
di: Suder, Piotr M., et al.
Pubblicazione: (2025)
Vector Optimization with Gaussian Process Bandits
di: Korkmaz, İlter Onat, et al.
Pubblicazione: (2024)
di: Korkmaz, İlter Onat, et al.
Pubblicazione: (2024)
Implicit Q-Learning and SARSA: Liberating Policy Control from Step-Size Calibration
di: Kim, Hwanwoo, et al.
Pubblicazione: (2026)
di: Kim, Hwanwoo, et al.
Pubblicazione: (2026)
Contextual Combinatorial Bandits with Changing Action Sets via Gaussian Processes
di: Nika, Andi, et al.
Pubblicazione: (2021)
di: Nika, Andi, et al.
Pubblicazione: (2021)
Multiplayer Information Asymmetric Contextual Bandits
di: Chang, William, et al.
Pubblicazione: (2025)
di: Chang, William, et al.
Pubblicazione: (2025)
Optimal Regret for Policy Optimization in Contextual Bandits
di: Levy, Orin, et al.
Pubblicazione: (2026)
di: Levy, Orin, et al.
Pubblicazione: (2026)
Contextual Bandits with Budgeted Information Reveal
di: Gan, Kyra, et al.
Pubblicazione: (2023)
di: Gan, Kyra, et al.
Pubblicazione: (2023)
Contextual Bandit Optimization with Pre-Trained Neural Networks
di: Terekhov, Mikhail
Pubblicazione: (2025)
di: Terekhov, Mikhail
Pubblicazione: (2025)
Generalized Low-Rank Matrix Contextual Bandits with Graph Information
di: Wang, Yao, et al.
Pubblicazione: (2025)
di: Wang, Yao, et al.
Pubblicazione: (2025)
RIE-Greedy: Regularization-Induced Exploration for Contextual Bandits
di: Li, Tong, et al.
Pubblicazione: (2026)
di: Li, Tong, et al.
Pubblicazione: (2026)
Gaussian Process Bandit Optimization with Machine Learning Predictions and Application to Hypothesis Generation
di: Chen, Xin Jennifer, et al.
Pubblicazione: (2026)
di: Chen, Xin Jennifer, et al.
Pubblicazione: (2026)
Leveraging Offline Data in Linear Latent Contextual Bandits
di: Kausik, Chinmaya, et al.
Pubblicazione: (2024)
di: Kausik, Chinmaya, et al.
Pubblicazione: (2024)
Contextual Bandits for Resource-Constrained Devices using Probabilistic Learning
di: Angioli, Marco, et al.
Pubblicazione: (2026)
di: Angioli, Marco, et al.
Pubblicazione: (2026)
Online Continuous Hyperparameter Optimization for Generalized Linear Contextual Bandits
di: Kang, Yue, et al.
Pubblicazione: (2023)
di: Kang, Yue, et al.
Pubblicazione: (2023)
Scalable Policy Maximization Under Network Interference
di: Gleich, Aidan, et al.
Pubblicazione: (2025)
di: Gleich, Aidan, et al.
Pubblicazione: (2025)
Adaptive Policy Learning Under Unknown Network Interference
di: Gleich, Aidan, et al.
Pubblicazione: (2026)
di: Gleich, Aidan, et al.
Pubblicazione: (2026)
Regret Bounds for Expected Improvement Algorithms in Gaussian Process Bandit Optimization
di: Tran-The, Hung, et al.
Pubblicazione: (2022)
di: Tran-The, Hung, et al.
Pubblicazione: (2022)
Contextual Bandits for Unbounded Context Distributions
di: Zhao, Puning, et al.
Pubblicazione: (2024)
di: Zhao, Puning, et al.
Pubblicazione: (2024)
Sparse Nonparametric Contextual Bandits
di: Flynn, Hamish, et al.
Pubblicazione: (2025)
di: Flynn, Hamish, et al.
Pubblicazione: (2025)
Optimization of Inter-group Criteria for Clustering with Minimum Size Constraints
di: Laber, Eduardo S., et al.
Pubblicazione: (2024)
di: Laber, Eduardo S., et al.
Pubblicazione: (2024)
PAC Off-Policy Prediction of Contextual Bandits
di: Wan, Yilong, et al.
Pubblicazione: (2025)
di: Wan, Yilong, et al.
Pubblicazione: (2025)
Active Learning for Stochastic Contextual Linear Bandits
di: Brunskill, Emma, et al.
Pubblicazione: (2026)
di: Brunskill, Emma, et al.
Pubblicazione: (2026)
Stabilizing Temporal Difference Learning via Implicit Stochastic Recursion
di: Kim, Hwanwoo, et al.
Pubblicazione: (2025)
di: Kim, Hwanwoo, et al.
Pubblicazione: (2025)
Time-Varying Gaussian Process Bandits with Unknown Prior
di: Ziomek, Juliusz, et al.
Pubblicazione: (2024)
di: Ziomek, Juliusz, et al.
Pubblicazione: (2024)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)
Single Index Bandits: Generalized Linear Contextual Bandits with Unknown Reward Functions
di: Kang, Yue, et al.
Pubblicazione: (2025)
di: Kang, Yue, et al.
Pubblicazione: (2025)
Linear Contextual Bandits with Interference
di: Xu, Yang, et al.
Pubblicazione: (2024)
di: Xu, Yang, et al.
Pubblicazione: (2024)
Implicit Updates for Average-Reward Temporal Difference Learning
di: Kim, Hwanwoo, et al.
Pubblicazione: (2025)
di: Kim, Hwanwoo, et al.
Pubblicazione: (2025)
Episodic Contextual Bandits with Knapsacks under Conversion Models
di: Cheung, Wang Chi, et al.
Pubblicazione: (2025)
di: Cheung, Wang Chi, et al.
Pubblicazione: (2025)
Bayesian Analysis of Combinatorial Gaussian Process Bandits
di: Sandberg, Jack, et al.
Pubblicazione: (2023)
di: Sandberg, Jack, et al.
Pubblicazione: (2023)
Contextual Linear Bandits with Delay as Payoff
di: Zhang, Mengxiao, et al.
Pubblicazione: (2025)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2025)
Group-Sensitive Offline Contextual Bandits
di: Guo, Yihong, et al.
Pubblicazione: (2025)
di: Guo, Yihong, et al.
Pubblicazione: (2025)
Differentially Private Kernelized Contextual Bandits
di: Pavlovic, Nikola, et al.
Pubblicazione: (2025)
di: Pavlovic, Nikola, et al.
Pubblicazione: (2025)
Neural Exploitation and Exploration of Contextual Bandits
di: Ban, Yikun, et al.
Pubblicazione: (2023)
di: Ban, Yikun, et al.
Pubblicazione: (2023)
Uncertainty of Joint Neural Contextual Bandit
di: Guo, Hongbo, et al.
Pubblicazione: (2024)
di: Guo, Hongbo, et al.
Pubblicazione: (2024)
Contextual Bandits with Stage-wise Constraints
di: Pacchiano, Aldo, et al.
Pubblicazione: (2024)
di: Pacchiano, Aldo, et al.
Pubblicazione: (2024)
Constrained Contextual Bandits with Adversarial Contexts
di: Sarkar, Dhruv, et al.
Pubblicazione: (2026)
di: Sarkar, Dhruv, et al.
Pubblicazione: (2026)
Designing an Interpretable Interface for Contextual Bandits
di: Maher, Andrew, et al.
Pubblicazione: (2024)
di: Maher, Andrew, et al.
Pubblicazione: (2024)
Pessimistic Risk-Aware Policy Learning in Contextual Bandits
di: Wan, Yilong, et al.
Pubblicazione: (2026)
di: Wan, Yilong, et al.
Pubblicazione: (2026)
Contextual Bandits in Payment Processing: Non-uniform Exploration and Supervised Learning
di: Vangara, Akhila, et al.
Pubblicazione: (2024)
di: Vangara, Akhila, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Empirical Bound Information-Directed Sampling for Norm-Agnostic Bandits
di: Suder, Piotr M., et al.
Pubblicazione: (2025) -
Vector Optimization with Gaussian Process Bandits
di: Korkmaz, İlter Onat, et al.
Pubblicazione: (2024) -
Implicit Q-Learning and SARSA: Liberating Policy Control from Step-Size Calibration
di: Kim, Hwanwoo, et al.
Pubblicazione: (2026) -
Contextual Combinatorial Bandits with Changing Action Sets via Gaussian Processes
di: Nika, Andi, et al.
Pubblicazione: (2021) -
Multiplayer Information Asymmetric Contextual Bandits
di: Chang, William, et al.
Pubblicazione: (2025)