RIE-Greedy: Regularization-Induced Exploration for Contextual Bandits
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Tong, Casanova, Thiago de Queiroz, Schwartz, Eric M., Kostyuk, Victor, Kong, Dehan, Williams, Joseph J. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sharp Analysis for KL-Regularized Contextual Bandits and RLHF
par: Zhao, Heyang, et autres
Publié: (2024)
par: Zhao, Heyang, et autres
Publié: (2024)
Neural Exploitation and Exploration of Contextual Bandits
par: Ban, Yikun, et autres
Publié: (2023)
par: Ban, Yikun, et autres
Publié: (2023)
Local Anti-Concentration Class: Logarithmic Regret for Greedy Linear Contextual Bandit
par: Kim, Seok-Jin, et autres
Publié: (2024)
par: Kim, Seok-Jin, et autres
Publié: (2024)
Exploration via Feature Perturbation in Contextual Bandits
par: Yi, Seouh-won, et autres
Publié: (2025)
par: Yi, Seouh-won, et autres
Publié: (2025)
Algorithms for Adaptive Experiments that Trade-off Statistical Analysis with Reward: Combining Uniform Random Assignment and Reward Maximization
par: Li, Tong, et autres
Publié: (2021)
par: Li, Tong, et autres
Publié: (2021)
Exploiting Concavity Information in Gaussian Process Contextual Bandit Optimization
par: Li, Kevin, et autres
Publié: (2025)
par: Li, Kevin, et autres
Publié: (2025)
A Statistically Reliable Optimization Framework for Bandit Experiments in Scientific Discovery
par: Li, Tong, et autres
Publié: (2026)
par: Li, Tong, et autres
Publié: (2026)
HD-CB: The First Exploration of Hyperdimensional Computing for Contextual Bandits Problems
par: Angioli, Marco, et autres
Publié: (2025)
par: Angioli, Marco, et autres
Publié: (2025)
Optimization of Epsilon-Greedy Exploration
par: Che, Ethan, et autres
Publié: (2025)
par: Che, Ethan, et autres
Publié: (2025)
Catoni Contextual Bandits are Robust to Heavy-tailed Rewards
par: Ye, Chenlu, et autres
Publié: (2025)
par: Ye, Chenlu, et autres
Publié: (2025)
Observation-Augmented Contextual Multi-Armed Bandits for Robotic Search and Exploration
par: Wakayama, Shohei, et autres
Publié: (2023)
par: Wakayama, Shohei, et autres
Publié: (2023)
Towards a Sharp Analysis of Offline Policy Learning for $f$-Divergence-Regularized Contextual Bandits
par: Zhao, Qingyue, et autres
Publié: (2025)
par: Zhao, Qingyue, et autres
Publié: (2025)
Contextual Bandits in Payment Processing: Non-uniform Exploration and Supervised Learning
par: Vangara, Akhila, et autres
Publié: (2024)
par: Vangara, Akhila, et autres
Publié: (2024)
Annealed Softmax Greedy in Many-Armed Bayesian Bandits
par: Overman, William, et autres
Publié: (2026)
par: Overman, William, et autres
Publié: (2026)
Contextual Bandits for Unbounded Context Distributions
par: Zhao, Puning, et autres
Publié: (2024)
par: Zhao, Puning, et autres
Publié: (2024)
Sparse Nonparametric Contextual Bandits
par: Flynn, Hamish, et autres
Publié: (2025)
par: Flynn, Hamish, et autres
Publié: (2025)
The Unreasonable Effectiveness of Greedy Algorithms in Multi-Armed Bandit with Many Arms
par: Bayati, Mohsen, et autres
Publié: (2020)
par: Bayati, Mohsen, et autres
Publié: (2020)
PAC Off-Policy Prediction of Contextual Bandits
par: Wan, Yilong, et autres
Publié: (2025)
par: Wan, Yilong, et autres
Publié: (2025)
Active Learning for Stochastic Contextual Linear Bandits
par: Brunskill, Emma, et autres
Publié: (2026)
par: Brunskill, Emma, et autres
Publié: (2026)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
par: Goyal, Tanmay, et autres
Publié: (2025)
par: Goyal, Tanmay, et autres
Publié: (2025)
Single Index Bandits: Generalized Linear Contextual Bandits with Unknown Reward Functions
par: Kang, Yue, et autres
Publié: (2025)
par: Kang, Yue, et autres
Publié: (2025)
Linear Contextual Bandits with Interference
par: Xu, Yang, et autres
Publié: (2024)
par: Xu, Yang, et autres
Publié: (2024)
Corruption-Robust Algorithms with Uncertainty Weighting for Nonlinear Contextual Bandits and Markov Decision Processes
par: Ye, Chenlu, et autres
Publié: (2022)
par: Ye, Chenlu, et autres
Publié: (2022)
Episodic Contextual Bandits with Knapsacks under Conversion Models
par: Cheung, Wang Chi, et autres
Publié: (2025)
par: Cheung, Wang Chi, et autres
Publié: (2025)
Uncertainty of Joint Neural Contextual Bandit
par: Guo, Hongbo, et autres
Publié: (2024)
par: Guo, Hongbo, et autres
Publié: (2024)
Contextual Linear Bandits with Delay as Payoff
par: Zhang, Mengxiao, et autres
Publié: (2025)
par: Zhang, Mengxiao, et autres
Publié: (2025)
Group-Sensitive Offline Contextual Bandits
par: Guo, Yihong, et autres
Publié: (2025)
par: Guo, Yihong, et autres
Publié: (2025)
Multiplayer Information Asymmetric Contextual Bandits
par: Chang, William, et autres
Publié: (2025)
par: Chang, William, et autres
Publié: (2025)
Differentially Private Kernelized Contextual Bandits
par: Pavlovic, Nikola, et autres
Publié: (2025)
par: Pavlovic, Nikola, et autres
Publié: (2025)
Contextual Bandits with Stage-wise Constraints
par: Pacchiano, Aldo, et autres
Publié: (2024)
par: Pacchiano, Aldo, et autres
Publié: (2024)
Constrained Contextual Bandits with Adversarial Contexts
par: Sarkar, Dhruv, et autres
Publié: (2026)
par: Sarkar, Dhruv, et autres
Publié: (2026)
Designing an Interpretable Interface for Contextual Bandits
par: Maher, Andrew, et autres
Publié: (2024)
par: Maher, Andrew, et autres
Publié: (2024)
RIE-SenseNet: Riemannian Manifold Embedding of Multi-Source Industrial Sensor Signals for Robust Pattern Recognition
par: Wang, Xu, et autres
Publié: (2025)
par: Wang, Xu, et autres
Publié: (2025)
Pessimistic Risk-Aware Policy Learning in Contextual Bandits
par: Wan, Yilong, et autres
Publié: (2026)
par: Wan, Yilong, et autres
Publié: (2026)
Inverse Contextual Bandits without Rewards: Learning from a Non-Stationary Learner via Suffix Imitation
par: Kong, Yuqi, et autres
Publié: (2026)
par: Kong, Yuqi, et autres
Publié: (2026)
Pure Exploration in Asynchronous Federated Bandits
par: Wang, Zichen, et autres
Publié: (2023)
par: Wang, Zichen, et autres
Publié: (2023)
Efficient Best-of-Both-Worlds Algorithms for Contextual Combinatorial Semi-Bandits
par: Li, Mengmeng, et autres
Publié: (2025)
par: Li, Mengmeng, et autres
Publié: (2025)
Online Multi-LLM Selection via Contextual Bandits under Unstructured Context Evolution
par: Poon, Manhin, et autres
Publié: (2025)
par: Poon, Manhin, et autres
Publié: (2025)
Calibrated Recommendations with Contextual Bandits
par: Feijer, Diego, et autres
Publié: (2025)
par: Feijer, Diego, et autres
Publié: (2025)
Batched Nonparametric Contextual Bandits
par: Jiang, Rong, et autres
Publié: (2024)
par: Jiang, Rong, et autres
Publié: (2024)
Documents similaires
-
Sharp Analysis for KL-Regularized Contextual Bandits and RLHF
par: Zhao, Heyang, et autres
Publié: (2024) -
Neural Exploitation and Exploration of Contextual Bandits
par: Ban, Yikun, et autres
Publié: (2023) -
Local Anti-Concentration Class: Logarithmic Regret for Greedy Linear Contextual Bandit
par: Kim, Seok-Jin, et autres
Publié: (2024) -
Exploration via Feature Perturbation in Contextual Bandits
par: Yi, Seouh-won, et autres
Publié: (2025) -
Algorithms for Adaptive Experiments that Trade-off Statistical Analysis with Reward: Combining Uniform Random Assignment and Reward Maximization
par: Li, Tong, et autres
Publié: (2021)