Nearly Tight Bounds for Cross-Learning Contextual Bandits with Graphical Feedback
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Huang, Ruiyuan, Huang, Zengfeng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
High Probability Bound for Cross-Learning Contextual Bandits with Unknown Context Distributions
von: Huang, Ruiyuan, et al.
Veröffentlicht: (2024)
von: Huang, Ruiyuan, et al.
Veröffentlicht: (2024)
Few Batches or Little Memory, But Not Both: Simultaneous Space and Adaptivity Constraints in Stochastic Bandits
von: Huang, Ruiyuan, et al.
Veröffentlicht: (2026)
von: Huang, Ruiyuan, et al.
Veröffentlicht: (2026)
Nearly Optimal Algorithms for Contextual Dueling Bandits from Adversarial Feedback
von: Di, Qiwei, et al.
Veröffentlicht: (2024)
von: Di, Qiwei, et al.
Veröffentlicht: (2024)
Regret Bounds for Adversarial Contextual Bandits with General Function Approximation and Delayed Feedback
von: Levy, Orin, et al.
Veröffentlicht: (2025)
von: Levy, Orin, et al.
Veröffentlicht: (2025)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
von: Goyal, Tanmay, et al.
Veröffentlicht: (2025)
von: Goyal, Tanmay, et al.
Veröffentlicht: (2025)
Nearly Tight Bounds for Exploration in Streaming Multi-armed Bandits with Known Optimality Gap
von: Karpov, Nikolai, et al.
Veröffentlicht: (2025)
von: Karpov, Nikolai, et al.
Veröffentlicht: (2025)
Efficient Contextual Bandits with Uninformed Feedback Graphs
von: Zhang, Mengxiao, et al.
Veröffentlicht: (2024)
von: Zhang, Mengxiao, et al.
Veröffentlicht: (2024)
Neural Contextual Bandits Under Delayed Feedback Constraints
von: Moghimi, Mohammadali, et al.
Veröffentlicht: (2025)
von: Moghimi, Mohammadali, et al.
Veröffentlicht: (2025)
Load--Reserve Wasserstein Propagation for Isotropic Diffusion Samplers
von: Lyu, Zicheng, et al.
Veröffentlicht: (2026)
von: Lyu, Zicheng, et al.
Veröffentlicht: (2026)
Queue Length Regret Bounds for Contextual Queueing Bandits
von: Bae, Seoungbin, et al.
Veröffentlicht: (2026)
von: Bae, Seoungbin, et al.
Veröffentlicht: (2026)
Learning-Based User Association for MmWave Vehicular Networks With Kernelized Contextual Bandits
von: He, Xiaoyang, et al.
Veröffentlicht: (2025)
von: He, Xiaoyang, et al.
Veröffentlicht: (2025)
Open Problem: Tight Bounds for Kernelized Multi-Armed Bandits with Bernoulli Rewards
von: Mussi, Marco, et al.
Veröffentlicht: (2024)
von: Mussi, Marco, et al.
Veröffentlicht: (2024)
Nearly Minimax Optimal Submodular Maximization with Bandit Feedback
von: Tajdini, Artin, et al.
Veröffentlicht: (2023)
von: Tajdini, Artin, et al.
Veröffentlicht: (2023)
Active Human Feedback Collection via Neural Contextual Dueling Bandits
von: Verma, Arun, et al.
Veröffentlicht: (2025)
von: Verma, Arun, et al.
Veröffentlicht: (2025)
Information Capacity Regret Bounds for Bandits with Mediator Feedback
von: Eldowa, Khaled, et al.
Veröffentlicht: (2024)
von: Eldowa, Khaled, et al.
Veröffentlicht: (2024)
Variance-Dependent Regret Lower Bounds for Contextual Bandits
von: He, Jiafan, et al.
Veröffentlicht: (2025)
von: He, Jiafan, et al.
Veröffentlicht: (2025)
Second Order Bounds for Contextual Bandits with Function Approximation
von: Pacchiano, Aldo
Veröffentlicht: (2024)
von: Pacchiano, Aldo
Veröffentlicht: (2024)
A Tight Lower Bound for Non-stochastic Multi-armed Bandits with Expert Advice
von: Chase, Zachary, et al.
Veröffentlicht: (2025)
von: Chase, Zachary, et al.
Veröffentlicht: (2025)
Near-Optimal Regret in Linear MDPs with Aggregate Bandit Feedback
von: Cassel, Asaf, et al.
Veröffentlicht: (2024)
von: Cassel, Asaf, et al.
Veröffentlicht: (2024)
Variance-Aware Regret Bounds for Stochastic Contextual Dueling Bandits
von: Di, Qiwei, et al.
Veröffentlicht: (2023)
von: Di, Qiwei, et al.
Veröffentlicht: (2023)
Near-optimal Per-Action Regret Bounds for Sleeping Bandits
von: Nguyen, Quan, et al.
Veröffentlicht: (2024)
von: Nguyen, Quan, et al.
Veröffentlicht: (2024)
Your Graph Recommender is Provably a Single-view Graph Contrastive Learning
von: Yang, Wenjie, et al.
Veröffentlicht: (2024)
von: Yang, Wenjie, et al.
Veröffentlicht: (2024)
Active Learning for Stochastic Contextual Linear Bandits
von: Brunskill, Emma, et al.
Veröffentlicht: (2026)
von: Brunskill, Emma, et al.
Veröffentlicht: (2026)
Improved Offline Contextual Bandits with Second-Order Bounds: Betting and Freezing
von: Ryu, J. Jon, et al.
Veröffentlicht: (2025)
von: Ryu, J. Jon, et al.
Veröffentlicht: (2025)
Learning When to Trust in Contextual Bandits
von: Ghasemi, Majid, et al.
Veröffentlicht: (2026)
von: Ghasemi, Majid, et al.
Veröffentlicht: (2026)
Optimizing Warfarin Dosing Using Contextual Bandit: An Offline Policy Learning and Evaluation Method
von: Huang, Yong, et al.
Veröffentlicht: (2024)
von: Huang, Yong, et al.
Veröffentlicht: (2024)
Bi-Level Contextual Bandits for Individualized Resource Allocation under Delayed Feedback
von: Almasi, Mohammadsina, et al.
Veröffentlicht: (2025)
von: Almasi, Mohammadsina, et al.
Veröffentlicht: (2025)
Quantum-Enhanced Neural Contextual Bandit Algorithms
von: Huang, Yuqi, et al.
Veröffentlicht: (2026)
von: Huang, Yuqi, et al.
Veröffentlicht: (2026)
Sparse Nonparametric Contextual Bandits
von: Flynn, Hamish, et al.
Veröffentlicht: (2025)
von: Flynn, Hamish, et al.
Veröffentlicht: (2025)
Pessimistic Risk-Aware Policy Learning in Contextual Bandits
von: Wan, Yilong, et al.
Veröffentlicht: (2026)
von: Wan, Yilong, et al.
Veröffentlicht: (2026)
Tight Regret Bounds for Bilateral Trade under Semi Feedback
von: Jin, Yaonan
Veröffentlicht: (2026)
von: Jin, Yaonan
Veröffentlicht: (2026)
Contextual Bandits with Non-Stationary Correlated Rewards for User Association in MmWave Vehicular Networks
von: He, Xiaoyang, et al.
Veröffentlicht: (2024)
von: He, Xiaoyang, et al.
Veröffentlicht: (2024)
Upper Counterfactual Confidence Bounds: a New Optimism Principle for Contextual Bandits
von: Xu, Yunbei, et al.
Veröffentlicht: (2020)
von: Xu, Yunbei, et al.
Veröffentlicht: (2020)
Nearly Tight Regret Bounds for Profit Maximization in Bilateral Trade
von: Di Gregorio, Simone, et al.
Veröffentlicht: (2025)
von: Di Gregorio, Simone, et al.
Veröffentlicht: (2025)
Learning Equilibria in Matching Games with Bandit Feedback
von: Athanasopoulos, Andreas, et al.
Veröffentlicht: (2025)
von: Athanasopoulos, Andreas, et al.
Veröffentlicht: (2025)
Transfer Learning for Contextual Multi-armed Bandits
von: Cai, Changxiao, et al.
Veröffentlicht: (2022)
von: Cai, Changxiao, et al.
Veröffentlicht: (2022)
Near-optimal Regret Using Policy Optimization in Online MDPs with Aggregate Bandit Feedback
von: Lancewicki, Tal, et al.
Veröffentlicht: (2025)
von: Lancewicki, Tal, et al.
Veröffentlicht: (2025)
Learning to Optimize Feedback for One Million Students: Insights from Multi-Armed and Contextual Bandits in Large-Scale Online Tutoring
von: Schmucker, Robin, et al.
Veröffentlicht: (2025)
von: Schmucker, Robin, et al.
Veröffentlicht: (2025)
Linear Contextual Bandits with Interference
von: Xu, Yang, et al.
Veröffentlicht: (2024)
von: Xu, Yang, et al.
Veröffentlicht: (2024)
Optimal Multitask Linear Regression and Contextual Bandits under Sparse Heterogeneity
von: Huang, Xinmeng, et al.
Veröffentlicht: (2023)
von: Huang, Xinmeng, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
High Probability Bound for Cross-Learning Contextual Bandits with Unknown Context Distributions
von: Huang, Ruiyuan, et al.
Veröffentlicht: (2024) -
Few Batches or Little Memory, But Not Both: Simultaneous Space and Adaptivity Constraints in Stochastic Bandits
von: Huang, Ruiyuan, et al.
Veröffentlicht: (2026) -
Nearly Optimal Algorithms for Contextual Dueling Bandits from Adversarial Feedback
von: Di, Qiwei, et al.
Veröffentlicht: (2024) -
Regret Bounds for Adversarial Contextual Bandits with General Function Approximation and Delayed Feedback
von: Levy, Orin, et al.
Veröffentlicht: (2025) -
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
von: Goyal, Tanmay, et al.
Veröffentlicht: (2025)