Stochastic Graph Bandit Learning with Side-Observations
Fuente:
arXiv
Salvato in:
| Autori principali: | Gong, Xueping, Zhang, Jiheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Parameter-Adaptive Dynamic Pricing
di: Gong, Xueping, et al.
Pubblicazione: (2025)
di: Gong, Xueping, et al.
Pubblicazione: (2025)
Efficient Transfer Learning via Causal Bounds
di: Gong, Xueping, et al.
Pubblicazione: (2023)
di: Gong, Xueping, et al.
Pubblicazione: (2023)
Minimax Optimality in Contextual Dynamic Pricing with General Valuation Models
di: Gong, Xueping, et al.
Pubblicazione: (2024)
di: Gong, Xueping, et al.
Pubblicazione: (2024)
Direction-Aware Offline-to-Online Learning in Linear Contextual Bandits
di: Han, Zean, et al.
Pubblicazione: (2026)
di: Han, Zean, et al.
Pubblicazione: (2026)
Asymptotically-Optimal Gaussian Bandits with Side Observations
di: Atsidakou, Alexia, et al.
Pubblicazione: (2025)
di: Atsidakou, Alexia, et al.
Pubblicazione: (2025)
An LP-based Sampling Policy for Multi-Armed Bandits with Side-Observations and Stochastic Availability
di: Soni, Ashutosh, et al.
Pubblicazione: (2026)
di: Soni, Ashutosh, et al.
Pubblicazione: (2026)
Bayesian Bandit Algorithms with Approximate Inference in Stochastic Linear Bandits
di: Huang, Ziyi, et al.
Pubblicazione: (2024)
di: Huang, Ziyi, et al.
Pubblicazione: (2024)
Active Learning for Stochastic Contextual Linear Bandits
di: Brunskill, Emma, et al.
Pubblicazione: (2026)
di: Brunskill, Emma, et al.
Pubblicazione: (2026)
Speed Up the Cold-Start Learning in Two-Sided Bandits with Many Arms
di: Bayati, Mohsen, et al.
Pubblicazione: (2022)
di: Bayati, Mohsen, et al.
Pubblicazione: (2022)
Graph Learning Is Suboptimal in Causal Bandits
di: Shahverdikondori, Mohammad, et al.
Pubblicazione: (2025)
di: Shahverdikondori, Mohammad, et al.
Pubblicazione: (2025)
Stochastic Bandits for Egalitarian Assignment
di: Lim, Eugene, et al.
Pubblicazione: (2024)
di: Lim, Eugene, et al.
Pubblicazione: (2024)
Efficient Clustering in Stochastic Bandits
di: Chandran, G Dhinesh, et al.
Pubblicazione: (2026)
di: Chandran, G Dhinesh, et al.
Pubblicazione: (2026)
Stochastic Gradient Succeeds for Bandits
di: Mei, Jincheng, et al.
Pubblicazione: (2024)
di: Mei, Jincheng, et al.
Pubblicazione: (2024)
Learning to Sparsify Stochastic Linear Bandits
di: Wang, Zhengmiao, et al.
Pubblicazione: (2026)
di: Wang, Zhengmiao, et al.
Pubblicazione: (2026)
Are Stochastic Multi-objective Bandits Harder than Single-objective Bandits?
di: Guan, Changkun, et al.
Pubblicazione: (2026)
di: Guan, Changkun, et al.
Pubblicazione: (2026)
Nearly-Optimal Bandit Learning in Stackelberg Games with Side Information
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
Batched Stochastic Bandit for Nondegenerate Functions
di: Liu, Yu, et al.
Pubblicazione: (2024)
di: Liu, Yu, et al.
Pubblicazione: (2024)
Stochastic Bandits Robust to Adversarial Attacks
di: Wang, Xuchuang, et al.
Pubblicazione: (2024)
di: Wang, Xuchuang, et al.
Pubblicazione: (2024)
Lipschitz Bandits with Stochastic Delayed Feedback
di: Liu, Zhongxuan, et al.
Pubblicazione: (2025)
di: Liu, Zhongxuan, et al.
Pubblicazione: (2025)
Non-stochastic Bandits With Evolving Observations
di: Bar-On, Yogev, et al.
Pubblicazione: (2024)
di: Bar-On, Yogev, et al.
Pubblicazione: (2024)
Semi-Bandit Learning for Monotone Stochastic Optimization
di: Agarwal, Arpit, et al.
Pubblicazione: (2023)
di: Agarwal, Arpit, et al.
Pubblicazione: (2023)
Efficient Contextual Bandits with Uninformed Feedback Graphs
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
Learning to Bid with Unknown Private Values in Budget-Constrained First-Price Auctions
di: Hu, Zihao, et al.
Pubblicazione: (2026)
di: Hu, Zihao, et al.
Pubblicazione: (2026)
Stochastic $k$-Submodular Bandits with Full Bandit Feedback
di: Nie, Guanyu, et al.
Pubblicazione: (2024)
di: Nie, Guanyu, et al.
Pubblicazione: (2024)
Best Arm Identification for Stochastic Rising Bandits
di: Mussi, Marco, et al.
Pubblicazione: (2023)
di: Mussi, Marco, et al.
Pubblicazione: (2023)
Stochastic Matching Bandits with Rare Optimization Updates
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
Conformal-Style Quantile Analyses for Stochastic Bandits
di: Du, Chengyu, et al.
Pubblicazione: (2026)
di: Du, Chengyu, et al.
Pubblicazione: (2026)
Biased Dueling Bandits with Stochastic Delayed Feedback
di: Yi, Bongsoo, et al.
Pubblicazione: (2024)
di: Yi, Bongsoo, et al.
Pubblicazione: (2024)
Offline Local Search for Online Stochastic Bandits
di: Benadè, Gerdus, et al.
Pubblicazione: (2026)
di: Benadè, Gerdus, et al.
Pubblicazione: (2026)
Fast and Sample Efficient Multi-Task Representation Learning in Stochastic Contextual Bandits
di: Lin, Jiabin, et al.
Pubblicazione: (2024)
di: Lin, Jiabin, et al.
Pubblicazione: (2024)
Graph Feedback Bandits on Similar Arms: With and Without Graph Structures
di: Qi, Han, et al.
Pubblicazione: (2025)
di: Qi, Han, et al.
Pubblicazione: (2025)
Low-Complexity Algorithm for Restless Bandits with Imperfect Observations
di: Liu, Keqin, et al.
Pubblicazione: (2021)
di: Liu, Keqin, et al.
Pubblicazione: (2021)
Stochastic Online Conformal Prediction with Semi-Bandit Feedback
di: Ge, Haosen, et al.
Pubblicazione: (2024)
di: Ge, Haosen, et al.
Pubblicazione: (2024)
Stochastic Multi-Armed Bandits with Limited Control Variates
di: Verma, Arun, et al.
Pubblicazione: (2026)
di: Verma, Arun, et al.
Pubblicazione: (2026)
Batch Ensemble for Variance Dependent Regret in Stochastic Bandits
di: Cassel, Asaf, et al.
Pubblicazione: (2024)
di: Cassel, Asaf, et al.
Pubblicazione: (2024)
Multi-Agent Stochastic Bandits Robust to Adversarial Corruptions
di: Ghaffari, Fatemeh, et al.
Pubblicazione: (2024)
di: Ghaffari, Fatemeh, et al.
Pubblicazione: (2024)
Thompson Sampling-like Algorithms for Stochastic Rising Bandits
di: Fiandri, Marco, et al.
Pubblicazione: (2025)
di: Fiandri, Marco, et al.
Pubblicazione: (2025)
Individual Regret in Cooperative Stochastic Multi-Armed Bandits
di: Barnea, Idan, et al.
Pubblicazione: (2024)
di: Barnea, Idan, et al.
Pubblicazione: (2024)
Online Statistical Inference for Contextual Bandits via Stochastic Gradient Descent
di: Chang, Xiangyu, et al.
Pubblicazione: (2022)
di: Chang, Xiangyu, et al.
Pubblicazione: (2022)
Single-Trajectory Distributionally Robust Reinforcement Learning
di: Liang, Zhipeng, et al.
Pubblicazione: (2023)
di: Liang, Zhipeng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Parameter-Adaptive Dynamic Pricing
di: Gong, Xueping, et al.
Pubblicazione: (2025) -
Efficient Transfer Learning via Causal Bounds
di: Gong, Xueping, et al.
Pubblicazione: (2023) -
Minimax Optimality in Contextual Dynamic Pricing with General Valuation Models
di: Gong, Xueping, et al.
Pubblicazione: (2024) -
Direction-Aware Offline-to-Online Learning in Linear Contextual Bandits
di: Han, Zean, et al.
Pubblicazione: (2026) -
Asymptotically-Optimal Gaussian Bandits with Side Observations
di: Atsidakou, Alexia, et al.
Pubblicazione: (2025)