Improved Regret Bounds for Bandits with Expert Advice
Fuente:
arXiv
Salvato in:
| Autori principali: | Cesa-Bianchi, Nicolò, Eldowa, Khaled, Esposito, Emmanuel, Olkhovskaya, Julia |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Information Capacity Regret Bounds for Bandits with Mediator Feedback
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)
Instance-Dependent Regret Bounds for Nonstochastic Linear Partial Monitoring
di: Di Gennaro, Federico, et al.
Pubblicazione: (2025)
di: Di Gennaro, Federico, et al.
Pubblicazione: (2025)
Near-Optimal Regret for Distributed Adversarial Bandits: A Black-Box Approach
di: Qiu, Hao, et al.
Pubblicazione: (2026)
di: Qiu, Hao, et al.
Pubblicazione: (2026)
Parameter-Free Dynamic Regret for Unconstrained Linear Bandits
di: Rumi, Alberto, et al.
Pubblicazione: (2026)
di: Rumi, Alberto, et al.
Pubblicazione: (2026)
Kernelized Reinforcement Learning with Order Optimal Regret Bounds
di: Vakili, Sattar, et al.
Pubblicazione: (2023)
di: Vakili, Sattar, et al.
Pubblicazione: (2023)
Gradient-Variation Regret Bounds for Unconstrained Online Learning
di: Zhao, Yuheng, et al.
Pubblicazione: (2026)
di: Zhao, Yuheng, et al.
Pubblicazione: (2026)
Dynamic Regret Reduces to Kernelized Static Regret
di: Jacobsen, Andrew, et al.
Pubblicazione: (2025)
di: Jacobsen, Andrew, et al.
Pubblicazione: (2025)
Sparsity-Agnostic Linear Bandits with Adaptive Adversaries
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
Kernel-Based Function Approximation for Average Reward Reinforcement Learning: An Optimist No-Regret Algorithm
di: Vakili, Sattar, et al.
Pubblicazione: (2024)
di: Vakili, Sattar, et al.
Pubblicazione: (2024)
Beyond Bandit Feedback in Online Multiclass Classification
di: van der Hoeven, Dirk, et al.
Pubblicazione: (2021)
di: van der Hoeven, Dirk, et al.
Pubblicazione: (2021)
A Perturbation Approach to Unconstrained Linear Bandits
di: Jacobsen, Andrew, et al.
Pubblicazione: (2026)
di: Jacobsen, Andrew, et al.
Pubblicazione: (2026)
Sparse Nonparametric Contextual Bandits
di: Flynn, Hamish, et al.
Pubblicazione: (2025)
di: Flynn, Hamish, et al.
Pubblicazione: (2025)
A Regret Analysis of Bilateral Trade
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
An Improved Algorithm for Adversarial Linear Contextual Bandits via Reduction
di: van Erven, Tim, et al.
Pubblicazione: (2025)
di: van Erven, Tim, et al.
Pubblicazione: (2025)
Learning on the Edge: Online Learning with Stochastic Feedback Graphs
di: Esposito, Emmanuel, et al.
Pubblicazione: (2022)
di: Esposito, Emmanuel, et al.
Pubblicazione: (2022)
Best-of-Both-Worlds Algorithms for Linear Contextual Bandits
di: Kuroki, Yuko, et al.
Pubblicazione: (2023)
di: Kuroki, Yuko, et al.
Pubblicazione: (2023)
Online Budget Allocation with Censored Semi-Bandit Feedback
di: Bachoc, François, et al.
Pubblicazione: (2025)
di: Bachoc, François, et al.
Pubblicazione: (2025)
Market Making without Regret
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
Bandits with Abstention under Expert Advice
di: Pasteris, Stephen, et al.
Pubblicazione: (2024)
di: Pasteris, Stephen, et al.
Pubblicazione: (2024)
A Theory of Interpretable Approximations
di: Bressan, Marco, et al.
Pubblicazione: (2024)
di: Bressan, Marco, et al.
Pubblicazione: (2024)
A Tight Lower Bound for Non-stochastic Multi-armed Bandits with Expert Advice
di: Chase, Zachary, et al.
Pubblicazione: (2025)
di: Chase, Zachary, et al.
Pubblicazione: (2025)
Of Dice and Games: A Theory of Generalized Boosting
di: Bressan, Marco, et al.
Pubblicazione: (2024)
di: Bressan, Marco, et al.
Pubblicazione: (2024)
Learning Conditional Averages
di: Bressan, Marco, et al.
Pubblicazione: (2026)
di: Bressan, Marco, et al.
Pubblicazione: (2026)
Distributed Online Optimization with Stochastic Agent Availability
di: Achddou, Juliette, et al.
Pubblicazione: (2024)
di: Achddou, Juliette, et al.
Pubblicazione: (2024)
Lookahead identification in adversarial bandits: accuracy and memory bounds
di: Brukhim, Nataly, et al.
Pubblicazione: (2026)
di: Brukhim, Nataly, et al.
Pubblicazione: (2026)
Online Linear Regression with Paid Stochastic Features
di: Merlis, Nadav, et al.
Pubblicazione: (2025)
di: Merlis, Nadav, et al.
Pubblicazione: (2025)
Multitask Online Learning: Listen to the Neighborhood Buzz
di: Achddou, Juliette, et al.
Pubblicazione: (2023)
di: Achddou, Juliette, et al.
Pubblicazione: (2023)
Improved Regret Bounds of (Multinomial) Logistic Bandits via Regret-to-Confidence-Set Conversion
di: Lee, Junghyun, et al.
Pubblicazione: (2023)
di: Lee, Junghyun, et al.
Pubblicazione: (2023)
Adaptive maximization of social welfare
di: Cesa-Bianchi, Nicolo, et al.
Pubblicazione: (2023)
di: Cesa-Bianchi, Nicolo, et al.
Pubblicazione: (2023)
Improved Regret Bounds for Linear Bandits with Heavy-Tailed Rewards
di: Tajdini, Artin, et al.
Pubblicazione: (2025)
di: Tajdini, Artin, et al.
Pubblicazione: (2025)
Bandits with Stochastic Experts: Constant Regret, Empirical Experts and Episodes
di: Sharma, Nihal, et al.
Pubblicazione: (2021)
di: Sharma, Nihal, et al.
Pubblicazione: (2021)
Cooperative Online Learning with Feedback Graphs
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
Improved Regret Bounds for Online Fair Division with Bandit Learning
di: Schiffer, Benjamin, et al.
Pubblicazione: (2025)
di: Schiffer, Benjamin, et al.
Pubblicazione: (2025)
Queue Length Regret Bounds for Contextual Queueing Bandits
di: Bae, Seoungbin, et al.
Pubblicazione: (2026)
di: Bae, Seoungbin, et al.
Pubblicazione: (2026)
Near-optimal Per-Action Regret Bounds for Sleeping Bandits
di: Nguyen, Quan, et al.
Pubblicazione: (2024)
di: Nguyen, Quan, et al.
Pubblicazione: (2024)
Graph-Dependent Regret Bounds in Multi-Armed Bandits with Interference
di: Jamshidi, Fateme, et al.
Pubblicazione: (2025)
di: Jamshidi, Fateme, et al.
Pubblicazione: (2025)
Multimodal Bandits: Regret Lower Bounds and Optimal Algorithms
di: Réveillard, William, et al.
Pubblicazione: (2025)
di: Réveillard, William, et al.
Pubblicazione: (2025)
Regret Bounds for Noise-Free Cascaded Kernelized Bandits
di: Li, Zihan, et al.
Pubblicazione: (2022)
di: Li, Zihan, et al.
Pubblicazione: (2022)
Variance-Dependent Regret Lower Bounds for Contextual Bandits
di: He, Jiafan, et al.
Pubblicazione: (2025)
di: He, Jiafan, et al.
Pubblicazione: (2025)
Improved Regret for Bandit Convex Optimization with Delayed Feedback
di: Wan, Yuanyu, et al.
Pubblicazione: (2024)
di: Wan, Yuanyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Information Capacity Regret Bounds for Bandits with Mediator Feedback
di: Eldowa, Khaled, et al.
Pubblicazione: (2024) -
Instance-Dependent Regret Bounds for Nonstochastic Linear Partial Monitoring
di: Di Gennaro, Federico, et al.
Pubblicazione: (2025) -
Near-Optimal Regret for Distributed Adversarial Bandits: A Black-Box Approach
di: Qiu, Hao, et al.
Pubblicazione: (2026) -
Parameter-Free Dynamic Regret for Unconstrained Linear Bandits
di: Rumi, Alberto, et al.
Pubblicazione: (2026) -
Kernelized Reinforcement Learning with Order Optimal Regret Bounds
di: Vakili, Sattar, et al.
Pubblicazione: (2023)