Parameter-Free Dynamic Regret for Unconstrained Linear Bandits
Fuente:
arXiv
Salvato in:
| Autori principali: | Rumi, Alberto, Jacobsen, Andrew, Cesa-Bianchi, Nicolò, Vitale, Fabio |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Perturbation Approach to Unconstrained Linear Bandits
di: Jacobsen, Andrew, et al.
Pubblicazione: (2026)
di: Jacobsen, Andrew, et al.
Pubblicazione: (2026)
Best-of-Both-Worlds Algorithms for Linear Contextual Bandits
di: Kuroki, Yuko, et al.
Pubblicazione: (2023)
di: Kuroki, Yuko, et al.
Pubblicazione: (2023)
Gradient-Variation Regret Bounds for Unconstrained Online Learning
di: Zhao, Yuheng, et al.
Pubblicazione: (2026)
di: Zhao, Yuheng, et al.
Pubblicazione: (2026)
Dynamic Regret Reduces to Kernelized Static Regret
di: Jacobsen, Andrew, et al.
Pubblicazione: (2025)
di: Jacobsen, Andrew, et al.
Pubblicazione: (2025)
Information Capacity Regret Bounds for Bandits with Mediator Feedback
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)
Improved Regret Bounds for Bandits with Expert Advice
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
Near-Optimal Regret for Distributed Adversarial Bandits: A Black-Box Approach
di: Qiu, Hao, et al.
Pubblicazione: (2026)
di: Qiu, Hao, et al.
Pubblicazione: (2026)
Sparsity-Agnostic Linear Bandits with Adaptive Adversaries
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
Instance-Dependent Regret Bounds for Nonstochastic Linear Partial Monitoring
di: Di Gennaro, Federico, et al.
Pubblicazione: (2025)
di: Di Gennaro, Federico, et al.
Pubblicazione: (2025)
Beyond Bandit Feedback in Online Multiclass Classification
di: van der Hoeven, Dirk, et al.
Pubblicazione: (2021)
di: van der Hoeven, Dirk, et al.
Pubblicazione: (2021)
Online Linear Regression with Paid Stochastic Features
di: Merlis, Nadav, et al.
Pubblicazione: (2025)
di: Merlis, Nadav, et al.
Pubblicazione: (2025)
A Regret Analysis of Bilateral Trade
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
Online Budget Allocation with Censored Semi-Bandit Feedback
di: Bachoc, François, et al.
Pubblicazione: (2025)
di: Bachoc, François, et al.
Pubblicazione: (2025)
Market Making without Regret
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
Bandits with Abstention under Expert Advice
di: Pasteris, Stephen, et al.
Pubblicazione: (2024)
di: Pasteris, Stephen, et al.
Pubblicazione: (2024)
Logarithmic Regret for Unconstrained Submodular Maximization Stochastic Bandit
di: Zhou, Julien, et al.
Pubblicazione: (2024)
di: Zhou, Julien, et al.
Pubblicazione: (2024)
Lookahead identification in adversarial bandits: accuracy and memory bounds
di: Brukhim, Nataly, et al.
Pubblicazione: (2026)
di: Brukhim, Nataly, et al.
Pubblicazione: (2026)
Distributed Online Optimization with Stochastic Agent Availability
di: Achddou, Juliette, et al.
Pubblicazione: (2024)
di: Achddou, Juliette, et al.
Pubblicazione: (2024)
Multitask Online Learning: Listen to the Neighborhood Buzz
di: Achddou, Juliette, et al.
Pubblicazione: (2023)
di: Achddou, Juliette, et al.
Pubblicazione: (2023)
Parameter-free Dynamic Regret: Time-varying Movement Costs, Delayed Feedback, and Memory
di: Qiu, Hao, et al.
Pubblicazione: (2026)
di: Qiu, Hao, et al.
Pubblicazione: (2026)
An Equivalence Between Static and Dynamic Regret Minimization
di: Jacobsen, Andrew, et al.
Pubblicazione: (2024)
di: Jacobsen, Andrew, et al.
Pubblicazione: (2024)
Adaptive maximization of social welfare
di: Cesa-Bianchi, Nicolo, et al.
Pubblicazione: (2023)
di: Cesa-Bianchi, Nicolo, et al.
Pubblicazione: (2023)
Cooperative Online Learning with Feedback Graphs
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
Prior Diffusiveness and Regret in the Linear-Gaussian Bandit
di: Zhu, Yifan, et al.
Pubblicazione: (2026)
di: Zhu, Yifan, et al.
Pubblicazione: (2026)
No-Regret Linear Bandits under Gap-Adjusted Misspecification
di: Liu, Chong, et al.
Pubblicazione: (2025)
di: Liu, Chong, et al.
Pubblicazione: (2025)
Online Linear Regression in Dynamic Environments via Discounting
di: Jacobsen, Andrew, et al.
Pubblicazione: (2024)
di: Jacobsen, Andrew, et al.
Pubblicazione: (2024)
Near-Optimal Regret in Linear MDPs with Aggregate Bandit Feedback
di: Cassel, Asaf, et al.
Pubblicazione: (2024)
di: Cassel, Asaf, et al.
Pubblicazione: (2024)
Fair Online Bilateral Trade
di: Bachoc, François, et al.
Pubblicazione: (2024)
di: Bachoc, François, et al.
Pubblicazione: (2024)
On the Optimal Regret of Locally Private Linear Contextual Bandit
di: Li, Jiachun, et al.
Pubblicazione: (2024)
di: Li, Jiachun, et al.
Pubblicazione: (2024)
Regret Bounds for Noise-Free Cascaded Kernelized Bandits
di: Li, Zihan, et al.
Pubblicazione: (2022)
di: Li, Zihan, et al.
Pubblicazione: (2022)
Generalized Linear Bandits: Almost Optimal Regret with One-Pass Update
di: Zhang, Yu-Jie, et al.
Pubblicazione: (2025)
di: Zhang, Yu-Jie, et al.
Pubblicazione: (2025)
Variance-Dependent Regret Bounds for Non-stationary Linear Bandits
di: Wang, Zhiyong, et al.
Pubblicazione: (2024)
di: Wang, Zhiyong, et al.
Pubblicazione: (2024)
Improved Regret Bounds for Linear Bandits with Heavy-Tailed Rewards
di: Tajdini, Artin, et al.
Pubblicazione: (2025)
di: Tajdini, Artin, et al.
Pubblicazione: (2025)
Chained Information-Theoretic bounds and Tight Regret Rate for Linear Bandit Problems
di: Gouverneur, Amaury, et al.
Pubblicazione: (2024)
di: Gouverneur, Amaury, et al.
Pubblicazione: (2024)
Local Anti-Concentration Class: Logarithmic Regret for Greedy Linear Contextual Bandit
di: Kim, Seok-Jin, et al.
Pubblicazione: (2024)
di: Kim, Seok-Jin, et al.
Pubblicazione: (2024)
Generalized Kernelized Bandits: A Novel Self-Normalized Bernstein-Like Dimension-Free Inequality and Regret Bounds
di: Metelli, Alberto Maria, et al.
Pubblicazione: (2025)
di: Metelli, Alberto Maria, et al.
Pubblicazione: (2025)
Learning on the Edge: Online Learning with Stochastic Feedback Graphs
di: Esposito, Emmanuel, et al.
Pubblicazione: (2022)
di: Esposito, Emmanuel, et al.
Pubblicazione: (2022)
Regret minimization in Linear Bandits with offline data via extended D-optimal exploration
di: Vijayan, Sushant, et al.
Pubblicazione: (2025)
di: Vijayan, Sushant, et al.
Pubblicazione: (2025)
Optimal Regret for Single Index Bandits
di: Dey, Devdan, et al.
Pubblicazione: (2026)
di: Dey, Devdan, et al.
Pubblicazione: (2026)
Bayesian Regret Minimization in Offline Bandits
di: Petrik, Marek, et al.
Pubblicazione: (2023)
di: Petrik, Marek, et al.
Pubblicazione: (2023)
Documenti analoghi
-
A Perturbation Approach to Unconstrained Linear Bandits
di: Jacobsen, Andrew, et al.
Pubblicazione: (2026) -
Best-of-Both-Worlds Algorithms for Linear Contextual Bandits
di: Kuroki, Yuko, et al.
Pubblicazione: (2023) -
Gradient-Variation Regret Bounds for Unconstrained Online Learning
di: Zhao, Yuheng, et al.
Pubblicazione: (2026) -
Dynamic Regret Reduces to Kernelized Static Regret
di: Jacobsen, Andrew, et al.
Pubblicazione: (2025) -
Information Capacity Regret Bounds for Bandits with Mediator Feedback
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)