Sparsity-Agnostic Linear Bandits with Adaptive Adversaries
Fuente:
arXiv
Salvato in:
| Autori principali: | Jin, Tianyuan, Jang, Kyoungseok, Cesa-Bianchi, Nicolò |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Online Linear Regression with Paid Stochastic Features
di: Merlis, Nadav, et al.
Pubblicazione: (2025)
di: Merlis, Nadav, et al.
Pubblicazione: (2025)
Near-Optimal Regret for Distributed Adversarial Bandits: A Black-Box Approach
di: Qiu, Hao, et al.
Pubblicazione: (2026)
di: Qiu, Hao, et al.
Pubblicazione: (2026)
A Perturbation Approach to Unconstrained Linear Bandits
di: Jacobsen, Andrew, et al.
Pubblicazione: (2026)
di: Jacobsen, Andrew, et al.
Pubblicazione: (2026)
Parameter-Free Dynamic Regret for Unconstrained Linear Bandits
di: Rumi, Alberto, et al.
Pubblicazione: (2026)
di: Rumi, Alberto, et al.
Pubblicazione: (2026)
Best-of-Both-Worlds Algorithms for Linear Contextual Bandits
di: Kuroki, Yuko, et al.
Pubblicazione: (2023)
di: Kuroki, Yuko, et al.
Pubblicazione: (2023)
Improved Regret Bounds for Bandits with Expert Advice
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
Beyond Bandit Feedback in Online Multiclass Classification
di: van der Hoeven, Dirk, et al.
Pubblicazione: (2021)
di: van der Hoeven, Dirk, et al.
Pubblicazione: (2021)
Information Capacity Regret Bounds for Bandits with Mediator Feedback
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)
Adaptive maximization of social welfare
di: Cesa-Bianchi, Nicolo, et al.
Pubblicazione: (2023)
di: Cesa-Bianchi, Nicolo, et al.
Pubblicazione: (2023)
Instance-Dependent Regret Bounds for Nonstochastic Linear Partial Monitoring
di: Di Gennaro, Federico, et al.
Pubblicazione: (2025)
di: Di Gennaro, Federico, et al.
Pubblicazione: (2025)
Online Budget Allocation with Censored Semi-Bandit Feedback
di: Bachoc, François, et al.
Pubblicazione: (2025)
di: Bachoc, François, et al.
Pubblicazione: (2025)
Efficient Low-Rank Matrix Estimation, Experimental Design, and Arm-Set-Dependent Low-Rank Bandits
di: Jang, Kyoungseok, et al.
Pubblicazione: (2024)
di: Jang, Kyoungseok, et al.
Pubblicazione: (2024)
Optimal Batched Linear Bandits
di: Ren, Xuanfei, et al.
Pubblicazione: (2024)
di: Ren, Xuanfei, et al.
Pubblicazione: (2024)
Distributed Online Optimization with Stochastic Agent Availability
di: Achddou, Juliette, et al.
Pubblicazione: (2024)
di: Achddou, Juliette, et al.
Pubblicazione: (2024)
Lookahead identification in adversarial bandits: accuracy and memory bounds
di: Brukhim, Nataly, et al.
Pubblicazione: (2026)
di: Brukhim, Nataly, et al.
Pubblicazione: (2026)
Multitask Online Learning: Listen to the Neighborhood Buzz
di: Achddou, Juliette, et al.
Pubblicazione: (2023)
di: Achddou, Juliette, et al.
Pubblicazione: (2023)
Repeated Bilateral Trade Against a Smoothed Adversary
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2023)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2023)
Gradient-Variation Regret Bounds for Unconstrained Online Learning
di: Zhao, Yuheng, et al.
Pubblicazione: (2026)
di: Zhao, Yuheng, et al.
Pubblicazione: (2026)
Cooperative Online Learning with Feedback Graphs
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
Dynamic Regret Reduces to Kernelized Static Regret
di: Jacobsen, Andrew, et al.
Pubblicazione: (2025)
di: Jacobsen, Andrew, et al.
Pubblicazione: (2025)
Stability and Generalization for Bellman Residuals
di: Kang, Enoch H., et al.
Pubblicazione: (2025)
di: Kang, Enoch H., et al.
Pubblicazione: (2025)
The Invisible Handshake: Persistent Overpricing by Adaptive Market Agents
di: Foscari, Luigi, et al.
Pubblicazione: (2025)
di: Foscari, Luigi, et al.
Pubblicazione: (2025)
Fixed Confidence Best Arm Identification in the Bayesian Setting
di: Jang, Kyoungseok, et al.
Pubblicazione: (2024)
di: Jang, Kyoungseok, et al.
Pubblicazione: (2024)
Rate-optimal Design for Anytime Best Arm Identification
di: Komiyama, Junpei, et al.
Pubblicazione: (2025)
di: Komiyama, Junpei, et al.
Pubblicazione: (2025)
Fair Online Bilateral Trade
di: Bachoc, François, et al.
Pubblicazione: (2024)
di: Bachoc, François, et al.
Pubblicazione: (2024)
Navigating Sparsities in High-Dimensional Linear Contextual Bandits
di: Zhao, Rui, et al.
Pubblicazione: (2025)
di: Zhao, Rui, et al.
Pubblicazione: (2025)
A Regret Analysis of Bilateral Trade
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2021)
Optimal Streaming Algorithms for Multi-Armed Bandits
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
Learning on the Edge: Online Learning with Stochastic Feedback Graphs
di: Esposito, Emmanuel, et al.
Pubblicazione: (2022)
di: Esposito, Emmanuel, et al.
Pubblicazione: (2022)
Adaptive Sampling for Continuous Group Equivariant Neural Networks
di: Inal, Berfin, et al.
Pubblicazione: (2024)
di: Inal, Berfin, et al.
Pubblicazione: (2024)
Generalized Linear Bandits with Limited Adaptivity
di: Sawarni, Ayush, et al.
Pubblicazione: (2024)
di: Sawarni, Ayush, et al.
Pubblicazione: (2024)
A Theory of Interpretable Approximations
di: Bressan, Marco, et al.
Pubblicazione: (2024)
di: Bressan, Marco, et al.
Pubblicazione: (2024)
Of Dice and Games: A Theory of Generalized Boosting
di: Bressan, Marco, et al.
Pubblicazione: (2024)
di: Bressan, Marco, et al.
Pubblicazione: (2024)
Learning Conditional Averages
di: Bressan, Marco, et al.
Pubblicazione: (2026)
di: Bressan, Marco, et al.
Pubblicazione: (2026)
An Improved Algorithm for Adversarial Linear Contextual Bandits via Reduction
di: van Erven, Tim, et al.
Pubblicazione: (2025)
di: van Erven, Tim, et al.
Pubblicazione: (2025)
Adversarial Bandit Optimization with Globally Bounded Perturbations to Linear Losses
di: Cheng, Zhuoyu, et al.
Pubblicazione: (2026)
di: Cheng, Zhuoyu, et al.
Pubblicazione: (2026)
Market Making without Regret
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
The Role of Transparency in Repeated First-Price Auctions with Unknown Valuations
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2023)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2023)
Asymptotically and Minimax Optimal Regret Bounds for Multi-Armed Bandits with Abstention
di: Yang, Junwen, et al.
Pubblicazione: (2024)
di: Yang, Junwen, et al.
Pubblicazione: (2024)
Adaptive Sample Sharing for Multi Agent Linear Bandits
di: Cherkaoui, Hamza, et al.
Pubblicazione: (2023)
di: Cherkaoui, Hamza, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Online Linear Regression with Paid Stochastic Features
di: Merlis, Nadav, et al.
Pubblicazione: (2025) -
Near-Optimal Regret for Distributed Adversarial Bandits: A Black-Box Approach
di: Qiu, Hao, et al.
Pubblicazione: (2026) -
A Perturbation Approach to Unconstrained Linear Bandits
di: Jacobsen, Andrew, et al.
Pubblicazione: (2026) -
Parameter-Free Dynamic Regret for Unconstrained Linear Bandits
di: Rumi, Alberto, et al.
Pubblicazione: (2026) -
Best-of-Both-Worlds Algorithms for Linear Contextual Bandits
di: Kuroki, Yuko, et al.
Pubblicazione: (2023)