Thompson Sampling-like Algorithms for Stochastic Rising Bandits
Fuente:
arXiv
Salvato in:
| Autori principali: | Fiandri, Marco, Metelli, Alberto Maria, Trovò, Francesco |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Sliding-Window Thompson Sampling for Non-Stationary Settings
di: Fiandri, Marco, et al.
Pubblicazione: (2024)
di: Fiandri, Marco, et al.
Pubblicazione: (2024)
Rising Rested Bandits: Lower Bounds and Efficient Algorithms
di: Fiandri, Marco, et al.
Pubblicazione: (2024)
di: Fiandri, Marco, et al.
Pubblicazione: (2024)
Best Arm Identification for Stochastic Rising Bandits
di: Mussi, Marco, et al.
Pubblicazione: (2023)
di: Mussi, Marco, et al.
Pubblicazione: (2023)
Bridging Rested and Restless Bandits with Graph-Triggering: Rising and Rotting
di: Genalti, Gianmarco, et al.
Pubblicazione: (2024)
di: Genalti, Gianmarco, et al.
Pubblicazione: (2024)
Open Problem: Tight Bounds for Kernelized Multi-Armed Bandits with Bernoulli Rewards
di: Mussi, Marco, et al.
Pubblicazione: (2024)
di: Mussi, Marco, et al.
Pubblicazione: (2024)
Autoregressive Bandits
di: Bacchiocchi, Francesco, et al.
Pubblicazione: (2022)
di: Bacchiocchi, Francesco, et al.
Pubblicazione: (2022)
Generalized Kernelized Bandits: A Novel Self-Normalized Bernstein-Like Dimension-Free Inequality and Regret Bounds
di: Metelli, Alberto Maria, et al.
Pubblicazione: (2025)
di: Metelli, Alberto Maria, et al.
Pubblicazione: (2025)
Thompson Sampling for Stochastic Bandits with Noisy Contexts: An Information-Theoretic Regret Analysis
di: Jose, Sharu Theresa, et al.
Pubblicazione: (2024)
di: Jose, Sharu Theresa, et al.
Pubblicazione: (2024)
Learning Optimal Deterministic Policies with Stochastic Policy Gradients
di: Montenegro, Alessandro, et al.
Pubblicazione: (2024)
di: Montenegro, Alessandro, et al.
Pubblicazione: (2024)
Thompson Sampling in Partially Observable Contextual Bandits
di: Park, Hongju, et al.
Pubblicazione: (2024)
di: Park, Hongju, et al.
Pubblicazione: (2024)
Information Capacity Regret Bounds for Bandits with Mediator Feedback
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)
Thompson Sampling for Multi-Objective Linear Contextual Bandit
di: Park, Somangchan, et al.
Pubblicazione: (2025)
di: Park, Somangchan, et al.
Pubblicazione: (2025)
An Information-Theoretic Analysis of Thompson Sampling for Logistic Bandits
di: Gouverneur, Amaury, et al.
Pubblicazione: (2024)
di: Gouverneur, Amaury, et al.
Pubblicazione: (2024)
Performance Improvement Bounds for Lipschitz Configurable Markov Decision Processes
di: Metelli, Alberto Maria
Pubblicazione: (2024)
di: Metelli, Alberto Maria
Pubblicazione: (2024)
Thompson Sampling For Combinatorial Bandits: Polynomial Regret and Mismatched Sampling Paradox
di: Zhang, Raymond, et al.
Pubblicazione: (2024)
di: Zhang, Raymond, et al.
Pubblicazione: (2024)
Catoni-Style Change Point Detection for Regret Minimization in Non-Stationary Heavy-Tailed Bandits
di: Genalti, Gianmarco, et al.
Pubblicazione: (2025)
di: Genalti, Gianmarco, et al.
Pubblicazione: (2025)
$(ε, u)$-Adaptive Regret Minimization in Heavy-Tailed Bandits
di: Genalti, Gianmarco, et al.
Pubblicazione: (2023)
di: Genalti, Gianmarco, et al.
Pubblicazione: (2023)
Adaptive Prior Selection in Gaussian Process Bandits with Thompson Sampling
di: Sandberg, Jack, et al.
Pubblicazione: (2025)
di: Sandberg, Jack, et al.
Pubblicazione: (2025)
Feel-Good Thompson Sampling for Contextual Dueling Bandits
di: Li, Xuheng, et al.
Pubblicazione: (2024)
di: Li, Xuheng, et al.
Pubblicazione: (2024)
Offline Inverse RL: New Solution Concepts and Provably Efficient Algorithms
di: Lazzati, Filippo, et al.
Pubblicazione: (2024)
di: Lazzati, Filippo, et al.
Pubblicazione: (2024)
A Provably Efficient Option-Based Algorithm for both High-Level and Low-Level Learning
di: Drappo, Gianluca, et al.
Pubblicazione: (2024)
di: Drappo, Gianluca, et al.
Pubblicazione: (2024)
Variance-Aware Feel-Good Thompson Sampling for Contextual Bandits
di: Li, Xuheng, et al.
Pubblicazione: (2025)
di: Li, Xuheng, et al.
Pubblicazione: (2025)
Policy Gradient with Active Importance Sampling
di: Papini, Matteo, et al.
Pubblicazione: (2024)
di: Papini, Matteo, et al.
Pubblicazione: (2024)
A Refined Analysis of UCBVI
di: Drago, Simone, et al.
Pubblicazione: (2025)
di: Drago, Simone, et al.
Pubblicazione: (2025)
Bayesian Collaborative Bandits with Thompson Sampling for Improved Outreach in Maternal Health Program
di: Dasgupta, Arpan, et al.
Pubblicazione: (2024)
di: Dasgupta, Arpan, et al.
Pubblicazione: (2024)
Worst-Case Regret Bounds for Combinatorial Thompson Sampling in Sleeping Semi-Bandits
di: Huang, Zhiming, et al.
Pubblicazione: (2026)
di: Huang, Zhiming, et al.
Pubblicazione: (2026)
Stochastically Constrained Best Arm Identification with Thompson Sampling
di: Yang, Le, et al.
Pubblicazione: (2025)
di: Yang, Le, et al.
Pubblicazione: (2025)
Bayesian Bandit Algorithms with Approximate Inference in Stochastic Linear Bandits
di: Huang, Ziyi, et al.
Pubblicazione: (2024)
di: Huang, Ziyi, et al.
Pubblicazione: (2024)
Generator-Mediated Bandits: Thompson Sampling for GenAI-Powered Adaptive Interventions
di: Brooks, Marc, et al.
Pubblicazione: (2025)
di: Brooks, Marc, et al.
Pubblicazione: (2025)
Robustness in the Face of Partial Identifiability in Reward Learning
di: Lazzati, Filippo, et al.
Pubblicazione: (2025)
di: Lazzati, Filippo, et al.
Pubblicazione: (2025)
Learning Utilities from Demonstrations in Markov Decision Processes
di: Lazzati, Filippo, et al.
Pubblicazione: (2024)
di: Lazzati, Filippo, et al.
Pubblicazione: (2024)
Combinatorial Rising Bandits
di: Song, Seockbean, et al.
Pubblicazione: (2024)
di: Song, Seockbean, et al.
Pubblicazione: (2024)
Actor-Critic with Active Importance Sampling
di: Molaei, Majid, et al.
Pubblicazione: (2026)
di: Molaei, Majid, et al.
Pubblicazione: (2026)
Modified Meta-Thompson Sampling for Linear Bandits and Its Bayes Regret Analysis
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Improving Thompson Sampling via Information Relaxation for Budgeted Multi-armed Bandits
di: Jeong, Woojin, et al.
Pubblicazione: (2024)
di: Jeong, Woojin, et al.
Pubblicazione: (2024)
Is Thompson Sampling Susceptible to Algorithmic Collusion?
di: Xiong, Yi, et al.
Pubblicazione: (2024)
di: Xiong, Yi, et al.
Pubblicazione: (2024)
Projection by Convolution: Optimal Sample Complexity for Reinforcement Learning in Continuous-Space MDPs
di: Maran, Davide, et al.
Pubblicazione: (2024)
di: Maran, Davide, et al.
Pubblicazione: (2024)
Last-Iterate Global Convergence of Policy Gradients for Constrained Reinforcement Learning
di: Montenegro, Alessandro, et al.
Pubblicazione: (2024)
di: Montenegro, Alessandro, et al.
Pubblicazione: (2024)
Generalizing Behavior via Inverse Reinforcement Learning with Closed-Form Reward Centroids
di: Lazzati, Filippo, et al.
Pubblicazione: (2025)
di: Lazzati, Filippo, et al.
Pubblicazione: (2025)
Imitation Learning as Return Distribution Matching
di: Lazzati, Filippo, et al.
Pubblicazione: (2025)
di: Lazzati, Filippo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Sliding-Window Thompson Sampling for Non-Stationary Settings
di: Fiandri, Marco, et al.
Pubblicazione: (2024) -
Rising Rested Bandits: Lower Bounds and Efficient Algorithms
di: Fiandri, Marco, et al.
Pubblicazione: (2024) -
Best Arm Identification for Stochastic Rising Bandits
di: Mussi, Marco, et al.
Pubblicazione: (2023) -
Bridging Rested and Restless Bandits with Graph-Triggering: Rising and Rotting
di: Genalti, Gianmarco, et al.
Pubblicazione: (2024) -
Open Problem: Tight Bounds for Kernelized Multi-Armed Bandits with Bernoulli Rewards
di: Mussi, Marco, et al.
Pubblicazione: (2024)