Model Predictive Control is Almost Optimal for Restless Bandit
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gast, Nicolas, Narasimha, Dheeraj |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Model Predictive Control is almost Optimal for Heterogeneous Restless Multi-armed Bandits
par: Narasimha, Dheeraj, et autres
Publié: (2025)
par: Narasimha, Dheeraj, et autres
Publié: (2025)
Lagrangian Index Policy for Restless Bandits with Average Reward
par: Avrachenkov, Konstantin, et autres
Publié: (2024)
par: Avrachenkov, Konstantin, et autres
Publié: (2024)
Bandit Allocational Instability
par: Chen, Yilun, et autres
Publié: (2026)
par: Chen, Yilun, et autres
Publié: (2026)
Achieving Exponential Asymptotic Optimality in Average-Reward Restless Bandits without Global Attractor Assumption
par: Hong, Yige, et autres
Publié: (2024)
par: Hong, Yige, et autres
Publié: (2024)
Restless Bandits with Average Reward: Breaking the Uniform Global Attractor Assumption
par: Hong, Yige, et autres
Publié: (2023)
par: Hong, Yige, et autres
Publié: (2023)
Representative Action Selection for Large Action Space Bandit Families
par: Zhou, Quan, et autres
Publié: (2025)
par: Zhou, Quan, et autres
Publié: (2025)
Representative Action Selection for Large Action Space: From Bandits to MDPs
par: Zhou, Quan, et autres
Publié: (2025)
par: Zhou, Quan, et autres
Publié: (2025)
Reoptimization Nearly Solves Weakly Coupled Markov Decision Processes
par: Gast, Nicolas, et autres
Publié: (2022)
par: Gast, Nicolas, et autres
Publié: (2022)
Low-Complexity Algorithm for Restless Bandits with Imperfect Observations
par: Liu, Keqin, et autres
Publié: (2021)
par: Liu, Keqin, et autres
Publié: (2021)
Multi-Action Restless Bandits with Weakly Coupled Constraints: Simultaneous Learning and Control
par: Fu, Jing, et autres
Publié: (2024)
par: Fu, Jing, et autres
Publié: (2024)
Stochastic Optimal Control Matching
par: Domingo-Enrich, Carles, et autres
Publié: (2023)
par: Domingo-Enrich, Carles, et autres
Publié: (2023)
Early Stopping in Contextual Bandits and Inferences
par: Cui, Zihan
Publié: (2025)
par: Cui, Zihan
Publié: (2025)
Designing Algorithms for Entropic Optimal Transport from an Optimisation Perspective
par: Srinivasan, Vishwak, et autres
Publié: (2025)
par: Srinivasan, Vishwak, et autres
Publié: (2025)
Computing the Bias of Constant-step Stochastic Approximation with Markovian Noise
par: Allmeier, Sebastian, et autres
Publié: (2024)
par: Allmeier, Sebastian, et autres
Publié: (2024)
DOPL: Direct Online Preference Learning for Restless Bandits with Preference Feedback
par: Xiong, Guojun, et autres
Publié: (2024)
par: Xiong, Guojun, et autres
Publié: (2024)
Wasserstein Formulation of Reinforcement Learning. An Optimal Transport Perspective on Policy Optimization
par: Dus, Mathias
Publié: (2026)
par: Dus, Mathias
Publié: (2026)
Causal Optimal Coupling for Gaussian Input-Output Distributional Data
par: Xu, Daran, et autres
Publié: (2026)
par: Xu, Daran, et autres
Publié: (2026)
Admission Control of Quasi-Reversible Queueing Systems: Optimization and Reinforcement Learning
par: Comte, Céline, et autres
Publié: (2025)
par: Comte, Céline, et autres
Publié: (2025)
Controlling the Flow: Stability and Convergence for Stochastic Gradient Descent with Decaying Regularization
par: Kassing, Sebastian, et autres
Publié: (2025)
par: Kassing, Sebastian, et autres
Publié: (2025)
Convergence of Actor-Critic Learning for Mean Field Games and Mean Field Control in Continuous Spaces
par: Fouque, Jean-Pierre, et autres
Publié: (2025)
par: Fouque, Jean-Pierre, et autres
Publié: (2025)
Algebraic Reduction of Hidden Markov Models
par: Grigoletto, Tommaso, et autres
Publié: (2022)
par: Grigoletto, Tommaso, et autres
Publié: (2022)
Markov Kernels, Distances and Optimal Control: A Parable of Linear Quadratic Non-Gaussian Distribution Steering
par: Teter, Alexis M. H., et autres
Publié: (2025)
par: Teter, Alexis M. H., et autres
Publié: (2025)
Wasserstein Convergence of Score-based Generative Models under Semiconvexity and Discontinuous Gradients
par: Bruno, Stefano, et autres
Publié: (2025)
par: Bruno, Stefano, et autres
Publié: (2025)
Constrained Density Estimation via Optimal Transport
par: Hu, Yinan, et autres
Publié: (2026)
par: Hu, Yinan, et autres
Publié: (2026)
Unichain and Aperiodicity are Sufficient for Asymptotic Optimality of Average-Reward Restless Bandits
par: Hong, Yige, et autres
Publié: (2024)
par: Hong, Yige, et autres
Publié: (2024)
4+3 Phases of Compute-Optimal Neural Scaling Laws
par: Paquette, Elliot, et autres
Publié: (2024)
par: Paquette, Elliot, et autres
Publié: (2024)
Optimal and instance-dependent guarantees for Markovian linear stochastic approximation
par: Mou, Wenlong, et autres
Publié: (2021)
par: Mou, Wenlong, et autres
Publié: (2021)
Set Invariance with Probability One for Controlled Diffusion: Score-based Approach
par: Wang, Wenqing, et autres
Publié: (2025)
par: Wang, Wenqing, et autres
Publié: (2025)
DeepMartingale: Duality of the Optimal Stopping Problem with Expressivity and High-Dimensional Hedging
par: Ye, Junyan, et autres
Publié: (2025)
par: Ye, Junyan, et autres
Publié: (2025)
Achieving $\tilde{\mathcal{O}}(1/N)$ Optimality Gap in Restless Bandits through Gaussian Approximation
par: Yan, Chen, et autres
Publié: (2024)
par: Yan, Chen, et autres
Publié: (2024)
A Generalization Result for Convergence in Learning-to-Optimize
par: Sucker, Michael, et autres
Publié: (2024)
par: Sucker, Michael, et autres
Publié: (2024)
Decoupled Functional Central Limit Theorems for Two-Time-Scale Stochastic Approximation
par: Han, Yuze, et autres
Publié: (2024)
par: Han, Yuze, et autres
Publié: (2024)
Asymptotic regularity of a generalised stochastic Halpern scheme
par: Pischke, Nicholas, et autres
Publié: (2024)
par: Pischke, Nicholas, et autres
Publié: (2024)
Accelerating Distributed Stochastic Optimization via Self-Repellent Random Walks
par: Hu, Jie, et autres
Publié: (2024)
par: Hu, Jie, et autres
Publié: (2024)
Stochastic Inverse Problem: stability, regularization and Wasserstein gradient flow
par: Li, Qin, et autres
Publié: (2024)
par: Li, Qin, et autres
Publié: (2024)
Weak Convergence Analysis of Online Neural Actor-Critic Algorithms
par: Lam, Samuel Chun-Hei, et autres
Publié: (2024)
par: Lam, Samuel Chun-Hei, et autres
Publié: (2024)
Learning-Based Pricing and Matching for Two-Sided Queues
par: Yang, Zixian, et autres
Publié: (2024)
par: Yang, Zixian, et autres
Publié: (2024)
Data-driven Multistage Distributionally Robust Linear Optimization with Nested Distance
par: Gao, Rui, et autres
Publié: (2024)
par: Gao, Rui, et autres
Publié: (2024)
Regret of exploratory policy improvement and $q$-learning
par: Tang, Wenpin, et autres
Publié: (2024)
par: Tang, Wenpin, et autres
Publié: (2024)
On the SAGA algorithm with decreasing step
par: Fredes, Luis, et autres
Publié: (2024)
par: Fredes, Luis, et autres
Publié: (2024)
Documents similaires
-
Model Predictive Control is almost Optimal for Heterogeneous Restless Multi-armed Bandits
par: Narasimha, Dheeraj, et autres
Publié: (2025) -
Lagrangian Index Policy for Restless Bandits with Average Reward
par: Avrachenkov, Konstantin, et autres
Publié: (2024) -
Bandit Allocational Instability
par: Chen, Yilun, et autres
Publié: (2026) -
Achieving Exponential Asymptotic Optimality in Average-Reward Restless Bandits without Global Attractor Assumption
par: Hong, Yige, et autres
Publié: (2024) -
Restless Bandits with Average Reward: Breaking the Uniform Global Attractor Assumption
par: Hong, Yige, et autres
Publié: (2023)