Optimal Variance-Dependent Regret Bounds for Infinite-Horizon MDPs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zamir, Guy, Zurek, Matthew, Chen, Yudong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Optimal Single-Policy Sample Complexity and Transient Coverage for Average-Reward Offline RL
par: Zurek, Matthew, et autres
Publié: (2025)
par: Zurek, Matthew, et autres
Publié: (2025)
Span-Based Optimal Sample Complexity for Average Reward MDPs
par: Zurek, Matthew, et autres
Publié: (2023)
par: Zurek, Matthew, et autres
Publié: (2023)
The Plug-in Approach for Average-Reward and Discounted MDPs: Optimal Sample Complexity Analysis
par: Zurek, Matthew, et autres
Publié: (2024)
par: Zurek, Matthew, et autres
Publié: (2024)
Span-Based Optimal Sample Complexity for Weakly Communicating and General Average Reward MDPs
par: Zurek, Matthew, et autres
Publié: (2024)
par: Zurek, Matthew, et autres
Publié: (2024)
Span-Agnostic Optimal Sample Complexity and Oracle Inequalities for Average-Reward RL
par: Zurek, Matthew, et autres
Publié: (2025)
par: Zurek, Matthew, et autres
Publié: (2025)
Faster Fixed-Point Methods for Multichain MDPs
par: Zurek, Matthew, et autres
Publié: (2025)
par: Zurek, Matthew, et autres
Publié: (2025)
Gap-Free Clustering: Sensitivity and Robustness of SDP
par: Zurek, Matthew, et autres
Publié: (2023)
par: Zurek, Matthew, et autres
Publié: (2023)
Tight Regret Bounds for Bayesian Optimization in One Dimension
par: Scarlett, Jonathan
Publié: (2018)
par: Scarlett, Jonathan
Publié: (2018)
Learning Infinite-Horizon Average-Reward Linear Mixture MDPs of Bounded Span
par: Chae, Woojin, et autres
Publié: (2024)
par: Chae, Woojin, et autres
Publié: (2024)
Finite-Time Minimax Bounds and an Optimal Lyapunov Policy in Queueing Control
par: Liu, Yujie, et autres
Publié: (2025)
par: Liu, Yujie, et autres
Publié: (2025)
Achieving Tractable Minimax Optimal Regret in Average Reward MDPs
par: Boone, Victor, et autres
Publié: (2024)
par: Boone, Victor, et autres
Publié: (2024)
Geometry, Computation, and Optimality in Stochastic Optimization
par: Cheng, Chen, et autres
Publié: (2019)
par: Cheng, Chen, et autres
Publié: (2019)
Variance-Aware Regret Bounds for Stochastic Contextual Dueling Bandits
par: Di, Qiwei, et autres
Publié: (2023)
par: Di, Qiwei, et autres
Publié: (2023)
Optimal Horizon-Free Reward-Free Exploration for Linear Mixture MDPs
par: Zhang, Junkai, et autres
Publié: (2023)
par: Zhang, Junkai, et autres
Publié: (2023)
A Neural Network Algorithm for KL Divergence Estimation with Quantitative Error Bounds
par: Foss, Mikil, et autres
Publié: (2025)
par: Foss, Mikil, et autres
Publié: (2025)
Optimal transport natural gradient for statistical manifolds with continuous sample space
par: Chen, Yifan, et autres
Publié: (2018)
par: Chen, Yifan, et autres
Publié: (2018)
Wasserstein Distributionally Robust Estimation in High Dimensions: Performance Analysis and Optimal Hyperparameter Tuning
par: Aolaritei, Liviu, et autres
Publié: (2022)
par: Aolaritei, Liviu, et autres
Publié: (2022)
Is Q-Learning Minimax Optimal? A Tight Sample Complexity Analysis
par: Li, Gen, et autres
Publié: (2021)
par: Li, Gen, et autres
Publié: (2021)
A Soft Inducement Framework for Incentive-Aided Steering of No-Regret Players
par: Yorulmaz, Asrin Efe, et autres
Publié: (2025)
par: Yorulmaz, Asrin Efe, et autres
Publié: (2025)
Landscape of Policy Optimization for Finite Horizon MDPs with General State and Action
par: Chen, Xin, et autres
Publié: (2024)
par: Chen, Xin, et autres
Publié: (2024)
EVODiff: Entropy-aware Variance Optimized Diffusion Inference
par: Li, Shigui, et autres
Publié: (2025)
par: Li, Shigui, et autres
Publié: (2025)
Infinite-Horizon Distributionally Robust Regret-Optimal Control
par: Kargin, Taylan, et autres
Publié: (2024)
par: Kargin, Taylan, et autres
Publié: (2024)
Fast Computation of Optimal Transport via Entropy-Regularized Extragradient Methods
par: Li, Gen, et autres
Publié: (2023)
par: Li, Gen, et autres
Publié: (2023)
Optimal Online Bookmaking for Binary Games
par: Bhatt, Alankrita, et autres
Publié: (2025)
par: Bhatt, Alankrita, et autres
Publié: (2025)
Convexity in Disguise: A Theoretical Framework for Nonconvex Low-Rank Matrix Estimation
par: Cui, Chengyu, et autres
Publié: (2026)
par: Cui, Chengyu, et autres
Publié: (2026)
The augmented NLP bound for maximum-entropy remote sampling
par: Ponte, Gabriel, et autres
Publié: (2026)
par: Ponte, Gabriel, et autres
Publié: (2026)
Adversarial Water-Filling: Theory, Algorithms and Foundation Model
par: Tong, Xindi, et autres
Publié: (2026)
par: Tong, Xindi, et autres
Publié: (2026)
Linear regression with overparameterized linear neural networks: Tight upper and lower bounds for implicit $\ell^1$-regularization
par: Matt, Hannes, et autres
Publié: (2025)
par: Matt, Hannes, et autres
Publié: (2025)
Recovering Simultaneously Structured Data via Non-Convex Iteratively Reweighted Least Squares
par: Kümmerle, Christian, et autres
Publié: (2023)
par: Kümmerle, Christian, et autres
Publié: (2023)
Generalized Orthogonal Procrustes Problem under Arbitrary Adversaries
par: Ling, Shuyang
Publié: (2021)
par: Ling, Shuyang
Publié: (2021)
On the Robustness of Cross-Concentrated Sampling for Matrix Completion
par: Cai, HanQin, et autres
Publié: (2024)
par: Cai, HanQin, et autres
Publié: (2024)
Stochastic Zeroth-Order Optimization under Strongly Convexity and Lipschitz Hessian: Minimax Sample Complexity
par: Yu, Qian, et autres
Publié: (2024)
par: Yu, Qian, et autres
Publié: (2024)
Stochastic Smoothed Gradient Descent Ascent for Federated Minimax Optimization
par: Shen, Wei, et autres
Publié: (2023)
par: Shen, Wei, et autres
Publié: (2023)
Variational Inference on the Boolean Hypercube with the Quantum Entropy
par: Beyler, Eliot, et autres
Publié: (2024)
par: Beyler, Eliot, et autres
Publié: (2024)
A Dual Basis Approach for Structured Robust Euclidean Distance Geometry
par: Kundu, Chandra, et autres
Publié: (2025)
par: Kundu, Chandra, et autres
Publié: (2025)
Structured Sampling for Robust Euclidean Distance Geometry
par: Kundu, Chandra, et autres
Publié: (2024)
par: Kundu, Chandra, et autres
Publié: (2024)
A Single-Loop First-Order Algorithm for Linearly Constrained Bilevel Optimization
par: Shen, Wei, et autres
Publié: (2025)
par: Shen, Wei, et autres
Publié: (2025)
More is Less: Inducing Sparsity via Overparameterization
par: Chou, Hung-Hsu, et autres
Publié: (2021)
par: Chou, Hung-Hsu, et autres
Publié: (2021)
On the Convergence Analysis of Muon
par: Shen, Wei, et autres
Publié: (2025)
par: Shen, Wei, et autres
Publié: (2025)
Group Projected Subspace Pursuit for Block Sparse Signal Reconstruction: Convergence Analysis and Applications
par: He, Roy Y., et autres
Publié: (2024)
par: He, Roy Y., et autres
Publié: (2024)
Documents similaires
-
Optimal Single-Policy Sample Complexity and Transient Coverage for Average-Reward Offline RL
par: Zurek, Matthew, et autres
Publié: (2025) -
Span-Based Optimal Sample Complexity for Average Reward MDPs
par: Zurek, Matthew, et autres
Publié: (2023) -
The Plug-in Approach for Average-Reward and Discounted MDPs: Optimal Sample Complexity Analysis
par: Zurek, Matthew, et autres
Publié: (2024) -
Span-Based Optimal Sample Complexity for Weakly Communicating and General Average Reward MDPs
par: Zurek, Matthew, et autres
Publié: (2024) -
Span-Agnostic Optimal Sample Complexity and Oracle Inequalities for Average-Reward RL
par: Zurek, Matthew, et autres
Publié: (2025)