Horizon-Free Regret for Linear Markov Decision Processes
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Zihan, Lee, Jason D., Chen, Yuxin, Du, Simon S. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Achieving Constant Regret in Linear Markov Decision Processes
por: Zhang, Weitong, et al.
Publicado: (2024)
por: Zhang, Weitong, et al.
Publicado: (2024)
No-Regret Thompson Sampling for Finite-Horizon Markov Decision Processes with Gaussian Processes
por: Bayrooti, Jasmine, et al.
Publicado: (2025)
por: Bayrooti, Jasmine, et al.
Publicado: (2025)
Warm-up Free Policy Optimization: Improved Regret in Linear Markov Decision Processes
por: Cassel, Asaf, et al.
Publicado: (2024)
por: Cassel, Asaf, et al.
Publicado: (2024)
Settling the Sample Complexity of Online Reinforcement Learning
por: Zhang, Zihan, et al.
Publicado: (2023)
por: Zhang, Zihan, et al.
Publicado: (2023)
Regret Analysis of Policy Gradient Algorithm for Infinite Horizon Average Reward Markov Decision Processes
por: Bai, Qinbo, et al.
Publicado: (2023)
por: Bai, Qinbo, et al.
Publicado: (2023)
Quantum Speedups in Regret Analysis of Infinite Horizon Average-Reward Markov Decision Processes
por: Ganguly, Bhargav, et al.
Publicado: (2023)
por: Ganguly, Bhargav, et al.
Publicado: (2023)
Anytime Acceleration of Gradient Descent
por: Zhang, Zihan, et al.
Publicado: (2024)
por: Zhang, Zihan, et al.
Publicado: (2024)
Generalized Linear Markov Decision Process
por: Zhang, Sinian, et al.
Publicado: (2025)
por: Zhang, Sinian, et al.
Publicado: (2025)
Optimal Multi-Distribution Learning
por: Zhang, Zihan, et al.
Publicado: (2023)
por: Zhang, Zihan, et al.
Publicado: (2023)
Logarithmic Regret of Exploration in Average Reward Markov Decision Processes
por: Boone, Victor, et al.
Publicado: (2025)
por: Boone, Victor, et al.
Publicado: (2025)
Optimistic Regret Bounds for Online Learning in Adversarial Markov Decision Processes
por: Moon, Sang Bin, et al.
Publicado: (2024)
por: Moon, Sang Bin, et al.
Publicado: (2024)
Sharp Gap-Dependent Variance-Aware Regret Bounds for Tabular MDPs
por: Chen, Shulun, et al.
Publicado: (2025)
por: Chen, Shulun, et al.
Publicado: (2025)
No-Regret Learning of Nash Equilibrium for Black-Box Games via Gaussian Processes
por: Han, Minbiao, et al.
Publicado: (2024)
por: Han, Minbiao, et al.
Publicado: (2024)
The Number of Trials Matters in Infinite-Horizon General-Utility Markov Decision Processes
por: Santos, Pedro P., et al.
Publicado: (2024)
por: Santos, Pedro P., et al.
Publicado: (2024)
A policy gradient approach for Finite Horizon Constrained Markov Decision Processes
por: Guin, Soumyajit, et al.
Publicado: (2022)
por: Guin, Soumyajit, et al.
Publicado: (2022)
Direct Regret Optimization in Bayesian Optimization
por: Zhang, Fengxue, et al.
Publicado: (2025)
por: Zhang, Fengxue, et al.
Publicado: (2025)
Rate-Optimal Policy Optimization for Linear Markov Decision Processes
por: Sherman, Uri, et al.
Publicado: (2023)
por: Sherman, Uri, et al.
Publicado: (2023)
Best-of-Both-Worlds for Heavy-Tailed Markov Decision Processes
por: Chen, Yu, et al.
Publicado: (2026)
por: Chen, Yu, et al.
Publicado: (2026)
Regret Bounds for Noise-Free Cascaded Kernelized Bandits
por: Li, Zihan, et al.
Publicado: (2022)
por: Li, Zihan, et al.
Publicado: (2022)
Tighter Regret Bounds for Contextual Action-Set Reinforcement Learning
por: Chen, Zijun, et al.
Publicado: (2026)
por: Chen, Zijun, et al.
Publicado: (2026)
Optimistic Actor-Critic with Parametric Policies for Linear Markov Decision Processes
por: Lin, Max Qiushi, et al.
Publicado: (2026)
por: Lin, Max Qiushi, et al.
Publicado: (2026)
Federated Control in Markov Decision Processes
por: Jin, Hao, et al.
Publicado: (2024)
por: Jin, Hao, et al.
Publicado: (2024)
Linear Mixture Distributionally Robust Markov Decision Processes
por: Liu, Zhishuai, et al.
Publicado: (2025)
por: Liu, Zhishuai, et al.
Publicado: (2025)
Hierarchical Average-Reward Linearly-solvable Markov Decision Processes
por: Infante, Guillermo, et al.
Publicado: (2024)
por: Infante, Guillermo, et al.
Publicado: (2024)
Model-Free, Regret-Optimal Best Policy Identification in Online CMDPs
por: Zhou, Zihan, et al.
Publicado: (2023)
por: Zhou, Zihan, et al.
Publicado: (2023)
Performative Reinforcement Learning with Linear Markov Decision Process
por: Mandal, Debmalya, et al.
Publicado: (2024)
por: Mandal, Debmalya, et al.
Publicado: (2024)
Parameter-Free Algorithms for Performative Regret Minimization under Decision-Dependent Distributions
por: Park, Sungwoo, et al.
Publicado: (2024)
por: Park, Sungwoo, et al.
Publicado: (2024)
Parameter-Free Dynamic Regret for Unconstrained Linear Bandits
por: Rumi, Alberto, et al.
Publicado: (2026)
por: Rumi, Alberto, et al.
Publicado: (2026)
Monitored Markov Decision Processes
por: Parisi, Simone, et al.
Publicado: (2024)
por: Parisi, Simone, et al.
Publicado: (2024)
Improved Regret of Linear Ensemble Sampling
por: Lee, Harin, et al.
Publicado: (2024)
por: Lee, Harin, et al.
Publicado: (2024)
Sample Complexity of Offline Distributionally Robust Linear Markov Decision Processes
por: Wang, He, et al.
Publicado: (2024)
por: Wang, He, et al.
Publicado: (2024)
Unregularized Linear Convergence in Zero-Sum Game from Preference Feedback
por: Chen, Shulun, et al.
Publicado: (2025)
por: Chen, Shulun, et al.
Publicado: (2025)
Policy Regularized Distributionally Robust Markov Decision Processes with Linear Function Approximation
por: Gu, Jingwen, et al.
Publicado: (2025)
por: Gu, Jingwen, et al.
Publicado: (2025)
Globally Optimal Hierarchical Reinforcement Learning for Linearly-Solvable Markov Decision Processes
por: Infante, Guillermo, et al.
Publicado: (2021)
por: Infante, Guillermo, et al.
Publicado: (2021)
Online Learning for Uninformed Markov Games: Empirical Nash-Value Regret and Non-Stationarity Adaptation
por: Liu, Junyan, et al.
Publicado: (2026)
por: Liu, Junyan, et al.
Publicado: (2026)
Optimal Horizon-Free Reward-Free Exploration for Linear Mixture MDPs
por: Zhang, Junkai, et al.
Publicado: (2023)
por: Zhang, Junkai, et al.
Publicado: (2023)
Online Reinforcement Learning in Markov Decision Process Using Linear Programming
por: Leon, Vincent, et al.
Publicado: (2023)
por: Leon, Vincent, et al.
Publicado: (2023)
Transition Transfer $Q$-Learning for Composite Markov Decision Processes
por: Chai, Jinhang, et al.
Publicado: (2025)
por: Chai, Jinhang, et al.
Publicado: (2025)
Transition Constrained Bayesian Optimization via Markov Decision Processes
por: Folch, Jose Pablo, et al.
Publicado: (2024)
por: Folch, Jose Pablo, et al.
Publicado: (2024)
Learning in Markov Decision Processes with Exogenous Dynamics
por: Maran, Davide, et al.
Publicado: (2026)
por: Maran, Davide, et al.
Publicado: (2026)
Ejemplares similares
-
Achieving Constant Regret in Linear Markov Decision Processes
por: Zhang, Weitong, et al.
Publicado: (2024) -
No-Regret Thompson Sampling for Finite-Horizon Markov Decision Processes with Gaussian Processes
por: Bayrooti, Jasmine, et al.
Publicado: (2025) -
Warm-up Free Policy Optimization: Improved Regret in Linear Markov Decision Processes
por: Cassel, Asaf, et al.
Publicado: (2024) -
Settling the Sample Complexity of Online Reinforcement Learning
por: Zhang, Zihan, et al.
Publicado: (2023) -
Regret Analysis of Policy Gradient Algorithm for Infinite Horizon Average Reward Markov Decision Processes
por: Bai, Qinbo, et al.
Publicado: (2023)