Minimax Optimal and Computationally Efficient Algorithms for Distributionally Robust Offline Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Zhishuai, Xu, Pan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
por: Tang, Cheng, et al.
Publicado: (2024)
por: Tang, Cheng, et al.
Publicado: (2024)
Upper and Lower Bounds for Distributionally Robust Off-Dynamics Reinforcement Learning
por: Liu, Zhishuai, et al.
Publicado: (2024)
por: Liu, Zhishuai, et al.
Publicado: (2024)
Linear Mixture Distributionally Robust Markov Decision Processes
por: Liu, Zhishuai, et al.
Publicado: (2025)
por: Liu, Zhishuai, et al.
Publicado: (2025)
Sample Complexity of Distributionally Robust Off-Dynamics Reinforcement Learning with Online Interaction
por: He, Yiting, et al.
Publicado: (2025)
por: He, Yiting, et al.
Publicado: (2025)
Policy Regularized Distributionally Robust Markov Decision Processes with Linear Function Approximation
por: Gu, Jingwen, et al.
Publicado: (2025)
por: Gu, Jingwen, et al.
Publicado: (2025)
Sample Efficient Active Algorithms for Offline Reinforcement Learning
por: Roy, Soumyadeep, et al.
Publicado: (2026)
por: Roy, Soumyadeep, et al.
Publicado: (2026)
Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning
por: Wang, Ruhan, et al.
Publicado: (2024)
por: Wang, Ruhan, et al.
Publicado: (2024)
Distributionally Robust Off-Dynamics Reinforcement Learning: Provable Efficiency with Linear Function Approximation
por: Liu, Zhishuai, et al.
Publicado: (2024)
por: Liu, Zhishuai, et al.
Publicado: (2024)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
por: Guo, Yihong, et al.
Publicado: (2025)
por: Guo, Yihong, et al.
Publicado: (2025)
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
por: Liu, Zeyuan, et al.
Publicado: (2025)
por: Liu, Zeyuan, et al.
Publicado: (2025)
Corruption Robust Offline Reinforcement Learning with Human Feedback
por: Mandal, Debmalya, et al.
Publicado: (2024)
por: Mandal, Debmalya, et al.
Publicado: (2024)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
por: Galesloot, Maris F. L., et al.
Publicado: (2026)
por: Galesloot, Maris F. L., et al.
Publicado: (2026)
When is Offline Policy Selection Sample Efficient for Reinforcement Learning?
por: Liu, Vincent, et al.
Publicado: (2023)
por: Liu, Vincent, et al.
Publicado: (2023)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
por: Yang, Rui, et al.
Publicado: (2023)
por: Yang, Rui, et al.
Publicado: (2023)
Offline Trajectory Optimization for Offline Reinforcement Learning
por: Zhao, Ziqi, et al.
Publicado: (2024)
por: Zhao, Ziqi, et al.
Publicado: (2024)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
por: Liu, Tenglong, et al.
Publicado: (2024)
por: Liu, Tenglong, et al.
Publicado: (2024)
Offline Reinforcement Learning in Large State Spaces: Algorithms and Guarantees
por: Jiang, Nan, et al.
Publicado: (2025)
por: Jiang, Nan, et al.
Publicado: (2025)
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning
por: Chen, Jiayu, et al.
Publicado: (2025)
por: Chen, Jiayu, et al.
Publicado: (2025)
How to Provably Improve Return Conditioned Supervised Learning?
por: Liu, Zhishuai, et al.
Publicado: (2025)
por: Liu, Zhishuai, et al.
Publicado: (2025)
Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
por: Xu, Le, et al.
Publicado: (2025)
por: Xu, Le, et al.
Publicado: (2025)
Localized Dynamics-Aware Domain Adaption for Off-Dynamics Offline Reinforcement Learning
por: Xia, Zhangjie, et al.
Publicado: (2026)
por: Xia, Zhangjie, et al.
Publicado: (2026)
Dataset Distillation for Offline Reinforcement Learning
por: Light, Jonathan, et al.
Publicado: (2024)
por: Light, Jonathan, et al.
Publicado: (2024)
Balance Equation-based Distributionally Robust Offline Imitation Learning
por: Agrawal, Rishabh, et al.
Publicado: (2025)
por: Agrawal, Rishabh, et al.
Publicado: (2025)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
por: Li, Mingxuan, et al.
Publicado: (2026)
por: Li, Mingxuan, et al.
Publicado: (2026)
Offline Reinforcement Learning with Imbalanced Datasets
por: Jiang, Li, et al.
Publicado: (2023)
por: Jiang, Li, et al.
Publicado: (2023)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
por: Zhan, Simon Sinong, et al.
Publicado: (2025)
por: Zhan, Simon Sinong, et al.
Publicado: (2025)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
por: Huang, Xiao, et al.
Publicado: (2025)
por: Huang, Xiao, et al.
Publicado: (2025)
Mutual Information Regularized Offline Reinforcement Learning
por: Ma, Xiao, et al.
Publicado: (2022)
por: Ma, Xiao, et al.
Publicado: (2022)
Development and Validation of Heparin Dosing Policies Using an Offline Reinforcement Learning Algorithm
por: Lim, Yooseok, et al.
Publicado: (2024)
por: Lim, Yooseok, et al.
Publicado: (2024)
Diverse Transformer Decoding for Offline Reinforcement Learning Using Financial Algorithmic Approaches
por: Elbaz, Dan, et al.
Publicado: (2025)
por: Elbaz, Dan, et al.
Publicado: (2025)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
por: Xu, Qiushui, et al.
Publicado: (2025)
por: Xu, Qiushui, et al.
Publicado: (2025)
KAN v.s. MLP for Offline Reinforcement Learning
por: Guo, Haihong, et al.
Publicado: (2024)
por: Guo, Haihong, et al.
Publicado: (2024)
Offline Reinforcement Learning with Wasserstein Regularization via Optimal Transport Maps
por: Omura, Motoki, et al.
Publicado: (2025)
por: Omura, Motoki, et al.
Publicado: (2025)
Tackling Heavy-Tailed Rewards in Reinforcement Learning with Function Approximation: Minimax Optimal and Instance-Dependent Regret Bounds
por: Huang, Jiayi, et al.
Publicado: (2023)
por: Huang, Jiayi, et al.
Publicado: (2023)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
por: Liu, Wenhui, et al.
Publicado: (2025)
por: Liu, Wenhui, et al.
Publicado: (2025)
Robust Offline Reinforcement learning with Heavy-Tailed Rewards
por: Zhu, Jin, et al.
Publicado: (2023)
por: Zhu, Jin, et al.
Publicado: (2023)
Offline and Distributional Reinforcement Learning for Radio Resource Management
por: Eldeeb, Eslam, et al.
Publicado: (2024)
por: Eldeeb, Eslam, et al.
Publicado: (2024)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
por: Zhang, Liyu, et al.
Publicado: (2024)
por: Zhang, Liyu, et al.
Publicado: (2024)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
por: Pan, Minting, et al.
Publicado: (2023)
por: Pan, Minting, et al.
Publicado: (2023)
Policy-regularized Offline Multi-objective Reinforcement Learning
por: Lin, Qian, et al.
Publicado: (2024)
por: Lin, Qian, et al.
Publicado: (2024)
Ejemplares similares
-
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
por: Tang, Cheng, et al.
Publicado: (2024) -
Upper and Lower Bounds for Distributionally Robust Off-Dynamics Reinforcement Learning
por: Liu, Zhishuai, et al.
Publicado: (2024) -
Linear Mixture Distributionally Robust Markov Decision Processes
por: Liu, Zhishuai, et al.
Publicado: (2025) -
Sample Complexity of Distributionally Robust Off-Dynamics Reinforcement Learning with Online Interaction
por: He, Yiting, et al.
Publicado: (2025) -
Policy Regularized Distributionally Robust Markov Decision Processes with Linear Function Approximation
por: Gu, Jingwen, et al.
Publicado: (2025)