Diverse Randomized Value Functions: A Provably Pessimistic Approach for Offline Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yu, Xudong, Bai, Chenjia, Guo, Hongyi, Wang, Changhong, Wang, Zhen |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
von: Wang, Changhong, et al.
Veröffentlicht: (2024)
von: Wang, Changhong, et al.
Veröffentlicht: (2024)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
von: Bai, Chenjia, et al.
Veröffentlicht: (2024)
von: Bai, Chenjia, et al.
Veröffentlicht: (2024)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2024)
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2024)
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
von: Wang, Danyang, et al.
Veröffentlicht: (2024)
von: Wang, Danyang, et al.
Veröffentlicht: (2024)
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
von: Liu, Shirong, et al.
Veröffentlicht: (2024)
von: Liu, Shirong, et al.
Veröffentlicht: (2024)
Provable Zero-Shot Generalization in Offline Reinforcement Learning
von: Wang, Zhiyong, et al.
Veröffentlicht: (2025)
von: Wang, Zhiyong, et al.
Veröffentlicht: (2025)
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning
von: Chen, Xuyang, et al.
Veröffentlicht: (2025)
von: Chen, Xuyang, et al.
Veröffentlicht: (2025)
Towards Robust Offline-to-Online Reinforcement Learning via Uncertainty and Smoothness
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2023)
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2023)
Is Value Functions Estimation with Classification Plug-and-play for Offline Reinforcement Learning?
von: Tarasov, Denis, et al.
Veröffentlicht: (2024)
von: Tarasov, Denis, et al.
Veröffentlicht: (2024)
Exponential Topology-enabled Scalable Communication in Multi-agent Reinforcement Learning
von: Li, Xinran, et al.
Veröffentlicht: (2025)
von: Li, Xinran, et al.
Veröffentlicht: (2025)
Diverse Transformer Decoding for Offline Reinforcement Learning Using Financial Algorithmic Approaches
von: Elbaz, Dan, et al.
Veröffentlicht: (2025)
von: Elbaz, Dan, et al.
Veröffentlicht: (2025)
Provable Offline Reinforcement Learning for Structured Cyclic MDPs
von: Lee, Kyungbok, et al.
Veröffentlicht: (2026)
von: Lee, Kyungbok, et al.
Veröffentlicht: (2026)
Bellman Unbiasedness: Toward Provably Efficient Distributional Reinforcement Learning with General Value Function Approximation
von: Cho, Taehyun, et al.
Veröffentlicht: (2024)
von: Cho, Taehyun, et al.
Veröffentlicht: (2024)
On the Statistical Complexity for Offline and Low-Adaptive Reinforcement Learning with Structures
von: Yin, Ming, et al.
Veröffentlicht: (2025)
von: Yin, Ming, et al.
Veröffentlicht: (2025)
Provable Multi-Party Reinforcement Learning with Diverse Human Feedback
von: Zhong, Huiying, et al.
Veröffentlicht: (2024)
von: Zhong, Huiying, et al.
Veröffentlicht: (2024)
Uncertainty-based Offline Variational Bayesian Reinforcement Learning for Robustness under Diverse Data Corruptions
von: Yang, Rui, et al.
Veröffentlicht: (2024)
von: Yang, Rui, et al.
Veröffentlicht: (2024)
Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach
von: Pan, Minting, et al.
Veröffentlicht: (2025)
von: Pan, Minting, et al.
Veröffentlicht: (2025)
Stable Offline Value Function Learning with Bisimulation-based Representations
von: Pavse, Brahma S., et al.
Veröffentlicht: (2024)
von: Pavse, Brahma S., et al.
Veröffentlicht: (2024)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
von: Yang, Rui, et al.
Veröffentlicht: (2023)
von: Yang, Rui, et al.
Veröffentlicht: (2023)
Permutation Equivariant Model-based Offline Reinforcement Learning for Auto-bidding
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025)
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025)
Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes
von: Lu, Miao, et al.
Veröffentlicht: (2022)
von: Lu, Miao, et al.
Veröffentlicht: (2022)
Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data
von: Madhow, Sunil, et al.
Veröffentlicht: (2023)
von: Madhow, Sunil, et al.
Veröffentlicht: (2023)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
von: Ma, Yunchang, et al.
Veröffentlicht: (2025)
von: Ma, Yunchang, et al.
Veröffentlicht: (2025)
KAN v.s. MLP for Offline Reinforcement Learning
von: Guo, Haihong, et al.
Veröffentlicht: (2024)
von: Guo, Haihong, et al.
Veröffentlicht: (2024)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
von: Tiofack, Franki Nguimatsia, et al.
Veröffentlicht: (2025)
von: Tiofack, Franki Nguimatsia, et al.
Veröffentlicht: (2025)
Option-aware Temporally Abstracted Value for Offline Goal-Conditioned Reinforcement Learning
von: Ahn, Hongjoon, et al.
Veröffentlicht: (2025)
von: Ahn, Hongjoon, et al.
Veröffentlicht: (2025)
Offline Reinforcement Learning with Generative Trajectory Policies
von: Feng, Xinsong, et al.
Veröffentlicht: (2025)
von: Feng, Xinsong, et al.
Veröffentlicht: (2025)
On Sample-Efficient Offline Reinforcement Learning: Data Diversity, Posterior Sampling, and Beyond
von: Nguyen-Tang, Thanh, et al.
Veröffentlicht: (2024)
von: Nguyen-Tang, Thanh, et al.
Veröffentlicht: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
Expressive Value Learning for Scalable Offline Reinforcement Learning
von: Espinosa-Dice, Nicolas, et al.
Veröffentlicht: (2025)
von: Espinosa-Dice, Nicolas, et al.
Veröffentlicht: (2025)
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective
von: Zhao, Lei, et al.
Veröffentlicht: (2023)
von: Zhao, Lei, et al.
Veröffentlicht: (2023)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
von: Liu, Wenhui, et al.
Veröffentlicht: (2025)
von: Liu, Wenhui, et al.
Veröffentlicht: (2025)
Doubly Mild Generalization for Offline Reinforcement Learning
von: Mao, Yixiu, et al.
Veröffentlicht: (2024)
von: Mao, Yixiu, et al.
Veröffentlicht: (2024)
Pre-training with Synthetic Data Helps Offline Reinforcement Learning
von: Wang, Zecheng, et al.
Veröffentlicht: (2023)
von: Wang, Zecheng, et al.
Veröffentlicht: (2023)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
von: Guo, Yihong, et al.
Veröffentlicht: (2025)
von: Guo, Yihong, et al.
Veröffentlicht: (2025)
Pessimistic Auxiliary Policy for Offline Reinforcement Learning
von: Zhang, Fan, et al.
Veröffentlicht: (2026)
von: Zhang, Fan, et al.
Veröffentlicht: (2026)
Task-Agnostic Pre-training and Task-Guided Fine-tuning for Versatile Diffusion Planner
von: Fan, Chenyou, et al.
Veröffentlicht: (2024)
von: Fan, Chenyou, et al.
Veröffentlicht: (2024)
Policy-Based Trajectory Clustering in Offline Reinforcement Learning
von: Hu, Hao, et al.
Veröffentlicht: (2025)
von: Hu, Hao, et al.
Veröffentlicht: (2025)
Compositional Conservatism: A Transductive Approach in Offline Reinforcement Learning
von: Song, Yeda, et al.
Veröffentlicht: (2024)
von: Song, Yeda, et al.
Veröffentlicht: (2024)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
von: Xu, Qiushui, et al.
Veröffentlicht: (2025)
von: Xu, Qiushui, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
von: Wang, Changhong, et al.
Veröffentlicht: (2024) -
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
von: Bai, Chenjia, et al.
Veröffentlicht: (2024) -
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2024) -
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
von: Wang, Danyang, et al.
Veröffentlicht: (2024) -
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
von: Liu, Shirong, et al.
Veröffentlicht: (2024)