Pre-training with Synthetic Data Helps Offline Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Zecheng, Wang, Che, Dong, Zixuan, Ross, Keith |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?
di: Omori, Yumi, et al.
Pubblicazione: (2025)
di: Omori, Yumi, et al.
Pubblicazione: (2025)
On the Convergence of Monte Carlo UCB for Random-Length Episodic MDPs
di: Dong, Zixuan, et al.
Pubblicazione: (2022)
di: Dong, Zixuan, et al.
Pubblicazione: (2022)
Is Optimal Transport Necessary for Inverse Reinforcement Learning?
di: Dong, Zixuan, et al.
Pubblicazione: (2025)
di: Dong, Zixuan, et al.
Pubblicazione: (2025)
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
di: Wang, Danyang, et al.
Pubblicazione: (2024)
di: Wang, Danyang, et al.
Pubblicazione: (2024)
Relational In-Context Learning via Synthetic Pre-training with Structural Prior
di: Wang, Yanbo, et al.
Pubblicazione: (2026)
di: Wang, Yanbo, et al.
Pubblicazione: (2026)
Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data
di: Madhow, Sunil, et al.
Pubblicazione: (2023)
di: Madhow, Sunil, et al.
Pubblicazione: (2023)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
di: Wen, Xiaoyu, et al.
Pubblicazione: (2024)
di: Wen, Xiaoyu, et al.
Pubblicazione: (2024)
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
di: Xu, Jiawei, et al.
Pubblicazione: (2024)
di: Xu, Jiawei, et al.
Pubblicazione: (2024)
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
di: Xiao, Wei, et al.
Pubblicazione: (2025)
di: Xiao, Wei, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Generative Trajectory Policies
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
The Prevalence of Neural Collapse in Neural Multivariate Regression
di: Andriopoulos, George, et al.
Pubblicazione: (2024)
di: Andriopoulos, George, et al.
Pubblicazione: (2024)
On the Statistical Complexity for Offline and Low-Adaptive Reinforcement Learning with Structures
di: Yin, Ming, et al.
Pubblicazione: (2025)
di: Yin, Ming, et al.
Pubblicazione: (2025)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
Doubly Mild Generalization for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
Safe Offline Reinforcement Learning with Real-Time Budget Constraints
di: Lin, Qian, et al.
Pubblicazione: (2023)
di: Lin, Qian, et al.
Pubblicazione: (2023)
MOTO: Offline Pre-training to Online Fine-tuning for Model-based Robot Learning
di: Rafailov, Rafael, et al.
Pubblicazione: (2024)
di: Rafailov, Rafael, et al.
Pubblicazione: (2024)
IPD: Boosting Sequential Policy with Imaginary Planning Distillation in Offline Reinforcement Learning
di: Qin, Yihao, et al.
Pubblicazione: (2026)
di: Qin, Yihao, et al.
Pubblicazione: (2026)
Policy-Based Trajectory Clustering in Offline Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2025)
di: Hu, Hao, et al.
Pubblicazione: (2025)
Cross-domain Random Pre-training with Prototypes for Reinforcement Learning
di: Liu, Xin, et al.
Pubblicazione: (2023)
di: Liu, Xin, et al.
Pubblicazione: (2023)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2025)
di: Mao, Yixiu, et al.
Pubblicazione: (2025)
Theoretical Analysis of Meta Reinforcement Learning: Generalization Bounds and Convergence Guarantees
di: Wang, Cangqing, et al.
Pubblicazione: (2024)
di: Wang, Cangqing, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning: Role of State Aggregation and Trajectory Data
di: Jia, Zeyu, et al.
Pubblicazione: (2024)
di: Jia, Zeyu, et al.
Pubblicazione: (2024)
FOVA: Offline Federated Reinforcement Learning with Mixed-Quality Data
di: Qiao, Nan, et al.
Pubblicazione: (2025)
di: Qiao, Nan, et al.
Pubblicazione: (2025)
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation
di: Cao, Hongye, et al.
Pubblicazione: (2025)
di: Cao, Hongye, et al.
Pubblicazione: (2025)
Uncertainty-based Offline Variational Bayesian Reinforcement Learning for Robustness under Diverse Data Corruptions
di: Yang, Rui, et al.
Pubblicazione: (2024)
di: Yang, Rui, et al.
Pubblicazione: (2024)
Provable Zero-Shot Generalization in Offline Reinforcement Learning
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
di: Wang, Changhong, et al.
Pubblicazione: (2024)
di: Wang, Changhong, et al.
Pubblicazione: (2024)
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
di: Huang, Xingshuai, et al.
Pubblicazione: (2024)
di: Huang, Xingshuai, et al.
Pubblicazione: (2024)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
di: Yang, Letian, et al.
Pubblicazione: (2026)
di: Yang, Letian, et al.
Pubblicazione: (2026)
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning
di: Chen, Xuyang, et al.
Pubblicazione: (2025)
di: Chen, Xuyang, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning for LLM Multi-Step Reasoning
di: Wang, Huaijie, et al.
Pubblicazione: (2024)
di: Wang, Huaijie, et al.
Pubblicazione: (2024)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
di: Wu, Kun, et al.
Pubblicazione: (2024)
di: Wu, Kun, et al.
Pubblicazione: (2024)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
di: Yang, Rui, et al.
Pubblicazione: (2023)
di: Yang, Rui, et al.
Pubblicazione: (2023)
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
Knockoff-Guided Feature Selection via A Single Pre-trained Reinforced Agent
di: Wang, Xinyuan, et al.
Pubblicazione: (2024)
di: Wang, Xinyuan, et al.
Pubblicazione: (2024)
GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models
di: Wang, Mianchu, et al.
Pubblicazione: (2023)
di: Wang, Mianchu, et al.
Pubblicazione: (2023)
Diffusion Policies creating a Trust Region for Offline Reinforcement Learning
di: Chen, Tianyu, et al.
Pubblicazione: (2024)
di: Chen, Tianyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?
di: Omori, Yumi, et al.
Pubblicazione: (2025) -
On the Convergence of Monte Carlo UCB for Random-Length Episodic MDPs
di: Dong, Zixuan, et al.
Pubblicazione: (2022) -
Is Optimal Transport Necessary for Inverse Reinforcement Learning?
di: Dong, Zixuan, et al.
Pubblicazione: (2025) -
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
di: Wang, Danyang, et al.
Pubblicazione: (2024) -
Relational In-Context Learning via Synthetic Pre-training with Structural Prior
di: Wang, Yanbo, et al.
Pubblicazione: (2026)