Offline Reinforcement Learning with Imbalanced Datasets
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Li, Cheng, Sijie, Qiu, Jielin, Xu, Haoran, Chan, Wai Kin, Ding, Zhao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Dataset Distillation for Offline Reinforcement Learning
por: Light, Jonathan, et al.
Publicado: (2024)
por: Light, Jonathan, et al.
Publicado: (2024)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
por: Yang, Yiqin, et al.
Publicado: (2026)
por: Yang, Yiqin, et al.
Publicado: (2026)
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
por: Mao, Liyuan, et al.
Publicado: (2024)
por: Mao, Liyuan, et al.
Publicado: (2024)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
por: Xu, Qiushui, et al.
Publicado: (2025)
por: Xu, Qiushui, et al.
Publicado: (2025)
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
por: Liu, Zeyuan, et al.
Publicado: (2025)
por: Liu, Zeyuan, et al.
Publicado: (2025)
In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
por: Tu, Songjun, et al.
Publicado: (2024)
por: Tu, Songjun, et al.
Publicado: (2024)
BECAUSE: Bilinear Causal Representation for Generalizable Offline Model-based Reinforcement Learning
por: Lin, Haohong, et al.
Publicado: (2024)
por: Lin, Haohong, et al.
Publicado: (2024)
BAFFLE: Hiding Backdoors in Offline Reinforcement Learning Datasets
por: Gong, Chen, et al.
Publicado: (2022)
por: Gong, Chen, et al.
Publicado: (2022)
Offline Trajectory Optimization for Offline Reinforcement Learning
por: Zhao, Ziqi, et al.
Publicado: (2024)
por: Zhao, Ziqi, et al.
Publicado: (2024)
Offline Reinforcement Learning from Datasets with Structured Non-Stationarity
por: Ackermann, Johannes, et al.
Publicado: (2024)
por: Ackermann, Johannes, et al.
Publicado: (2024)
The Generalization Gap in Offline Reinforcement Learning
por: Mediratta, Ishita, et al.
Publicado: (2023)
por: Mediratta, Ishita, et al.
Publicado: (2023)
Robotic Manipulation Datasets for Offline Compositional Reinforcement Learning
por: Hussing, Marcel, et al.
Publicado: (2023)
por: Hussing, Marcel, et al.
Publicado: (2023)
Learning from Sparse Offline Datasets via Conservative Density Estimation
por: Cen, Zhepeng, et al.
Publicado: (2024)
por: Cen, Zhepeng, et al.
Publicado: (2024)
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
por: Xu, Jiawei, et al.
Publicado: (2024)
por: Xu, Jiawei, et al.
Publicado: (2024)
Solving Continual Offline Reinforcement Learning with Decision Transformer
por: Huang, Kaixin, et al.
Publicado: (2024)
por: Huang, Kaixin, et al.
Publicado: (2024)
Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions
por: Xu, Yinglun, et al.
Publicado: (2023)
por: Xu, Yinglun, et al.
Publicado: (2023)
Doubly Mild Generalization for Offline Reinforcement Learning
por: Mao, Yixiu, et al.
Publicado: (2024)
por: Mao, Yixiu, et al.
Publicado: (2024)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
por: Tang, Cheng, et al.
Publicado: (2024)
por: Tang, Cheng, et al.
Publicado: (2024)
Offline-to-online Reinforcement Learning for Image-based Grasping with Scarce Demonstrations
por: Chan, Bryan, et al.
Publicado: (2024)
por: Chan, Bryan, et al.
Publicado: (2024)
Variational OOD State Correction for Offline Reinforcement Learning
por: Jiang, Ke, et al.
Publicado: (2025)
por: Jiang, Ke, et al.
Publicado: (2025)
Offline Reinforcement Learning in Large State Spaces: Algorithms and Guarantees
por: Jiang, Nan, et al.
Publicado: (2025)
por: Jiang, Nan, et al.
Publicado: (2025)
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
por: Lin, Haohong, et al.
Publicado: (2023)
por: Lin, Haohong, et al.
Publicado: (2023)
Reinforcement Learning with Promising Tokens for Large Language Models
por: Pang, Jing-Cheng, et al.
Publicado: (2026)
por: Pang, Jing-Cheng, et al.
Publicado: (2026)
Mutual Information Regularized Offline Reinforcement Learning
por: Ma, Xiao, et al.
Publicado: (2022)
por: Ma, Xiao, et al.
Publicado: (2022)
KAN v.s. MLP for Offline Reinforcement Learning
por: Guo, Haihong, et al.
Publicado: (2024)
por: Guo, Haihong, et al.
Publicado: (2024)
Hokoff: Real Game Dataset from Honor of Kings and its Offline Reinforcement Learning Benchmarks
por: Qu, Yun, et al.
Publicado: (2024)
por: Qu, Yun, et al.
Publicado: (2024)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
por: Huang, Xiao, et al.
Publicado: (2025)
por: Huang, Xiao, et al.
Publicado: (2025)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
por: Zhang, Tianle, et al.
Publicado: (2024)
por: Zhang, Tianle, et al.
Publicado: (2024)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
por: Lyu, Jiafei, et al.
Publicado: (2022)
por: Lyu, Jiafei, et al.
Publicado: (2022)
The Three Regimes of Offline-to-Online Reinforcement Learning
por: Li, Lu, et al.
Publicado: (2025)
por: Li, Lu, et al.
Publicado: (2025)
Offline Reinforcement Learning with Discrete Diffusion Skills
por: Qiao, RuiXi, et al.
Publicado: (2025)
por: Qiao, RuiXi, et al.
Publicado: (2025)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
por: Liu, Zongkai, et al.
Publicado: (2024)
por: Liu, Zongkai, et al.
Publicado: (2024)
Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning
por: He, Jinmin, et al.
Publicado: (2025)
por: He, Jinmin, et al.
Publicado: (2025)
When to Trust Your Simulator: Dynamics-Aware Hybrid Offline-and-Online Reinforcement Learning
por: Niu, Haoyi, et al.
Publicado: (2022)
por: Niu, Haoyi, et al.
Publicado: (2022)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
por: Zhang, Liyu, et al.
Publicado: (2024)
por: Zhang, Liyu, et al.
Publicado: (2024)
Imbalance in Regression Datasets
por: Kowatsch, Daniel, et al.
Publicado: (2024)
por: Kowatsch, Daniel, et al.
Publicado: (2024)
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning
por: Chen, Xuyang, et al.
Publicado: (2025)
por: Chen, Xuyang, et al.
Publicado: (2025)
Preserve Support, Not Correspondence: Dynamic Routing for Offline Reinforcement Learning
por: Mu, Zhancun, et al.
Publicado: (2026)
por: Mu, Zhancun, et al.
Publicado: (2026)
Preference Elicitation for Offline Reinforcement Learning
por: Pace, Alizée, et al.
Publicado: (2024)
por: Pace, Alizée, et al.
Publicado: (2024)
Simple Ingredients for Offline Reinforcement Learning
por: Cetin, Edoardo, et al.
Publicado: (2024)
por: Cetin, Edoardo, et al.
Publicado: (2024)
Ejemplares similares
-
Dataset Distillation for Offline Reinforcement Learning
por: Light, Jonathan, et al.
Publicado: (2024) -
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
por: Yang, Yiqin, et al.
Publicado: (2026) -
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
por: Mao, Liyuan, et al.
Publicado: (2024) -
In-Context Compositional Q-Learning for Offline Reinforcement Learning
por: Xu, Qiushui, et al.
Publicado: (2025) -
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
por: Liu, Zeyuan, et al.
Publicado: (2025)