Improving Offline Reinforcement Learning with Inaccurate Simulators
Fuente:
arXiv
Salvato in:
| Autori principali: | Hou, Yiwen, Sun, Haoyuan, Ma, Jinming, Wu, Feng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
di: Zhao, Kai, et al.
Pubblicazione: (2023)
di: Zhao, Kai, et al.
Pubblicazione: (2023)
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
di: Huang, Xingshuai, et al.
Pubblicazione: (2024)
di: Huang, Xingshuai, et al.
Pubblicazione: (2024)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
di: Wu, Kun, et al.
Pubblicazione: (2024)
di: Wu, Kun, et al.
Pubblicazione: (2024)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
Safe Offline Reinforcement Learning with Real-Time Budget Constraints
di: Lin, Qian, et al.
Pubblicazione: (2023)
di: Lin, Qian, et al.
Pubblicazione: (2023)
Offline Reinforcement Learning with Discrete Diffusion Skills
di: Qiao, RuiXi, et al.
Pubblicazione: (2025)
di: Qiao, RuiXi, et al.
Pubblicazione: (2025)
A Clean Slate for Offline Reinforcement Learning
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2025)
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2025)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
Forecasting in Offline Reinforcement Learning for Non-stationary Environments
di: Ada, Suzan Ece, et al.
Pubblicazione: (2025)
di: Ada, Suzan Ece, et al.
Pubblicazione: (2025)
Variational OOD State Correction for Offline Reinforcement Learning
di: Jiang, Ke, et al.
Pubblicazione: (2025)
di: Jiang, Ke, et al.
Pubblicazione: (2025)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
di: Su, Huikang, et al.
Pubblicazione: (2025)
di: Su, Huikang, et al.
Pubblicazione: (2025)
Graph-Assisted Stitching for Offline Hierarchical Reinforcement Learning
di: Baek, Seungho, et al.
Pubblicazione: (2025)
di: Baek, Seungho, et al.
Pubblicazione: (2025)
Robotic Manipulation Datasets for Offline Compositional Reinforcement Learning
di: Hussing, Marcel, et al.
Pubblicazione: (2023)
di: Hussing, Marcel, et al.
Pubblicazione: (2023)
Offline Actor-Critic Reinforcement Learning Scales to Large Models
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024)
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024)
Compositional Conservatism: A Transductive Approach in Offline Reinforcement Learning
di: Song, Yeda, et al.
Pubblicazione: (2024)
di: Song, Yeda, et al.
Pubblicazione: (2024)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning
di: Sikchi, Harshit, et al.
Pubblicazione: (2023)
di: Sikchi, Harshit, et al.
Pubblicazione: (2023)
A Recipe for Stable Offline Multi-agent Reinforcement Learning
di: Lee, Dongsu, et al.
Pubblicazione: (2026)
di: Lee, Dongsu, et al.
Pubblicazione: (2026)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
di: Guo, Yihong, et al.
Pubblicazione: (2025)
di: Guo, Yihong, et al.
Pubblicazione: (2025)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
di: Pan, Minting, et al.
Pubblicazione: (2023)
di: Pan, Minting, et al.
Pubblicazione: (2023)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
di: Tang, Cheng, et al.
Pubblicazione: (2024)
di: Tang, Cheng, et al.
Pubblicazione: (2024)
Offline-to-online Reinforcement Learning for Image-based Grasping with Scarce Demonstrations
di: Chan, Bryan, et al.
Pubblicazione: (2024)
di: Chan, Bryan, et al.
Pubblicazione: (2024)
Diffusion Models for Offline Multi-agent Reinforcement Learning with Safety Constraints
di: Huang, Jianuo
Pubblicazione: (2024)
di: Huang, Jianuo
Pubblicazione: (2024)
Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach
di: Pan, Minting, et al.
Pubblicazione: (2025)
di: Pan, Minting, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Wasserstein Regularization via Optimal Transport Maps
di: Omura, Motoki, et al.
Pubblicazione: (2025)
di: Omura, Motoki, et al.
Pubblicazione: (2025)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
di: Alles, Marvin, et al.
Pubblicazione: (2025)
di: Alles, Marvin, et al.
Pubblicazione: (2025)
Using Non-Expert Data to Robustify Imitation Learning via Offline Reinforcement Learning
di: Huang, Kevin, et al.
Pubblicazione: (2025)
di: Huang, Kevin, et al.
Pubblicazione: (2025)
Real-World Offline Reinforcement Learning from Vision Language Model Feedback
di: Venkataraman, Sreyas, et al.
Pubblicazione: (2024)
di: Venkataraman, Sreyas, et al.
Pubblicazione: (2024)
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
di: Nguyen, Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Thanh, et al.
Pubblicazione: (2024)
CtRL-Sim: Reactive and Controllable Driving Agents with Offline Reinforcement Learning
di: Rowe, Luke, et al.
Pubblicazione: (2024)
di: Rowe, Luke, et al.
Pubblicazione: (2024)
Localized Dynamics-Aware Domain Adaption for Off-Dynamics Offline Reinforcement Learning
di: Xia, Zhangjie, et al.
Pubblicazione: (2026)
di: Xia, Zhangjie, et al.
Pubblicazione: (2026)
Offline Reinforcement Learning of High-Quality Behaviors Under Robust Style Alignment
di: Petitbois, Mathieu, et al.
Pubblicazione: (2026)
di: Petitbois, Mathieu, et al.
Pubblicazione: (2026)
Temporal Distance-aware Transition Augmentation for Offline Model-based Reinforcement Learning
di: Lee, Dongsu, et al.
Pubblicazione: (2025)
di: Lee, Dongsu, et al.
Pubblicazione: (2025)
Beyond Hard Constraints: Budget-Conditioned Reachability For Safe Offline Reinforcement Learning
di: Brahmanage, Janaka Chathuranga, et al.
Pubblicazione: (2026)
di: Brahmanage, Janaka Chathuranga, et al.
Pubblicazione: (2026)
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
di: Lin, Haohong, et al.
Pubblicazione: (2023)
di: Lin, Haohong, et al.
Pubblicazione: (2023)
Training and Simulation of Quadrupedal Robot in Adaptive Stair Climbing for Indoor Firefighting: An End-to-End Reinforcement Learning Approach
di: Huang, Baixiao, et al.
Pubblicazione: (2026)
di: Huang, Baixiao, et al.
Pubblicazione: (2026)
COSBO: Conservative Offline Simulation-Based Policy Optimization
di: Kargar, Eshagh, et al.
Pubblicazione: (2024)
di: Kargar, Eshagh, et al.
Pubblicazione: (2024)
Failure-Aware RL: Reliable Offline-to-Online Reinforcement Learning with Self-Recovery for Real-World Manipulation
di: Li, Huanyu, et al.
Pubblicazione: (2026)
di: Li, Huanyu, et al.
Pubblicazione: (2026)
Consistency Trajectory Planning: High-Quality and Efficient Trajectory Optimization for Offline Model-Based Reinforcement Learning
di: Wang, Guanquan, et al.
Pubblicazione: (2025)
di: Wang, Guanquan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
di: Zhao, Kai, et al.
Pubblicazione: (2023) -
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
di: Huang, Xingshuai, et al.
Pubblicazione: (2024) -
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
di: Wu, Kun, et al.
Pubblicazione: (2024) -
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
di: Ma, Yunchang, et al.
Pubblicazione: (2025) -
Safe Offline Reinforcement Learning with Real-Time Budget Constraints
di: Lin, Qian, et al.
Pubblicazione: (2023)