Planning to Go Out-of-Distribution in Offline-to-Online Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | McInroe, Trevor, Jelley, Adam, Albrecht, Stefano V., Storkey, Amos |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficient Offline Reinforcement Learning: First Imitate, then Improve
par: Jelley, Adam, et autres
Publié: (2024)
par: Jelley, Adam, et autres
Publié: (2024)
Object-Centric World Models from Few-Shot Annotations for Sample-Efficient Reinforcement Learning
par: Zhang, Weipu, et autres
Publié: (2025)
par: Zhang, Weipu, et autres
Publié: (2025)
Multi-Horizon Representations with Hierarchical Forward Models for Reinforcement Learning
par: McInroe, Trevor, et autres
Publié: (2022)
par: McInroe, Trevor, et autres
Publié: (2022)
LLM-Personalize: Aligning LLM Planners with Human Preferences via Reinforced Self-Training for Housekeeping Robots
par: Han, Dongge, et autres
Publié: (2024)
par: Han, Dongge, et autres
Publié: (2024)
PixelBrax: Learning Continuous Control from Pixels End-to-End on the GPU
par: McInroe, Trevor, et autres
Publié: (2025)
par: McInroe, Trevor, et autres
Publié: (2025)
Forgetting is Everywhere
par: Sanati, Ben, et autres
Publié: (2025)
par: Sanati, Ben, et autres
Publié: (2025)
Studying the Interplay Between the Actor and Critic Representations in Reinforcement Learning
par: Garcin, Samuel, et autres
Publié: (2025)
par: Garcin, Samuel, et autres
Publié: (2025)
Enhancing Tactile-based Reinforcement Learning for Robotic Control
par: Miller, Elle, et autres
Publié: (2025)
par: Miller, Elle, et autres
Publié: (2025)
CODA: Coordination via On-Policy Diffusion for Multi-Agent Offline Reinforcement Learning
par: Hedman, Marcel, et autres
Publié: (2026)
par: Hedman, Marcel, et autres
Publié: (2026)
Terra Nova: A Comprehensive Challenge Environment for Intelligent Agents
par: McInroe, Trevor
Publié: (2025)
par: McInroe, Trevor
Publié: (2025)
Assistax: A Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics
par: Hinckeldey, Leonard, et autres
Publié: (2025)
par: Hinckeldey, Leonard, et autres
Publié: (2025)
Aligning Agents like Large Language Models
par: Jelley, Adam, et autres
Publié: (2024)
par: Jelley, Adam, et autres
Publié: (2024)
Chunking: Continual Learning is not just about Distribution Shift
par: Lee, Thomas L., et autres
Publié: (2023)
par: Lee, Thomas L., et autres
Publié: (2023)
Rationality Measurement and Theory for Reinforcement Learning Agents
par: Qian, Kejiang, et autres
Publié: (2026)
par: Qian, Kejiang, et autres
Publié: (2026)
Diffusion for World Modeling: Visual Details Matter in Atari
par: Alonso, Eloi, et autres
Publié: (2024)
par: Alonso, Eloi, et autres
Publié: (2024)
HyperMARL: Adaptive Hypernetworks for Multi-Agent RL
par: Tessera, Kale-ab Abebe, et autres
Publié: (2024)
par: Tessera, Kale-ab Abebe, et autres
Publié: (2024)
Label Noise: Correcting the Forward-Correction
par: Toner, William, et autres
Publié: (2023)
par: Toner, William, et autres
Publié: (2023)
Noisy Early Stopping for Noisy Labels
par: Toner, William, et autres
Publié: (2024)
par: Toner, William, et autres
Publié: (2024)
roto 2.0: The Robot Tactile Olympiad
par: Miller, Elle, et autres
Publié: (2026)
par: Miller, Elle, et autres
Publié: (2026)
Approximate Bayesian Class-Conditional Models under Continuous Representation Shift
par: Lee, Thomas L., et autres
Publié: (2023)
par: Lee, Thomas L., et autres
Publié: (2023)
Using Offline Data to Speed Up Reinforcement Learning in Procedurally Generated Environments
par: Andres, Alain, et autres
Publié: (2023)
par: Andres, Alain, et autres
Publié: (2023)
Adversarial robustness of VAEs through the lens of local geometry
par: Khan, Asif, et autres
Publié: (2022)
par: Khan, Asif, et autres
Publié: (2022)
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning
par: Ada, Suzan Ece, et autres
Publié: (2023)
par: Ada, Suzan Ece, et autres
Publié: (2023)
Online Pre-Training for Offline-to-Online Reinforcement Learning
par: Shin, Yongjae, et autres
Publié: (2025)
par: Shin, Yongjae, et autres
Publié: (2025)
Adapting Time Series Foundation Models through Data Mixtures
par: Lee, Thomas L., et autres
Publié: (2026)
par: Lee, Thomas L., et autres
Publié: (2026)
Information-Directed Offline-to-Online Reinforcement Learning
par: Chen, Keru
Publié: (2026)
par: Chen, Keru
Publié: (2026)
Model-Free Robust $ϕ$-Divergence Reinforcement Learning Using Both Offline and Online Data
par: Panaganti, Kishan, et autres
Publié: (2024)
par: Panaganti, Kishan, et autres
Publié: (2024)
Multi-view Disentanglement for Reinforcement Learning with Multiple Cameras
par: Dunion, Mhairi, et autres
Publié: (2024)
par: Dunion, Mhairi, et autres
Publié: (2024)
Beyond Penalization: Diffusion-based Out-of-Distribution Detection and Selective Regularization in Offline Reinforcement Learning
par: Wang, Qingjun, et autres
Publié: (2026)
par: Wang, Qingjun, et autres
Publié: (2026)
Bayesian Design Principles for Offline-to-Online Reinforcement Learning
par: Hu, Hao, et autres
Publié: (2024)
par: Hu, Hao, et autres
Publié: (2024)
Prior-Guided Diffusion Planning for Offline Reinforcement Learning
par: Ki, Donghyeon, et autres
Publié: (2025)
par: Ki, Donghyeon, et autres
Publié: (2025)
Meta-Adaptive Prompt Distillation for Few-Shot Visual Question Answering
par: Gupta, Akash, et autres
Publié: (2025)
par: Gupta, Akash, et autres
Publié: (2025)
Making Offline RL Online: Collaborative World Models for Offline Visual Reinforcement Learning
par: Wang, Qi, et autres
Publié: (2023)
par: Wang, Qi, et autres
Publié: (2023)
Online Optimization for Offline Safe Reinforcement Learning
par: Chemingui, Yassine, et autres
Publié: (2025)
par: Chemingui, Yassine, et autres
Publié: (2025)
The Three Regimes of Offline-to-Online Reinforcement Learning
par: Li, Lu, et autres
Publié: (2025)
par: Li, Lu, et autres
Publié: (2025)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
par: Gireesh, Nandiraju, et autres
Publié: (2026)
par: Gireesh, Nandiraju, et autres
Publié: (2026)
Few-Shot Learning with Class Imbalance
par: Ochal, Mateusz, et autres
Publié: (2021)
par: Ochal, Mateusz, et autres
Publié: (2021)
Hyperparameter Selection in Continual Learning
par: Lee, Thomas L., et autres
Publié: (2024)
par: Lee, Thomas L., et autres
Publié: (2024)
Energy-Guided Diffusion Sampling for Offline-to-Online Reinforcement Learning
par: Liu, Xu-Hui, et autres
Publié: (2024)
par: Liu, Xu-Hui, et autres
Publié: (2024)
Active Advantage-Aligned Online Reinforcement Learning with Offline Data
par: Liu, Xuefeng, et autres
Publié: (2025)
par: Liu, Xuefeng, et autres
Publié: (2025)
Documents similaires
-
Efficient Offline Reinforcement Learning: First Imitate, then Improve
par: Jelley, Adam, et autres
Publié: (2024) -
Object-Centric World Models from Few-Shot Annotations for Sample-Efficient Reinforcement Learning
par: Zhang, Weipu, et autres
Publié: (2025) -
Multi-Horizon Representations with Hierarchical Forward Models for Reinforcement Learning
par: McInroe, Trevor, et autres
Publié: (2022) -
LLM-Personalize: Aligning LLM Planners with Human Preferences via Reinforced Self-Training for Housekeeping Robots
par: Han, Dongge, et autres
Publié: (2024) -
PixelBrax: Learning Continuous Control from Pixels End-to-End on the GPU
par: McInroe, Trevor, et autres
Publié: (2025)