Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Nakhaei, Mohammadreza, Scannell, Aidan, Pajarinen, Joni |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Entropy Regularized Task Representation Learning for Offline Meta-Reinforcement Learning
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024)
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024)
Contextual Latent World Models for Offline Meta Reinforcement Learning
von: Nakheai, Mohammadreza, et al.
Veröffentlicht: (2026)
von: Nakheai, Mohammadreza, et al.
Veröffentlicht: (2026)
iQRL -- Implicitly Quantized Representations for Sample-efficient Reinforcement Learning
von: Scannell, Aidan, et al.
Veröffentlicht: (2024)
von: Scannell, Aidan, et al.
Veröffentlicht: (2024)
Efficient Reinforcement Learning by Guiding Generalist World Models with Non-Curated Data
von: Zhao, Yi, et al.
Veröffentlicht: (2025)
von: Zhao, Yi, et al.
Veröffentlicht: (2025)
Discrete Codebook World Models for Continuous Control
von: Scannell, Aidan, et al.
Veröffentlicht: (2025)
von: Scannell, Aidan, et al.
Veröffentlicht: (2025)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
von: Gireesh, Nandiraju, et al.
Veröffentlicht: (2026)
von: Gireesh, Nandiraju, et al.
Veröffentlicht: (2026)
Function-space Parameterization of Neural Networks for Sequential Learning
von: Scannell, Aidan, et al.
Veröffentlicht: (2024)
von: Scannell, Aidan, et al.
Veröffentlicht: (2024)
Reachability Weighted Offline Goal-conditioned Resampling
von: Yang, Wenyan, et al.
Veröffentlicht: (2025)
von: Yang, Wenyan, et al.
Veröffentlicht: (2025)
Manipulate-to-Navigate: Reinforcement Learning with Visual Affordances and Manipulability Priors
von: Zhang, Yuying, et al.
Veröffentlicht: (2025)
von: Zhang, Yuying, et al.
Veröffentlicht: (2025)
Equivariant Offline Reinforcement Learning
von: Tangri, Arsh, et al.
Veröffentlicht: (2024)
von: Tangri, Arsh, et al.
Veröffentlicht: (2024)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
Controllable Generative Trajectory Prediction via Weak Preference Alignment
von: Cao, Yongxi, et al.
Veröffentlicht: (2025)
von: Cao, Yongxi, et al.
Veröffentlicht: (2025)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
von: Liu, Tenglong, et al.
Veröffentlicht: (2024)
von: Liu, Tenglong, et al.
Veröffentlicht: (2024)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
von: Wu, Kun, et al.
Veröffentlicht: (2024)
von: Wu, Kun, et al.
Veröffentlicht: (2024)
Guided Data Augmentation for Offline Reinforcement Learning and Imitation Learning
von: Corrado, Nicholas E., et al.
Veröffentlicht: (2023)
von: Corrado, Nicholas E., et al.
Veröffentlicht: (2023)
Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization
von: Lei, Kun, et al.
Veröffentlicht: (2023)
von: Lei, Kun, et al.
Veröffentlicht: (2023)
Trajectory-Level Data Augmentation for Offline Reinforcement Learning
von: Schmähling, Tobias, et al.
Veröffentlicht: (2026)
von: Schmähling, Tobias, et al.
Veröffentlicht: (2026)
Hierarchical Reinforcement Learning with Uncertainty-Guided Diffusional Subgoals
von: Wang, Vivienne Huiling, et al.
Veröffentlicht: (2025)
von: Wang, Vivienne Huiling, et al.
Veröffentlicht: (2025)
ROER: Regularized Optimal Experience Replay
von: Li, Changling, et al.
Veröffentlicht: (2024)
von: Li, Changling, et al.
Veröffentlicht: (2024)
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning
von: Yan, Teng, et al.
Veröffentlicht: (2024)
von: Yan, Teng, et al.
Veröffentlicht: (2024)
A Real-World Quadrupedal Locomotion Benchmark for Offline Reinforcement Learning
von: Zhang, Hongyin, et al.
Veröffentlicht: (2023)
von: Zhang, Hongyin, et al.
Veröffentlicht: (2023)
MoRe-ERL: Learning Motion Residuals using Episodic Reinforcement Learning
von: Huang, Xi, et al.
Veröffentlicht: (2025)
von: Huang, Xi, et al.
Veröffentlicht: (2025)
Improving Offline Reinforcement Learning with Inaccurate Simulators
von: Hou, Yiwen, et al.
Veröffentlicht: (2024)
von: Hou, Yiwen, et al.
Veröffentlicht: (2024)
Offline Reinforcement Learning with Discrete Diffusion Skills
von: Qiao, RuiXi, et al.
Veröffentlicht: (2025)
von: Qiao, RuiXi, et al.
Veröffentlicht: (2025)
A Clean Slate for Offline Reinforcement Learning
von: Jackson, Matthew Thomas, et al.
Veröffentlicht: (2025)
von: Jackson, Matthew Thomas, et al.
Veröffentlicht: (2025)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
von: Li, Mingxuan, et al.
Veröffentlicht: (2026)
von: Li, Mingxuan, et al.
Veröffentlicht: (2026)
EnCoMP: Enhanced Covert Maneuver Planning with Adaptive Threat-Aware Visibility Estimation using Offline Reinforcement Learning
von: Hossain, Jumman, et al.
Veröffentlicht: (2024)
von: Hossain, Jumman, et al.
Veröffentlicht: (2024)
Continuous Monte Carlo Graph Search
von: Kujanpää, Kalle, et al.
Veröffentlicht: (2022)
von: Kujanpää, Kalle, et al.
Veröffentlicht: (2022)
Failure-Aware RL: Reliable Offline-to-Online Reinforcement Learning with Self-Recovery for Real-World Manipulation
von: Li, Huanyu, et al.
Veröffentlicht: (2026)
von: Li, Huanyu, et al.
Veröffentlicht: (2026)
Filtering Learning Histories Enhances In-Context Reinforcement Learning
von: Chen, Weiqin, et al.
Veröffentlicht: (2025)
von: Chen, Weiqin, et al.
Veröffentlicht: (2025)
Robustness Evaluation of Offline Reinforcement Learning for Robot Control Against Action Perturbations
von: Ayabe, Shingo, et al.
Veröffentlicht: (2024)
von: Ayabe, Shingo, et al.
Veröffentlicht: (2024)
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
von: Huang, Xingshuai, et al.
Veröffentlicht: (2024)
von: Huang, Xingshuai, et al.
Veröffentlicht: (2024)
Forecasting in Offline Reinforcement Learning for Non-stationary Environments
von: Ada, Suzan Ece, et al.
Veröffentlicht: (2025)
von: Ada, Suzan Ece, et al.
Veröffentlicht: (2025)
Variational OOD State Correction for Offline Reinforcement Learning
von: Jiang, Ke, et al.
Veröffentlicht: (2025)
von: Jiang, Ke, et al.
Veröffentlicht: (2025)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
von: Su, Huikang, et al.
Veröffentlicht: (2025)
von: Su, Huikang, et al.
Veröffentlicht: (2025)
Graph-Assisted Stitching for Offline Hierarchical Reinforcement Learning
von: Baek, Seungho, et al.
Veröffentlicht: (2025)
von: Baek, Seungho, et al.
Veröffentlicht: (2025)
Robotic Manipulation Datasets for Offline Compositional Reinforcement Learning
von: Hussing, Marcel, et al.
Veröffentlicht: (2023)
von: Hussing, Marcel, et al.
Veröffentlicht: (2023)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026)
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026)
Beyond Non-Expert Demonstrations: Outcome-Driven Action Constraint for Offline Reinforcement Learning
von: Jiang, Ke, et al.
Veröffentlicht: (2025)
von: Jiang, Ke, et al.
Veröffentlicht: (2025)
ARBoids: Adaptive Residual Reinforcement Learning With Boids Model for Cooperative Multi-USV Target Defense
von: Tao, Jiyue, et al.
Veröffentlicht: (2025)
von: Tao, Jiyue, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Entropy Regularized Task Representation Learning for Offline Meta-Reinforcement Learning
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024) -
Contextual Latent World Models for Offline Meta Reinforcement Learning
von: Nakheai, Mohammadreza, et al.
Veröffentlicht: (2026) -
iQRL -- Implicitly Quantized Representations for Sample-efficient Reinforcement Learning
von: Scannell, Aidan, et al.
Veröffentlicht: (2024) -
Efficient Reinforcement Learning by Guiding Generalist World Models with Non-Curated Data
von: Zhao, Yi, et al.
Veröffentlicht: (2025) -
Discrete Codebook World Models for Continuous Control
von: Scannell, Aidan, et al.
Veröffentlicht: (2025)