Enhancing Online Reinforcement Learning with Meta-Learned Objective from Offline Data
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Deng, Shilong, Zheng, Zetao, He, Hongcai, Weng, Paul, Shao, Jie |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Imitation Learning from Suboptimal Demonstrations via Meta-Learning An Action Ranker
von: Fan, Jiangdong, et al.
Veröffentlicht: (2024)
von: Fan, Jiangdong, et al.
Veröffentlicht: (2024)
Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model
von: He, Shuncheng, et al.
Veröffentlicht: (2025)
von: He, Shuncheng, et al.
Veröffentlicht: (2025)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
von: Gireesh, Nandiraju, et al.
Veröffentlicht: (2026)
von: Gireesh, Nandiraju, et al.
Veröffentlicht: (2026)
Active Advantage-Aligned Online Reinforcement Learning with Offline Data
von: Liu, Xuefeng, et al.
Veröffentlicht: (2025)
von: Liu, Xuefeng, et al.
Veröffentlicht: (2025)
Online Pre-Training for Offline-to-Online Reinforcement Learning
von: Shin, Yongjae, et al.
Veröffentlicht: (2025)
von: Shin, Yongjae, et al.
Veröffentlicht: (2025)
Benchmarking Offline Multi-Objective Reinforcement Learning in Critical Care
von: Bansal, Aryaman, et al.
Veröffentlicht: (2025)
von: Bansal, Aryaman, et al.
Veröffentlicht: (2025)
Information-Directed Offline-to-Online Reinforcement Learning
von: Chen, Keru
Veröffentlicht: (2026)
von: Chen, Keru
Veröffentlicht: (2026)
Learning Control Policies for Variable Objectives from Offline Data
von: Weber, Marc, et al.
Veröffentlicht: (2023)
von: Weber, Marc, et al.
Veröffentlicht: (2023)
Online Bandit Learning with Offline Preference Data for Improved RLHF
von: Agnihotri, Akhil, et al.
Veröffentlicht: (2024)
von: Agnihotri, Akhil, et al.
Veröffentlicht: (2024)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
von: Zhang, Liyu, et al.
Veröffentlicht: (2024)
von: Zhang, Liyu, et al.
Veröffentlicht: (2024)
Efficient Online Reinforcement Learning Fine-Tuning Need Not Retain Offline Data
von: Zhou, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Zhou, Zhiyuan, et al.
Veröffentlicht: (2024)
Bayesian Design Principles for Offline-to-Online Reinforcement Learning
von: Hu, Hao, et al.
Veröffentlicht: (2024)
von: Hu, Hao, et al.
Veröffentlicht: (2024)
An Offline Adaptation Framework for Constrained Multi-Objective Reinforcement Learning
von: Lin, Qian, et al.
Veröffentlicht: (2024)
von: Lin, Qian, et al.
Veröffentlicht: (2024)
Optimal Perturbation Budget Allocation for Data Poisoning in Offline Reinforcement Learning
von: Qiu, Junnan, et al.
Veröffentlicht: (2025)
von: Qiu, Junnan, et al.
Veröffentlicht: (2025)
Entropy Regularized Task Representation Learning for Offline Meta-Reinforcement Learning
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024)
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024)
Online Optimization for Offline Safe Reinforcement Learning
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
The Three Regimes of Offline-to-Online Reinforcement Learning
von: Li, Lu, et al.
Veröffentlicht: (2025)
von: Li, Lu, et al.
Veröffentlicht: (2025)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
Making Offline RL Online: Collaborative World Models for Offline Visual Reinforcement Learning
von: Wang, Qi, et al.
Veröffentlicht: (2023)
von: Wang, Qi, et al.
Veröffentlicht: (2023)
Contextual Latent World Models for Offline Meta Reinforcement Learning
von: Nakheai, Mohammadreza, et al.
Veröffentlicht: (2026)
von: Nakheai, Mohammadreza, et al.
Veröffentlicht: (2026)
MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)
MOORL: A Framework for Integrating Offline-Online Reinforcement Learning
von: Chaudhary, Gaurav, et al.
Veröffentlicht: (2025)
von: Chaudhary, Gaurav, et al.
Veröffentlicht: (2025)
Energy-Guided Diffusion Sampling for Offline-to-Online Reinforcement Learning
von: Liu, Xu-Hui, et al.
Veröffentlicht: (2024)
von: Liu, Xu-Hui, et al.
Veröffentlicht: (2024)
Planning to Go Out-of-Distribution in Offline-to-Online Reinforcement Learning
von: McInroe, Trevor, et al.
Veröffentlicht: (2023)
von: McInroe, Trevor, et al.
Veröffentlicht: (2023)
Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024)
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024)
FairDICE: Fairness-Driven Offline Multi-Objective Reinforcement Learning
von: Kim, Woosung, et al.
Veröffentlicht: (2025)
von: Kim, Woosung, et al.
Veröffentlicht: (2025)
Temporal Abstraction in Reinforcement Learning with Offline Data
von: Ayyagari, Ranga Shaarad, et al.
Veröffentlicht: (2024)
von: Ayyagari, Ranga Shaarad, et al.
Veröffentlicht: (2024)
Offline Reinforcement Learning with Domain-Unlabeled Data
von: Nishimori, Soichiro, et al.
Veröffentlicht: (2024)
von: Nishimori, Soichiro, et al.
Veröffentlicht: (2024)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
von: Song, Chihyeon, et al.
Veröffentlicht: (2025)
von: Song, Chihyeon, et al.
Veröffentlicht: (2025)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
von: Zhang, Zhongjun, et al.
Veröffentlicht: (2026)
von: Zhang, Zhongjun, et al.
Veröffentlicht: (2026)
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
von: Khan, Fairoz Nower, et al.
Veröffentlicht: (2026)
von: Khan, Fairoz Nower, et al.
Veröffentlicht: (2026)
Multi-task Offline Reinforcement Learning for Online Advertising in Recommender Systems
von: Liu, Langming, et al.
Veröffentlicht: (2025)
von: Liu, Langming, et al.
Veröffentlicht: (2025)
Model-Free Robust $ϕ$-Divergence Reinforcement Learning Using Both Offline and Online Data
von: Panaganti, Kishan, et al.
Veröffentlicht: (2024)
von: Panaganti, Kishan, et al.
Veröffentlicht: (2024)
A Non-Monolithic Policy Approach of Offline-to-Online Reinforcement Learning
von: Kim, JaeYoon, et al.
Veröffentlicht: (2024)
von: Kim, JaeYoon, et al.
Veröffentlicht: (2024)
Towards Robust Offline-to-Online Reinforcement Learning via Uncertainty and Smoothness
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2023)
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2023)
Efficient and Uncertainty-Aware Diffusion Framework for Offline-to-Online Reinforcement Learning
von: Bui, Ha Manh, et al.
Veröffentlicht: (2026)
von: Bui, Ha Manh, et al.
Veröffentlicht: (2026)
Disentangling Multiplex Spatial-Temporal Transition Graph Representation Learning for Socially Enhanced POI Recommendation
von: Li, Jie, et al.
Veröffentlicht: (2025)
von: Li, Jie, et al.
Veröffentlicht: (2025)
Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation
von: Abolfazli, Amir, et al.
Veröffentlicht: (2025)
von: Abolfazli, Amir, et al.
Veröffentlicht: (2025)
PhysEDA: Physics-Aware Learning Framework for Efficient EDA With Manhattan Distance Decay
von: Yang, Zetao
Veröffentlicht: (2026)
von: Yang, Zetao
Veröffentlicht: (2026)
Guided Data Augmentation for Offline Reinforcement Learning and Imitation Learning
von: Corrado, Nicholas E., et al.
Veröffentlicht: (2023)
von: Corrado, Nicholas E., et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Imitation Learning from Suboptimal Demonstrations via Meta-Learning An Action Ranker
von: Fan, Jiangdong, et al.
Veröffentlicht: (2024) -
Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model
von: He, Shuncheng, et al.
Veröffentlicht: (2025) -
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
von: Gireesh, Nandiraju, et al.
Veröffentlicht: (2026) -
Active Advantage-Aligned Online Reinforcement Learning with Offline Data
von: Liu, Xuefeng, et al.
Veröffentlicht: (2025) -
Online Pre-Training for Offline-to-Online Reinforcement Learning
von: Shin, Yongjae, et al.
Veröffentlicht: (2025)