A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Guo, Siyuan, Sun, Yanchao, Hu, Jifeng, Huang, Sili, Chen, Hechang, Piao, Haiyin, Sun, Lichao, Chang, Yi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
por: Hu, Jifeng, et al.
Publicado: (2025)
por: Hu, Jifeng, et al.
Publicado: (2025)
Continual Diffuser (CoD): Mastering Continual Offline Reinforcement Learning with Experience Rehearsal
por: Hu, Jifeng, et al.
Publicado: (2024)
por: Hu, Jifeng, et al.
Publicado: (2024)
In-Context Decision Transformer: Reinforcement Learning via Hierarchical Chain-of-Thought
por: Huang, Sili, et al.
Publicado: (2024)
por: Huang, Sili, et al.
Publicado: (2024)
Decision Flow Policy Optimization
por: Hu, Jifeng, et al.
Publicado: (2025)
por: Hu, Jifeng, et al.
Publicado: (2025)
Solving Continual Offline RL through Selective Weights Activation on Aligned Spaces
por: Hu, Jifeng, et al.
Publicado: (2024)
por: Hu, Jifeng, et al.
Publicado: (2024)
Decision Mamba: Reinforcement Learning via Hybrid Selective Sequence Modeling
por: Huang, Sili, et al.
Publicado: (2024)
por: Huang, Sili, et al.
Publicado: (2024)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
por: Chen, Rufeng, et al.
Publicado: (2026)
por: Chen, Rufeng, et al.
Publicado: (2026)
The Three Regimes of Offline-to-Online Reinforcement Learning
por: Li, Lu, et al.
Publicado: (2025)
por: Li, Lu, et al.
Publicado: (2025)
CASCADE: Case-Based Continual Adaptation for Large Language Models During Deployment
por: Guo, Siyuan, et al.
Publicado: (2026)
por: Guo, Siyuan, et al.
Publicado: (2026)
Simple Ingredients for Offline Reinforcement Learning
por: Cetin, Edoardo, et al.
Publicado: (2024)
por: Cetin, Edoardo, et al.
Publicado: (2024)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
por: Zhang, Liyu, et al.
Publicado: (2024)
por: Zhang, Liyu, et al.
Publicado: (2024)
Phasic Diversity Optimization for Population-Based Reinforcement Learning
por: Jiang, Jingcheng, et al.
Publicado: (2024)
por: Jiang, Jingcheng, et al.
Publicado: (2024)
Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration
por: Zhong, Hai, et al.
Publicado: (2024)
por: Zhong, Hai, et al.
Publicado: (2024)
Coordinating Ride-Pooling with Public Transit using Reward-Guided Conservative Q-Learning: An Offline Training and Online Fine-Tuning Reinforcement Learning Framework
por: Hu, Yulong, et al.
Publicado: (2025)
por: Hu, Yulong, et al.
Publicado: (2025)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
por: Huang, Xiao, et al.
Publicado: (2025)
por: Huang, Xiao, et al.
Publicado: (2025)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
por: Zhao, Kai, et al.
Publicado: (2023)
por: Zhao, Kai, et al.
Publicado: (2023)
Online Optimization for Offline Safe Reinforcement Learning
por: Chemingui, Yassine, et al.
Publicado: (2025)
por: Chemingui, Yassine, et al.
Publicado: (2025)
Policy Expansion for Bridging Offline-to-Online Reinforcement Learning
por: Zhang, Haichao, et al.
Publicado: (2023)
por: Zhang, Haichao, et al.
Publicado: (2023)
RLSynC: Offline-Online Reinforcement Learning for Synthon Completion
por: Baker, Frazier N., et al.
Publicado: (2023)
por: Baker, Frazier N., et al.
Publicado: (2023)
Grid-Mapping Pseudo-Count Constraint for Offline Reinforcement Learning
por: Shen, Yi, et al.
Publicado: (2024)
por: Shen, Yi, et al.
Publicado: (2024)
Sparsity-based Safety Conservatism for Constrained Offline Reinforcement Learning
por: Cho, Minjae, et al.
Publicado: (2024)
por: Cho, Minjae, et al.
Publicado: (2024)
OGER: A Robust Offline-Guided Exploration Reward for Hybrid Reinforcement Learning
por: Ma, Xinyu, et al.
Publicado: (2026)
por: Ma, Xinyu, et al.
Publicado: (2026)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
por: Song, Chihyeon, et al.
Publicado: (2025)
por: Song, Chihyeon, et al.
Publicado: (2025)
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
por: Khan, Fairoz Nower, et al.
Publicado: (2026)
por: Khan, Fairoz Nower, et al.
Publicado: (2026)
Improving Offline Reinforcement Learning with Inaccurate Simulators
por: Hou, Yiwen, et al.
Publicado: (2024)
por: Hou, Yiwen, et al.
Publicado: (2024)
Expressive Value Learning for Scalable Offline Reinforcement Learning
por: Espinosa-Dice, Nicolas, et al.
Publicado: (2025)
por: Espinosa-Dice, Nicolas, et al.
Publicado: (2025)
Learning by Doing: An Online Causal Reinforcement Learning Framework with Causal-Aware Policy
por: Cai, Ruichu, et al.
Publicado: (2024)
por: Cai, Ruichu, et al.
Publicado: (2024)
GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models
por: Wang, Mianchu, et al.
Publicado: (2023)
por: Wang, Mianchu, et al.
Publicado: (2023)
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
por: Shin, Yongjae, et al.
Publicado: (2026)
por: Shin, Yongjae, et al.
Publicado: (2026)
ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning
por: Wang, Xiaoxuan, et al.
Publicado: (2026)
por: Wang, Xiaoxuan, et al.
Publicado: (2026)
Dataset Distillation for Offline Reinforcement Learning
por: Light, Jonathan, et al.
Publicado: (2024)
por: Light, Jonathan, et al.
Publicado: (2024)
When to Trust Your Simulator: Dynamics-Aware Hybrid Offline-and-Online Reinforcement Learning
por: Niu, Haoyi, et al.
Publicado: (2022)
por: Niu, Haoyi, et al.
Publicado: (2022)
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
por: Wang, Danyang, et al.
Publicado: (2024)
por: Wang, Danyang, et al.
Publicado: (2024)
BOTS: A Unified Framework for Bayesian Online Task Selection in LLM Reinforcement Finetuning
por: Shen, Qianli, et al.
Publicado: (2025)
por: Shen, Qianli, et al.
Publicado: (2025)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
por: Alles, Marvin, et al.
Publicado: (2025)
por: Alles, Marvin, et al.
Publicado: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
por: Zhao, Ziqi, et al.
Publicado: (2024)
por: Zhao, Ziqi, et al.
Publicado: (2024)
Large Language Models for Robotics: A Survey
por: Zeng, Fanlong, et al.
Publicado: (2023)
por: Zeng, Fanlong, et al.
Publicado: (2023)
BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization
por: Zhou, Xueyang, et al.
Publicado: (2025)
por: Zhou, Xueyang, et al.
Publicado: (2025)
Text-to-Decision Agent: Offline Meta-Reinforcement Learning from Natural Language Supervision
por: Zhang, Shilin, et al.
Publicado: (2025)
por: Zhang, Shilin, et al.
Publicado: (2025)
Selective Reincarnation: Offline-to-Online Multi-Agent Reinforcement Learning
por: Formanek, Claude, et al.
Publicado: (2023)
por: Formanek, Claude, et al.
Publicado: (2023)
Ejemplares similares
-
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
por: Hu, Jifeng, et al.
Publicado: (2025) -
Continual Diffuser (CoD): Mastering Continual Offline Reinforcement Learning with Experience Rehearsal
por: Hu, Jifeng, et al.
Publicado: (2024) -
In-Context Decision Transformer: Reinforcement Learning via Hierarchical Chain-of-Thought
por: Huang, Sili, et al.
Publicado: (2024) -
Decision Flow Policy Optimization
por: Hu, Jifeng, et al.
Publicado: (2025) -
Solving Continual Offline RL through Selective Weights Activation on Aligned Spaces
por: Hu, Jifeng, et al.
Publicado: (2024)