Salvato in:
| Autori principali: | Chaudhary, Gaurav, Mondal, Wassim Uddin, Behera, Laxmidhar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2506.09574 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
From Novelty to Imitation: Self-Distilled Rewards for Offline Reinforcement Learning
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2025)
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2025)
Match or Replay: Self Imitating Proximal Policy Optimization
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2026)
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2026)
TEACH: Temporal Variance-Driven Curriculum for Reinforcement Learning
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2025)
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2025)
Sample-Efficient Constrained Reinforcement Learning with General Parameterization
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2024)
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2024)
Online Pre-Training for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2025)
di: Shin, Yongjae, et al.
Pubblicazione: (2025)
Efficient and Uncertainty-Aware Diffusion Framework for Offline-to-Online Reinforcement Learning
di: Bui, Ha Manh, et al.
Pubblicazione: (2026)
di: Bui, Ha Manh, et al.
Pubblicazione: (2026)
A Sharper Global Convergence Analysis for Average Reward Reinforcement Learning via an Actor-Critic Approach
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
Finite-Sample Analysis of Policy Evaluation for Robust Average Reward Reinforcement Learning
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Information-Directed Offline-to-Online Reinforcement Learning
di: Chen, Keru
Pubblicazione: (2026)
di: Chen, Keru
Pubblicazione: (2026)
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning
di: Guo, Siyuan, et al.
Pubblicazione: (2023)
di: Guo, Siyuan, et al.
Pubblicazione: (2023)
Dynamic Hand Gesture Recognition for Robot Manipulator Tasks
di: Sharma, Dharmendra, et al.
Pubblicazione: (2026)
di: Sharma, Dharmendra, et al.
Pubblicazione: (2026)
Bayesian Design Principles for Offline-to-Online Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2024)
di: Hu, Hao, et al.
Pubblicazione: (2024)
Online Optimization for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2025)
di: Chemingui, Yassine, et al.
Pubblicazione: (2025)
The Three Regimes of Offline-to-Online Reinforcement Learning
di: Li, Lu, et al.
Pubblicazione: (2025)
di: Li, Lu, et al.
Pubblicazione: (2025)
Constrained Reinforcement Learning with Average Reward Objective: Model-Based and Model-Free Algorithms
di: Aggarwal, Vaneet, et al.
Pubblicazione: (2024)
di: Aggarwal, Vaneet, et al.
Pubblicazione: (2024)
Governance-as-a-Service: A Multi-Agent Framework for AI System Compliance and Policy Enforcement
di: Gaurav, Suyash, et al.
Pubblicazione: (2025)
di: Gaurav, Suyash, et al.
Pubblicazione: (2025)
Making Offline RL Online: Collaborative World Models for Offline Visual Reinforcement Learning
di: Wang, Qi, et al.
Pubblicazione: (2023)
di: Wang, Qi, et al.
Pubblicazione: (2023)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
di: Gireesh, Nandiraju, et al.
Pubblicazione: (2026)
di: Gireesh, Nandiraju, et al.
Pubblicazione: (2026)
Mean-Field Approximation of Cooperative Constrained Multi-Agent Reinforcement Learning (CMARL)
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2022)
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2022)
A Non-Monolithic Policy Approach of Offline-to-Online Reinforcement Learning
di: Kim, JaeYoon, et al.
Pubblicazione: (2024)
di: Kim, JaeYoon, et al.
Pubblicazione: (2024)
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
di: Liu, Shirong, et al.
Pubblicazione: (2024)
di: Liu, Shirong, et al.
Pubblicazione: (2024)
Active Advantage-Aligned Online Reinforcement Learning with Offline Data
di: Liu, Xuefeng, et al.
Pubblicazione: (2025)
di: Liu, Xuefeng, et al.
Pubblicazione: (2025)
Energy-Guided Diffusion Sampling for Offline-to-Online Reinforcement Learning
di: Liu, Xu-Hui, et al.
Pubblicazione: (2024)
di: Liu, Xu-Hui, et al.
Pubblicazione: (2024)
Planning to Go Out-of-Distribution in Offline-to-Online Reinforcement Learning
di: McInroe, Trevor, et al.
Pubblicazione: (2023)
di: McInroe, Trevor, et al.
Pubblicazione: (2023)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)
Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
Towards Robust Offline-to-Online Reinforcement Learning via Uncertainty and Smoothness
di: Wen, Xiaoyu, et al.
Pubblicazione: (2023)
di: Wen, Xiaoyu, et al.
Pubblicazione: (2023)
Enhancing Online Reinforcement Learning with Meta-Learned Objective from Offline Data
di: Deng, Shilong, et al.
Pubblicazione: (2025)
di: Deng, Shilong, et al.
Pubblicazione: (2025)
Hypercube Policy Regularization Framework for Offline Reinforcement Learning
di: Shen, Yi, et al.
Pubblicazione: (2024)
di: Shen, Yi, et al.
Pubblicazione: (2024)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
di: Huang, Xiao, et al.
Pubblicazione: (2025)
di: Huang, Xiao, et al.
Pubblicazione: (2025)
RLSynC: Offline-Online Reinforcement Learning for Synthon Completion
di: Baker, Frazier N., et al.
Pubblicazione: (2023)
di: Baker, Frazier N., et al.
Pubblicazione: (2023)
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
Online Symbolic Music Alignment with Offline Reinforcement Learning
di: Peter, Silvan David
Pubblicazione: (2023)
di: Peter, Silvan David
Pubblicazione: (2023)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
di: Zhang, Liyu, et al.
Pubblicazione: (2024)
di: Zhang, Liyu, et al.
Pubblicazione: (2024)
Stable Online and Offline Reinforcement Learning for Antibody CDRH3 Design
di: Vogt, Yannick, et al.
Pubblicazione: (2023)
di: Vogt, Yannick, et al.
Pubblicazione: (2023)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
di: Zhao, Kai, et al.
Pubblicazione: (2023)
di: Zhao, Kai, et al.
Pubblicazione: (2023)
Efficient Online Reinforcement Learning Fine-Tuning Need Not Retain Offline Data
di: Zhou, Zhiyuan, et al.
Pubblicazione: (2024)
di: Zhou, Zhiyuan, et al.
Pubblicazione: (2024)
Behavior-Adaptive Q-Learning: A Unifying Framework for Offline-to-Online RL
di: Zu, Lipeng, et al.
Pubblicazione: (2025)
di: Zu, Lipeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
From Novelty to Imitation: Self-Distilled Rewards for Offline Reinforcement Learning
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2025) -
Match or Replay: Self Imitating Proximal Policy Optimization
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2026) -
TEACH: Temporal Variance-Driven Curriculum for Reinforcement Learning
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2025) -
Sample-Efficient Constrained Reinforcement Learning with General Parameterization
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2024) -
Online Pre-Training for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2025)