Offline Model-Based Reinforcement Learning with Anti-Exploration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Srinivasan, Padmanaba, Knottenbelt, William |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Offline Reinforcement Learning with Behavioral Supervisor Tuning
par: Srinivasan, Padmanaba, et autres
Publié: (2024)
par: Srinivasan, Padmanaba, et autres
Publié: (2024)
Behavior Preference Regression for Offline Reinforcement Learning
par: Srinivasan, Padmanaba, et autres
Publié: (2025)
par: Srinivasan, Padmanaba, et autres
Publié: (2025)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
par: Yang, Yiqin, et autres
Publié: (2026)
par: Yang, Yiqin, et autres
Publié: (2026)
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration
par: Zhang, Ziqi, et autres
Publié: (2023)
par: Zhang, Ziqi, et autres
Publié: (2023)
The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
par: Sims, Anya, et autres
Publié: (2024)
par: Sims, Anya, et autres
Publié: (2024)
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation
par: Cao, Hongye, et autres
Publié: (2025)
par: Cao, Hongye, et autres
Publié: (2025)
Model-Based Offline Reinforcement Learning with Reliability-Guaranteed Sequence Modeling
par: He, Shenghong
Publié: (2025)
par: He, Shenghong
Publié: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
Constrained Latent Action Policies for Model-Based Offline Reinforcement Learning
par: Alles, Marvin, et autres
Publié: (2024)
par: Alles, Marvin, et autres
Publié: (2024)
Manifold-Constrained Energy-Based Transition Models for Offline Reinforcement Learning
par: Fang, Zeyu, et autres
Publié: (2026)
par: Fang, Zeyu, et autres
Publié: (2026)
Offline Reinforcement Learning with Universal Horizon Models
par: Chung, Hojun, et autres
Publié: (2026)
par: Chung, Hojun, et autres
Publié: (2026)
OffSim: Offline Simulator for Model-based Offline Inverse Reinforcement Learning
par: Ahn, Woo-Jin, et autres
Publié: (2025)
par: Ahn, Woo-Jin, et autres
Publié: (2025)
Policy-Based Trajectory Clustering in Offline Reinforcement Learning
par: Hu, Hao, et autres
Publié: (2025)
par: Hu, Hao, et autres
Publié: (2025)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
par: Guo, Yihong, et autres
Publié: (2025)
par: Guo, Yihong, et autres
Publié: (2025)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
par: Pan, Minting, et autres
Publié: (2023)
par: Pan, Minting, et autres
Publié: (2023)
MICRO: Model-Based Offline Reinforcement Learning with a Conservative Bellman Operator
par: Liu, Xiao-Yin, et autres
Publié: (2023)
par: Liu, Xiao-Yin, et autres
Publié: (2023)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
par: Gao, Xiancheng, et autres
Publié: (2025)
par: Gao, Xiancheng, et autres
Publié: (2025)
Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach
par: Pan, Minting, et autres
Publié: (2025)
par: Pan, Minting, et autres
Publié: (2025)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
par: Zhang, Liyu, et autres
Publié: (2024)
par: Zhang, Liyu, et autres
Publié: (2024)
Preference Elicitation for Offline Reinforcement Learning
par: Pace, Alizée, et autres
Publié: (2024)
par: Pace, Alizée, et autres
Publié: (2024)
Simple Ingredients for Offline Reinforcement Learning
par: Cetin, Edoardo, et autres
Publié: (2024)
par: Cetin, Edoardo, et autres
Publié: (2024)
State-Constrained Offline Reinforcement Learning
par: Hepburn, Charles A., et autres
Publié: (2024)
par: Hepburn, Charles A., et autres
Publié: (2024)
Dataset Distillation for Offline Reinforcement Learning
par: Light, Jonathan, et autres
Publié: (2024)
par: Light, Jonathan, et autres
Publié: (2024)
Offline Reinforcement Learning with Imputed Rewards
par: Romeo, Carlo, et autres
Publié: (2024)
par: Romeo, Carlo, et autres
Publié: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
par: Jiang, Li, et autres
Publié: (2023)
par: Jiang, Li, et autres
Publié: (2023)
The Generalization Gap in Offline Reinforcement Learning
par: Mediratta, Ishita, et autres
Publié: (2023)
par: Mediratta, Ishita, et autres
Publié: (2023)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
par: Park, Kwanyoung, et autres
Publié: (2024)
par: Park, Kwanyoung, et autres
Publié: (2024)
GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models
par: Wang, Mianchu, et autres
Publié: (2023)
par: Wang, Mianchu, et autres
Publié: (2023)
Offline Regularised Reinforcement Learning for Large Language Models Alignment
par: Richemond, Pierre Harvey, et autres
Publié: (2024)
par: Richemond, Pierre Harvey, et autres
Publié: (2024)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
par: Zhan, Simon Sinong, et autres
Publié: (2025)
par: Zhan, Simon Sinong, et autres
Publié: (2025)
Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions
par: Xu, Yinglun, et autres
Publié: (2023)
par: Xu, Yinglun, et autres
Publié: (2023)
FAST-Q: Fast-track Exploration with Adversarially Balanced State Representations for Counterfactual Action Estimation in Offline Reinforcement Learning
par: Agrawal, Pulkit, et autres
Publié: (2025)
par: Agrawal, Pulkit, et autres
Publié: (2025)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
par: Xu, Qiushui, et autres
Publié: (2025)
par: Xu, Qiushui, et autres
Publié: (2025)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
par: Liu, Wenhui, et autres
Publié: (2025)
par: Liu, Wenhui, et autres
Publié: (2025)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
par: Lyu, Jiafei, et autres
Publié: (2022)
par: Lyu, Jiafei, et autres
Publié: (2022)
Percentile Criterion Optimization in Offline Reinforcement Learning
par: Lobo, Elita A., et autres
Publié: (2024)
par: Lobo, Elita A., et autres
Publié: (2024)
Doubly Mild Generalization for Offline Reinforcement Learning
par: Mao, Yixiu, et autres
Publié: (2024)
par: Mao, Yixiu, et autres
Publié: (2024)
KAN v.s. MLP for Offline Reinforcement Learning
par: Guo, Haihong, et autres
Publié: (2024)
par: Guo, Haihong, et autres
Publié: (2024)
Mutual Information Regularized Offline Reinforcement Learning
par: Ma, Xiao, et autres
Publié: (2022)
par: Ma, Xiao, et autres
Publié: (2022)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
par: Wibault, Clarisse, et autres
Publié: (2026)
par: Wibault, Clarisse, et autres
Publié: (2026)
Documents similaires
-
Offline Reinforcement Learning with Behavioral Supervisor Tuning
par: Srinivasan, Padmanaba, et autres
Publié: (2024) -
Behavior Preference Regression for Offline Reinforcement Learning
par: Srinivasan, Padmanaba, et autres
Publié: (2025) -
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
par: Yang, Yiqin, et autres
Publié: (2026) -
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration
par: Zhang, Ziqi, et autres
Publié: (2023) -
The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
par: Sims, Anya, et autres
Publié: (2024)