Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Omori, Yumi, Dong, Zixuan, Ross, Keith |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Is Optimal Transport Necessary for Inverse Reinforcement Learning?
par: Dong, Zixuan, et autres
Publié: (2025)
par: Dong, Zixuan, et autres
Publié: (2025)
Pre-training with Synthetic Data Helps Offline Reinforcement Learning
par: Wang, Zecheng, et autres
Publié: (2023)
par: Wang, Zecheng, et autres
Publié: (2023)
Solving Continual Offline Reinforcement Learning with Decision Transformer
par: Huang, Kaixin, et autres
Publié: (2024)
par: Huang, Kaixin, et autres
Publié: (2024)
Preference Elicitation for Offline Reinforcement Learning
par: Pace, Alizée, et autres
Publié: (2024)
par: Pace, Alizée, et autres
Publié: (2024)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
par: Gao, Chen-Xiao, et autres
Publié: (2024)
par: Gao, Chen-Xiao, et autres
Publié: (2024)
When should we prefer Decision Transformers for Offline Reinforcement Learning?
par: Bhargava, Prajjwal, et autres
Publié: (2023)
par: Bhargava, Prajjwal, et autres
Publié: (2023)
Behavior Preference Regression for Offline Reinforcement Learning
par: Srinivasan, Padmanaba, et autres
Publié: (2025)
par: Srinivasan, Padmanaba, et autres
Publié: (2025)
On the Convergence of Monte Carlo UCB for Random-Length Episodic MDPs
par: Dong, Zixuan, et autres
Publié: (2022)
par: Dong, Zixuan, et autres
Publié: (2022)
How Should We Meta-Learn Reinforcement Learning Algorithms?
par: Goldie, Alexander David, et autres
Publié: (2025)
par: Goldie, Alexander David, et autres
Publié: (2025)
Soft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement Learning
par: Wang, Shudong, et autres
Publié: (2025)
par: Wang, Shudong, et autres
Publié: (2025)
Quantum Decision Transformers (QDT): Synergistic Entanglement and Interference for Offline Reinforcement Learning
par: Weinberg, Abraham Itzhak
Publié: (2025)
par: Weinberg, Abraham Itzhak
Publié: (2025)
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
par: Fan, Ziqing, et autres
Publié: (2024)
par: Fan, Ziqing, et autres
Publié: (2024)
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
par: Guo, Zijian, et autres
Publié: (2024)
par: Guo, Zijian, et autres
Publié: (2024)
Adversarial Policy Optimization for Offline Preference-based Reinforcement Learning
par: Kang, Hyungkyu, et autres
Publié: (2025)
par: Kang, Hyungkyu, et autres
Publié: (2025)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
par: Zhang, Tianle, et autres
Publié: (2024)
par: Zhang, Tianle, et autres
Publié: (2024)
Listwise Reward Estimation for Offline Preference-based Reinforcement Learning
par: Choi, Heewoong, et autres
Publié: (2024)
par: Choi, Heewoong, et autres
Publié: (2024)
MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning
par: Yuan, Yifu, et autres
Publié: (2024)
par: Yuan, Yifu, et autres
Publié: (2024)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
par: Gao, Xiancheng, et autres
Publié: (2025)
par: Gao, Xiancheng, et autres
Publié: (2025)
LEASE: Offline Preference-based Reinforcement Learning with High Sample Efficiency
par: Liu, Xiao-Yin, et autres
Publié: (2024)
par: Liu, Xiao-Yin, et autres
Publié: (2024)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
par: Yang, Yiqin, et autres
Publié: (2026)
par: Yang, Yiqin, et autres
Publié: (2026)
Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions
par: Xu, Yinglun, et autres
Publié: (2023)
par: Xu, Yinglun, et autres
Publié: (2023)
In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
par: Tu, Songjun, et autres
Publié: (2024)
par: Tu, Songjun, et autres
Publié: (2024)
When Should We Prefer State-to-Visual DAgger Over Visual Reinforcement Learning?
par: Mu, Tongzhou, et autres
Publié: (2024)
par: Mu, Tongzhou, et autres
Publié: (2024)
Offline Inverse Constrained Reinforcement Learning for Safe-Critical Decision Making in Healthcare
par: Fang, Nan, et autres
Publié: (2024)
par: Fang, Nan, et autres
Publié: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
The Prevalence of Neural Collapse in Neural Multivariate Regression
par: Andriopoulos, George, et autres
Publié: (2024)
par: Andriopoulos, George, et autres
Publié: (2024)
Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems
par: Carr, Jonathan Colaço, et autres
Publié: (2026)
par: Carr, Jonathan Colaço, et autres
Publié: (2026)
Diverse Transformer Decoding for Offline Reinforcement Learning Using Financial Algorithmic Approaches
par: Elbaz, Dan, et autres
Publié: (2025)
par: Elbaz, Dan, et autres
Publié: (2025)
Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement Learning
par: Zhang, Hai, et autres
Publié: (2024)
par: Zhang, Hai, et autres
Publié: (2024)
Exploring and Addressing Reward Confusion in Offline Preference Learning
par: Chen, Xin, et autres
Publié: (2024)
par: Chen, Xin, et autres
Publié: (2024)
When Should a Robot Think? Resource-Aware Reasoning via Reinforcement Learning for Embodied Robotic Decision-Making
par: Liu, Jun, et autres
Publié: (2026)
par: Liu, Jun, et autres
Publié: (2026)
Offline Reinforcement Learning with Imbalanced Datasets
par: Jiang, Li, et autres
Publié: (2023)
par: Jiang, Li, et autres
Publié: (2023)
Simple Ingredients for Offline Reinforcement Learning
par: Cetin, Edoardo, et autres
Publié: (2024)
par: Cetin, Edoardo, et autres
Publié: (2024)
State-Constrained Offline Reinforcement Learning
par: Hepburn, Charles A., et autres
Publié: (2024)
par: Hepburn, Charles A., et autres
Publié: (2024)
The Generalization Gap in Offline Reinforcement Learning
par: Mediratta, Ishita, et autres
Publié: (2023)
par: Mediratta, Ishita, et autres
Publié: (2023)
Dataset Distillation for Offline Reinforcement Learning
par: Light, Jonathan, et autres
Publié: (2024)
par: Light, Jonathan, et autres
Publié: (2024)
Offline Reinforcement Learning with Imputed Rewards
par: Romeo, Carlo, et autres
Publié: (2024)
par: Romeo, Carlo, et autres
Publié: (2024)
Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning
par: Qian, Fuyuan, et autres
Publié: (2026)
par: Qian, Fuyuan, et autres
Publié: (2026)
For How Long Should We Be Punching? Learning Action Duration in Fighting Games
par: Nguyen, Hoang Hai, et autres
Publié: (2026)
par: Nguyen, Hoang Hai, et autres
Publié: (2026)
Toward Explainable Offline RL: Analyzing Representations in Intrinsically Motivated Decision Transformers
par: Guiducci, Leonardo, et autres
Publié: (2025)
par: Guiducci, Leonardo, et autres
Publié: (2025)
Documents similaires
-
Is Optimal Transport Necessary for Inverse Reinforcement Learning?
par: Dong, Zixuan, et autres
Publié: (2025) -
Pre-training with Synthetic Data Helps Offline Reinforcement Learning
par: Wang, Zecheng, et autres
Publié: (2023) -
Solving Continual Offline Reinforcement Learning with Decision Transformer
par: Huang, Kaixin, et autres
Publié: (2024) -
Preference Elicitation for Offline Reinforcement Learning
par: Pace, Alizée, et autres
Publié: (2024) -
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
par: Gao, Chen-Xiao, et autres
Publié: (2024)