Human-Level Competitive Pokémon via Scalable Offline Reinforcement Learning with Transformers
Fuente:
arXiv
Saved in:
| Main Authors: | Grigsby, Jake, Xie, Yuqi, Sasek, Justin, Zheng, Steven, Zhu, Yuke |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AMAGO-2: Breaking the Multi-Task Barrier in Meta-Reinforcement Learning with Transformers
by: Grigsby, Jake, et al.
Published: (2024)
by: Grigsby, Jake, et al.
Published: (2024)
AMAGO: Scalable In-Context Reinforcement Learning for Adaptive Agents
by: Grigsby, Jake, et al.
Published: (2023)
by: Grigsby, Jake, et al.
Published: (2023)
VLM Q-Learning: Aligning Vision-Language Models for Interactive Decision-Making
by: Grigsby, Jake, et al.
Published: (2025)
by: Grigsby, Jake, et al.
Published: (2025)
Pokemon Red via Reinforcement Learning
by: Pleines, Marco, et al.
Published: (2025)
by: Pleines, Marco, et al.
Published: (2025)
PokeRL: Reinforcement Learning for Pokemon Red
by: Mudireddy, Dheeraj, et al.
Published: (2026)
by: Mudireddy, Dheeraj, et al.
Published: (2026)
DEAS: DEtached value learning with Action Sequence for Scalable Offline RL
by: Kim, Changyeon, et al.
Published: (2025)
by: Kim, Changyeon, et al.
Published: (2025)
Self-Confirming Transformer for Belief-Conditioned Adaptation in Offline Multi-Agent Reinforcement Learning
by: Li, Tao, et al.
Published: (2023)
by: Li, Tao, et al.
Published: (2023)
Scalable Multi-Agent Offline Reinforcement Learning and the Role of Information
by: Zamboni, Riccardo, et al.
Published: (2025)
by: Zamboni, Riccardo, et al.
Published: (2025)
Scalable Offline Reinforcement Learning for Mean Field Games
by: Brunnbauer, Axel, et al.
Published: (2024)
by: Brunnbauer, Axel, et al.
Published: (2024)
Trajectory-Level Data Augmentation for Offline Reinforcement Learning
by: Schmähling, Tobias, et al.
Published: (2026)
by: Schmähling, Tobias, et al.
Published: (2026)
Q-value Regularized Transformer for Offline Reinforcement Learning
by: Hu, Shengchao, et al.
Published: (2024)
by: Hu, Shengchao, et al.
Published: (2024)
Double Check My Desired Return: Transformer with Target Alignment for Offline Reinforcement Learning
by: Pei, Yue, et al.
Published: (2025)
by: Pei, Yue, et al.
Published: (2025)
Expressive Value Learning for Scalable Offline Reinforcement Learning
by: Espinosa-Dice, Nicolas, et al.
Published: (2025)
by: Espinosa-Dice, Nicolas, et al.
Published: (2025)
Preserving Expert-Level Privacy in Offline Reinforcement Learning
by: Sharma, Navodita, et al.
Published: (2024)
by: Sharma, Navodita, et al.
Published: (2024)
PyTupli: A Scalable Infrastructure for Collaborative Offline Reinforcement Learning Projects
by: Markgraf, Hannah, et al.
Published: (2025)
by: Markgraf, Hannah, et al.
Published: (2025)
Residuals-based Offline Reinforcement Learning
by: Zhu, Qing, et al.
Published: (2026)
by: Zhu, Qing, et al.
Published: (2026)
Simulation-Driven Balancing of Competitive Game Levels with Reinforcement Learning
by: Rupp, Florian, et al.
Published: (2025)
by: Rupp, Florian, et al.
Published: (2025)
Solving Continual Offline Reinforcement Learning with Decision Transformer
by: Huang, Kaixin, et al.
Published: (2024)
by: Huang, Kaixin, et al.
Published: (2024)
Corruption Robust Offline Reinforcement Learning with Human Feedback
by: Mandal, Debmalya, et al.
Published: (2024)
by: Mandal, Debmalya, et al.
Published: (2024)
Offline Goal-conditioned Reinforcement Learning with Quasimetric Representations
by: Myers, Vivek, et al.
Published: (2025)
by: Myers, Vivek, et al.
Published: (2025)
Machine Learning for Scalable and Optimal Load Shedding Under Power System Contingency
by: Zhou, Yuqi, et al.
Published: (2024)
by: Zhou, Yuqi, et al.
Published: (2024)
Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning
by: Zhou, Xue, et al.
Published: (2025)
by: Zhou, Xue, et al.
Published: (2025)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
by: Yang, Letian, et al.
Published: (2026)
by: Yang, Letian, et al.
Published: (2026)
Offline Reinforcement Learning in Large State Spaces: Algorithms and Guarantees
by: Jiang, Nan, et al.
Published: (2025)
by: Jiang, Nan, et al.
Published: (2025)
Session-Level Dynamic Ad Load Optimization using Offline Robust Reinforcement Learning
by: Liu, Tao, et al.
Published: (2025)
by: Liu, Tao, et al.
Published: (2025)
HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
by: Hu, Shengchao, et al.
Published: (2024)
by: Hu, Shengchao, et al.
Published: (2024)
Corruption-robust Offline Multi-agent Reinforcement Learning From Human Feedback
by: Nika, Andi, et al.
Published: (2026)
by: Nika, Andi, et al.
Published: (2026)
Offline Trajectory Optimization for Offline Reinforcement Learning
by: Zhao, Ziqi, et al.
Published: (2024)
by: Zhao, Ziqi, et al.
Published: (2024)
DyDiff: Long-Horizon Rollout via Dynamics Diffusion for Offline Reinforcement Learning
by: Zhao, Hanye, et al.
Published: (2024)
by: Zhao, Hanye, et al.
Published: (2024)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
by: Wu, Kun, et al.
Published: (2024)
by: Wu, Kun, et al.
Published: (2024)
Equivariant Offline Reinforcement Learning
by: Tangri, Arsh, et al.
Published: (2024)
by: Tangri, Arsh, et al.
Published: (2024)
Federated Offline Reinforcement Learning
by: Zhou, Doudou, et al.
Published: (2022)
by: Zhou, Doudou, et al.
Published: (2022)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
by: Yang, Yiqin, et al.
Published: (2026)
by: Yang, Yiqin, et al.
Published: (2026)
Survival Reinforcement Learning: Toward Scalable Self-Supervised RL
by: Nguimatsia-Tiofack, Franki, et al.
Published: (2026)
by: Nguimatsia-Tiofack, Franki, et al.
Published: (2026)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
by: Xu, Qiushui, et al.
Published: (2025)
by: Xu, Qiushui, et al.
Published: (2025)
Epistemic Robust Offline Reinforcement Learning
by: Chenreddy, Abhilash Reddy, et al.
Published: (2026)
by: Chenreddy, Abhilash Reddy, et al.
Published: (2026)
Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?
by: Omori, Yumi, et al.
Published: (2025)
by: Omori, Yumi, et al.
Published: (2025)
ISEP: Implicit Support Expansion for Offline Reinforcement Learning via Stochastic Policy Optimization
by: Chen, Yifei, et al.
Published: (2026)
by: Chen, Yifei, et al.
Published: (2026)
When should we prefer Decision Transformers for Offline Reinforcement Learning?
by: Bhargava, Prajjwal, et al.
Published: (2023)
by: Bhargava, Prajjwal, et al.
Published: (2023)
Enhancing Online Reinforcement Learning with Meta-Learned Objective from Offline Data
by: Deng, Shilong, et al.
Published: (2025)
by: Deng, Shilong, et al.
Published: (2025)
Similar Items
-
AMAGO-2: Breaking the Multi-Task Barrier in Meta-Reinforcement Learning with Transformers
by: Grigsby, Jake, et al.
Published: (2024) -
AMAGO: Scalable In-Context Reinforcement Learning for Adaptive Agents
by: Grigsby, Jake, et al.
Published: (2023) -
VLM Q-Learning: Aligning Vision-Language Models for Interactive Decision-Making
by: Grigsby, Jake, et al.
Published: (2025) -
Pokemon Red via Reinforcement Learning
by: Pleines, Marco, et al.
Published: (2025) -
PokeRL: Reinforcement Learning for Pokemon Red
by: Mudireddy, Dheeraj, et al.
Published: (2026)