When should we prefer Decision Transformers for Offline Reinforcement Learning?
Fuente:
arXiv
Salvato in:
| Autori principali: | Bhargava, Prajjwal, Chitnis, Rohan, Geramifard, Alborz, Sodhani, Shagun, Zhang, Amy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning
di: Sikchi, Harshit, et al.
Pubblicazione: (2023)
di: Sikchi, Harshit, et al.
Pubblicazione: (2023)
Sequential Decision-Making for Inline Text Autocomplete
di: Chitnis, Rohan, et al.
Pubblicazione: (2024)
di: Chitnis, Rohan, et al.
Pubblicazione: (2024)
Beyond GRPO and On-Policy Distillation: An Empirical Sparse-to-Dense Reward Principle for Language-Model Post-Training
di: Xu, Yuanda, et al.
Pubblicazione: (2026)
di: Xu, Yuanda, et al.
Pubblicazione: (2026)
TIP: Token Importance in On-Policy Distillation
di: Xu, Yuanda, et al.
Pubblicazione: (2026)
di: Xu, Yuanda, et al.
Pubblicazione: (2026)
Effect of Document Packing on the Latent Multi-Hop Reasoning Capabilities of Large Language Models
di: Prato, Gabriele, et al.
Pubblicazione: (2025)
di: Prato, Gabriele, et al.
Pubblicazione: (2025)
Agentic Reinforcement Learning for Real-World Code Repair
di: Zhu, Siyu, et al.
Pubblicazione: (2025)
di: Zhu, Siyu, et al.
Pubblicazione: (2025)
Solving Continual Offline Reinforcement Learning with Decision Transformer
di: Huang, Kaixin, et al.
Pubblicazione: (2024)
di: Huang, Kaixin, et al.
Pubblicazione: (2024)
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
di: Fan, Ziqing, et al.
Pubblicazione: (2024)
di: Fan, Ziqing, et al.
Pubblicazione: (2024)
Soft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement Learning
di: Wang, Shudong, et al.
Pubblicazione: (2025)
di: Wang, Shudong, et al.
Pubblicazione: (2025)
Do Large Language Models Know How Much They Know?
di: Prato, Gabriele, et al.
Pubblicazione: (2025)
di: Prato, Gabriele, et al.
Pubblicazione: (2025)
Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?
di: Omori, Yumi, et al.
Pubblicazione: (2025)
di: Omori, Yumi, et al.
Pubblicazione: (2025)
Quantum Decision Transformers (QDT): Synergistic Entanglement and Interference for Offline Reinforcement Learning
di: Weinberg, Abraham Itzhak
Pubblicazione: (2025)
di: Weinberg, Abraham Itzhak
Pubblicazione: (2025)
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
di: Guo, Zijian, et al.
Pubblicazione: (2024)
di: Guo, Zijian, et al.
Pubblicazione: (2024)
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
di: Mao, Liyuan, et al.
Pubblicazione: (2024)
di: Mao, Liyuan, et al.
Pubblicazione: (2024)
A Recipe for Stable Offline Multi-agent Reinforcement Learning
di: Lee, Dongsu, et al.
Pubblicazione: (2026)
di: Lee, Dongsu, et al.
Pubblicazione: (2026)
When is Offline Policy Selection Sample Efficient for Reinforcement Learning?
di: Liu, Vincent, et al.
Pubblicazione: (2023)
di: Liu, Vincent, et al.
Pubblicazione: (2023)
Harnessing small projectors and multiple views for efficient vision pretraining
di: Agrawal, Kumar Krishna, et al.
Pubblicazione: (2023)
di: Agrawal, Kumar Krishna, et al.
Pubblicazione: (2023)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
di: Yang, Rui, et al.
Pubblicazione: (2023)
di: Yang, Rui, et al.
Pubblicazione: (2023)
Scaling and Distilling Transformer Models for sEMG
di: Mehlman, Nicholas, et al.
Pubblicazione: (2025)
di: Mehlman, Nicholas, et al.
Pubblicazione: (2025)
Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning
di: Ding, Zihan, et al.
Pubblicazione: (2024)
di: Ding, Zihan, et al.
Pubblicazione: (2024)
Offline Inverse Constrained Reinforcement Learning for Safe-Critical Decision Making in Healthcare
di: Fang, Nan, et al.
Pubblicazione: (2024)
di: Fang, Nan, et al.
Pubblicazione: (2024)
Universal Black-Box Reward Poisoning Attack against Offline Reinforcement Learning
di: Xu, Yinglun, et al.
Pubblicazione: (2024)
di: Xu, Yinglun, et al.
Pubblicazione: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
When to Trust Your Simulator: Dynamics-Aware Hybrid Offline-and-Online Reinforcement Learning
di: Niu, Haoyi, et al.
Pubblicazione: (2022)
di: Niu, Haoyi, et al.
Pubblicazione: (2022)
Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions
di: Xu, Yinglun, et al.
Pubblicazione: (2023)
di: Xu, Yinglun, et al.
Pubblicazione: (2023)
Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning
di: Qian, Fuyuan, et al.
Pubblicazione: (2026)
di: Qian, Fuyuan, et al.
Pubblicazione: (2026)
Diverse Transformer Decoding for Offline Reinforcement Learning Using Financial Algorithmic Approaches
di: Elbaz, Dan, et al.
Pubblicazione: (2025)
di: Elbaz, Dan, et al.
Pubblicazione: (2025)
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem
di: Barde, Paul, et al.
Pubblicazione: (2023)
di: Barde, Paul, et al.
Pubblicazione: (2023)
MaestroMotif: Skill Design from Artificial Intelligence Feedback
di: Klissarov, Martin, et al.
Pubblicazione: (2024)
di: Klissarov, Martin, et al.
Pubblicazione: (2024)
Using Non-Expert Data to Robustify Imitation Learning via Offline Reinforcement Learning
di: Huang, Kevin, et al.
Pubblicazione: (2025)
di: Huang, Kevin, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning for Learning to Dispatch for Job Shop Scheduling
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024)
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
di: Jiang, Li, et al.
Pubblicazione: (2023)
di: Jiang, Li, et al.
Pubblicazione: (2023)
The Generalization Gap in Offline Reinforcement Learning
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
Preference Elicitation for Offline Reinforcement Learning
di: Pace, Alizée, et al.
Pubblicazione: (2024)
di: Pace, Alizée, et al.
Pubblicazione: (2024)
Simple Ingredients for Offline Reinforcement Learning
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
State-Constrained Offline Reinforcement Learning
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
Dataset Distillation for Offline Reinforcement Learning
di: Light, Jonathan, et al.
Pubblicazione: (2024)
di: Light, Jonathan, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Imputed Rewards
di: Romeo, Carlo, et al.
Pubblicazione: (2024)
di: Romeo, Carlo, et al.
Pubblicazione: (2024)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024)
IQL-TD-MPC: Implicit Q-Learning for Hierarchical Model Predictive Control
di: Chitnis, Rohan, et al.
Pubblicazione: (2023)
di: Chitnis, Rohan, et al.
Pubblicazione: (2023)
Documenti analoghi
-
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning
di: Sikchi, Harshit, et al.
Pubblicazione: (2023) -
Sequential Decision-Making for Inline Text Autocomplete
di: Chitnis, Rohan, et al.
Pubblicazione: (2024) -
Beyond GRPO and On-Policy Distillation: An Empirical Sparse-to-Dense Reward Principle for Language-Model Post-Training
di: Xu, Yuanda, et al.
Pubblicazione: (2026) -
TIP: Token Importance in On-Policy Distillation
di: Xu, Yuanda, et al.
Pubblicazione: (2026) -
Effect of Document Packing on the Latent Multi-Hop Reasoning Capabilities of Large Language Models
di: Prato, Gabriele, et al.
Pubblicazione: (2025)