Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Qian, Fuyuan, Zhang, Menglong, Wang, Song, Liu, Quanying |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Memory Sequence Length of Data Sampling Impacts the Adaptation of Meta-Reinforcement Learning Agents
von: Zhang, Menglong, et al.
Veröffentlicht: (2024)
von: Zhang, Menglong, et al.
Veröffentlicht: (2024)
Learning Task Belief Similarity with Latent Dynamics for Meta-Reinforcement Learning
von: Zhang, Menglong, et al.
Veröffentlicht: (2025)
von: Zhang, Menglong, et al.
Veröffentlicht: (2025)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
von: Wang, Changhong, et al.
Veröffentlicht: (2024)
von: Wang, Changhong, et al.
Veröffentlicht: (2024)
Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement Learning
von: Zhang, Hai, et al.
Veröffentlicht: (2024)
von: Zhang, Hai, et al.
Veröffentlicht: (2024)
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
von: Fan, Ziqing, et al.
Veröffentlicht: (2024)
von: Fan, Ziqing, et al.
Veröffentlicht: (2024)
Soft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement Learning
von: Wang, Shudong, et al.
Veröffentlicht: (2025)
von: Wang, Shudong, et al.
Veröffentlicht: (2025)
Using Curiosity for an Even Representation of Tasks in Continual Offline Reinforcement Learning
von: Pathmanathan, Pankayaraj, et al.
Veröffentlicht: (2023)
von: Pathmanathan, Pankayaraj, et al.
Veröffentlicht: (2023)
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
von: Liu, Shirong, et al.
Veröffentlicht: (2024)
von: Liu, Shirong, et al.
Veröffentlicht: (2024)
BECAUSE: Bilinear Causal Representation for Generalizable Offline Model-based Reinforcement Learning
von: Lin, Haohong, et al.
Veröffentlicht: (2024)
von: Lin, Haohong, et al.
Veröffentlicht: (2024)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
von: Pan, Minting, et al.
Veröffentlicht: (2023)
von: Pan, Minting, et al.
Veröffentlicht: (2023)
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning
von: Chen, Jiayu, et al.
Veröffentlicht: (2025)
von: Chen, Jiayu, et al.
Veröffentlicht: (2025)
Behavior Preference Regression for Offline Reinforcement Learning
von: Srinivasan, Padmanaba, et al.
Veröffentlicht: (2025)
von: Srinivasan, Padmanaba, et al.
Veröffentlicht: (2025)
Offline Reinforcement Learning with Behavioral Supervisor Tuning
von: Srinivasan, Padmanaba, et al.
Veröffentlicht: (2024)
von: Srinivasan, Padmanaba, et al.
Veröffentlicht: (2024)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2025)
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2025)
Policy-regularized Offline Multi-objective Reinforcement Learning
von: Lin, Qian, et al.
Veröffentlicht: (2024)
von: Lin, Qian, et al.
Veröffentlicht: (2024)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2024)
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2024)
OffSim: Offline Simulator for Model-based Offline Inverse Reinforcement Learning
von: Ahn, Woo-Jin, et al.
Veröffentlicht: (2025)
von: Ahn, Woo-Jin, et al.
Veröffentlicht: (2025)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
von: Xu, Qiushui, et al.
Veröffentlicht: (2025)
von: Xu, Qiushui, et al.
Veröffentlicht: (2025)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2024)
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2024)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
von: Park, Kwanyoung, et al.
Veröffentlicht: (2024)
von: Park, Kwanyoung, et al.
Veröffentlicht: (2024)
Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning
von: Ding, Zihan, et al.
Veröffentlicht: (2024)
von: Ding, Zihan, et al.
Veröffentlicht: (2024)
An Offline Adaptation Framework for Constrained Multi-Objective Reinforcement Learning
von: Lin, Qian, et al.
Veröffentlicht: (2024)
von: Lin, Qian, et al.
Veröffentlicht: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
Real-World Offline Reinforcement Learning from Vision Language Model Feedback
von: Venkataraman, Sreyas, et al.
Veröffentlicht: (2024)
von: Venkataraman, Sreyas, et al.
Veröffentlicht: (2024)
Solving Continual Offline Reinforcement Learning with Decision Transformer
von: Huang, Kaixin, et al.
Veröffentlicht: (2024)
von: Huang, Kaixin, et al.
Veröffentlicht: (2024)
Disentangling Policy from Offline Task Representation Learning via Adversarial Data Augmentation
von: Jia, Chengxing, et al.
Veröffentlicht: (2024)
von: Jia, Chengxing, et al.
Veröffentlicht: (2024)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
von: Bai, Chenjia, et al.
Veröffentlicht: (2024)
von: Bai, Chenjia, et al.
Veröffentlicht: (2024)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
von: Liu, Wenhui, et al.
Veröffentlicht: (2025)
von: Liu, Wenhui, et al.
Veröffentlicht: (2025)
In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
von: Tu, Songjun, et al.
Veröffentlicht: (2024)
von: Tu, Songjun, et al.
Veröffentlicht: (2024)
Continual Offline Reinforcement Learning via Diffusion-based Dual Generative Replay
von: Liu, Jinmei, et al.
Veröffentlicht: (2024)
von: Liu, Jinmei, et al.
Veröffentlicht: (2024)
Directed-MAML: Meta Reinforcement Learning Algorithm with Task-directed Approximation
von: Zhang, Yang, et al.
Veröffentlicht: (2025)
von: Zhang, Yang, et al.
Veröffentlicht: (2025)
When should we prefer Decision Transformers for Offline Reinforcement Learning?
von: Bhargava, Prajjwal, et al.
Veröffentlicht: (2023)
von: Bhargava, Prajjwal, et al.
Veröffentlicht: (2023)
Model-based Offline Quantum Reinforcement Learning
von: Eisenmann, Simon, et al.
Veröffentlicht: (2024)
von: Eisenmann, Simon, et al.
Veröffentlicht: (2024)
Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning
von: Dong, Jinzong, et al.
Veröffentlicht: (2026)
von: Dong, Jinzong, et al.
Veröffentlicht: (2026)
Dataset Distillation for Offline Reinforcement Learning
von: Light, Jonathan, et al.
Veröffentlicht: (2024)
von: Light, Jonathan, et al.
Veröffentlicht: (2024)
Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning
von: He, Jinmin, et al.
Veröffentlicht: (2025)
von: He, Jinmin, et al.
Veröffentlicht: (2025)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
von: Song, Chihyeon, et al.
Veröffentlicht: (2025)
von: Song, Chihyeon, et al.
Veröffentlicht: (2025)
DITTO: Offline Imitation Learning with World Models
von: DeMoss, Branton, et al.
Veröffentlicht: (2023)
von: DeMoss, Branton, et al.
Veröffentlicht: (2023)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
von: Yang, Yiqin, et al.
Veröffentlicht: (2026)
von: Yang, Yiqin, et al.
Veröffentlicht: (2026)
Permutation Equivariant Model-based Offline Reinforcement Learning for Auto-bidding
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025)
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Memory Sequence Length of Data Sampling Impacts the Adaptation of Meta-Reinforcement Learning Agents
von: Zhang, Menglong, et al.
Veröffentlicht: (2024) -
Learning Task Belief Similarity with Latent Dynamics for Meta-Reinforcement Learning
von: Zhang, Menglong, et al.
Veröffentlicht: (2025) -
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
von: Wang, Changhong, et al.
Veröffentlicht: (2024) -
Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement Learning
von: Zhang, Hai, et al.
Veröffentlicht: (2024) -
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
von: Fan, Ziqing, et al.
Veröffentlicht: (2024)