Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wen, Xiaoyu, Bai, Chenjia, Xu, Kang, Yu, Xudong, Zhang, Yang, Li, Xuelong, Wang, Zhen |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
par: Wang, Changhong, et autres
Publié: (2024)
par: Wang, Changhong, et autres
Publié: (2024)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
par: Bai, Chenjia, et autres
Publié: (2024)
par: Bai, Chenjia, et autres
Publié: (2024)
Diverse Randomized Value Functions: A Provably Pessimistic Approach for Offline Reinforcement Learning
par: Yu, Xudong, et autres
Publié: (2024)
par: Yu, Xudong, et autres
Publié: (2024)
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
par: Liu, Shirong, et autres
Publié: (2024)
par: Liu, Shirong, et autres
Publié: (2024)
Cross-Domain Policy Adaptation by Capturing Representation Mismatch
par: Lyu, Jiafei, et autres
Publié: (2024)
par: Lyu, Jiafei, et autres
Publié: (2024)
Towards Robust Offline-to-Online Reinforcement Learning via Uncertainty and Smoothness
par: Wen, Xiaoyu, et autres
Publié: (2023)
par: Wen, Xiaoyu, et autres
Publié: (2023)
Efficient Cross-Domain Offline Reinforcement Learning with Dynamics- and Value-Aligned Data Filtering
par: Qiao, Zhongjian, et autres
Publié: (2025)
par: Qiao, Zhongjian, et autres
Publié: (2025)
Localized Dynamics-Aware Domain Adaption for Off-Dynamics Offline Reinforcement Learning
par: Xia, Zhangjie, et autres
Publié: (2026)
par: Xia, Zhangjie, et autres
Publié: (2026)
ODRL: A Benchmark for Off-Dynamics Reinforcement Learning
par: Lyu, Jiafei, et autres
Publié: (2024)
par: Lyu, Jiafei, et autres
Publié: (2024)
PRTS: A Primitive Reasoning and Tasking System via Contrastive Representations
par: Zhang, Yang, et autres
Publié: (2026)
par: Zhang, Yang, et autres
Publié: (2026)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
par: Yang, Rui, et autres
Publié: (2023)
par: Yang, Rui, et autres
Publié: (2023)
Permutation Equivariant Model-based Offline Reinforcement Learning for Auto-bidding
par: Mou, Zhiyu, et autres
Publié: (2025)
par: Mou, Zhiyu, et autres
Publié: (2025)
Mutual Information Regularized Offline Reinforcement Learning
par: Ma, Xiao, et autres
Publié: (2022)
par: Ma, Xiao, et autres
Publié: (2022)
Disentangling Policy from Offline Task Representation Learning via Adversarial Data Augmentation
par: Jia, Chengxing, et autres
Publié: (2024)
par: Jia, Chengxing, et autres
Publié: (2024)
Exponential Topology-enabled Scalable Communication in Multi-agent Reinforcement Learning
par: Li, Xinran, et autres
Publié: (2025)
par: Li, Xinran, et autres
Publié: (2025)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
par: Zhang, Tianle, et autres
Publié: (2024)
par: Zhang, Tianle, et autres
Publié: (2024)
Learning Robust Spectral Dynamics for Temporal Domain Generalization
par: Yu, En, et autres
Publié: (2025)
par: Yu, En, et autres
Publié: (2025)
Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models
par: Zhang, Yang, et autres
Publié: (2024)
par: Zhang, Yang, et autres
Publié: (2024)
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation
par: Cao, Hongye, et autres
Publié: (2025)
par: Cao, Hongye, et autres
Publié: (2025)
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
par: Xu, Jiawei, et autres
Publié: (2024)
par: Xu, Jiawei, et autres
Publié: (2024)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
par: Gao, Chen-Xiao, et autres
Publié: (2024)
par: Gao, Chen-Xiao, et autres
Publié: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
Offline Reinforcement Learning: Role of State Aggregation and Trajectory Data
par: Jia, Zeyu, et autres
Publié: (2024)
par: Jia, Zeyu, et autres
Publié: (2024)
Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data
par: Madhow, Sunil, et autres
Publié: (2023)
par: Madhow, Sunil, et autres
Publié: (2023)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
par: Huang, Xiao, et autres
Publié: (2025)
par: Huang, Xiao, et autres
Publié: (2025)
Towards Efficient LLM Grounding for Embodied Multi-Agent Collaboration
par: Zhang, Yang, et autres
Publié: (2024)
par: Zhang, Yang, et autres
Publié: (2024)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
par: Guo, Yihong, et autres
Publié: (2025)
par: Guo, Yihong, et autres
Publié: (2025)
FOVA: Offline Federated Reinforcement Learning with Mixed-Quality Data
par: Qiao, Nan, et autres
Publié: (2025)
par: Qiao, Nan, et autres
Publié: (2025)
Adversarial Policy Optimization for Offline Preference-based Reinforcement Learning
par: Kang, Hyungkyu, et autres
Publié: (2025)
par: Kang, Hyungkyu, et autres
Publié: (2025)
Bridging Domain Gaps with Target-Aligned Generation for Offline Reinforcement Learning
par: Kim, Minung, et autres
Publié: (2026)
par: Kim, Minung, et autres
Publié: (2026)
Policy Regularization on Globally Accessible States in Cross-Dynamics Reinforcement Learning
par: Xue, Zhenghai, et autres
Publié: (2025)
par: Xue, Zhenghai, et autres
Publié: (2025)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
par: Yang, Yiqin, et autres
Publié: (2026)
par: Yang, Yiqin, et autres
Publié: (2026)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
par: Gao, Chen-Xiao, et autres
Publié: (2025)
par: Gao, Chen-Xiao, et autres
Publié: (2025)
Using Curiosity for an Even Representation of Tasks in Continual Offline Reinforcement Learning
par: Pathmanathan, Pankayaraj, et autres
Publié: (2023)
par: Pathmanathan, Pankayaraj, et autres
Publié: (2023)
Deep Contrastive Graph Learning with Clustering-Oriented Guidance
par: Chen, Mulin, et autres
Publié: (2024)
par: Chen, Mulin, et autres
Publié: (2024)
Task-Agnostic Pre-training and Task-Guided Fine-tuning for Versatile Diffusion Planner
par: Fan, Chenyou, et autres
Publié: (2024)
par: Fan, Chenyou, et autres
Publié: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
par: Jiang, Li, et autres
Publié: (2023)
par: Jiang, Li, et autres
Publié: (2023)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
par: Yang, Letian, et autres
Publié: (2026)
par: Yang, Letian, et autres
Publié: (2026)
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
par: Mao, Liyuan, et autres
Publié: (2024)
par: Mao, Liyuan, et autres
Publié: (2024)
Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning
par: Qian, Fuyuan, et autres
Publié: (2026)
par: Qian, Fuyuan, et autres
Publié: (2026)
Documents similaires
-
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
par: Wang, Changhong, et autres
Publié: (2024) -
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
par: Bai, Chenjia, et autres
Publié: (2024) -
Diverse Randomized Value Functions: A Provably Pessimistic Approach for Offline Reinforcement Learning
par: Yu, Xudong, et autres
Publié: (2024) -
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
par: Liu, Shirong, et autres
Publié: (2024) -
Cross-Domain Policy Adaptation by Capturing Representation Mismatch
par: Lyu, Jiafei, et autres
Publié: (2024)