Disentangling Policy from Offline Task Representation Learning via Adversarial Data Augmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Jia, Chengxing, Zhang, Fuxiang, Li, Yi-Chen, Gao, Chen-Xiao, Liu, Xu-Hui, Yuan, Lei, Zhang, Zongzhang, Yu, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Debiased Offline Representation Learning for Fast Online Adaptation in Non-stationary Dynamics
di: Zhang, Xinyu, et al.
Pubblicazione: (2024)
di: Zhang, Xinyu, et al.
Pubblicazione: (2024)
Q-Adapter: Customizing Pre-trained LLMs to New Preferences with Forgetting Mitigation
di: Li, Yi-Chen, et al.
Pubblicazione: (2024)
di: Li, Yi-Chen, et al.
Pubblicazione: (2024)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024)
Improving Sample Efficiency of Reinforcement Learning with Background Knowledge from Large Language Models
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)
Any-step Dynamics Model Improves Future Predictions for Online and Offline Reinforcement Learning
di: Lin, Haoxin, et al.
Pubblicazione: (2024)
di: Lin, Haoxin, et al.
Pubblicazione: (2024)
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation
di: Cao, Hongye, et al.
Pubblicazione: (2025)
di: Cao, Hongye, et al.
Pubblicazione: (2025)
Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay
di: Chen, Feng, et al.
Pubblicazione: (2024)
di: Chen, Feng, et al.
Pubblicazione: (2024)
Learning Expressive Disentangled Speech Representations with Soft Speech Units and Adversarial Style Augmentation
di: Deng, Yimin, et al.
Pubblicazione: (2024)
di: Deng, Yimin, et al.
Pubblicazione: (2024)
Robust Multi-agent Communication via Multi-view Message Certification
di: Yuan, Lei, et al.
Pubblicazione: (2023)
di: Yuan, Lei, et al.
Pubblicazione: (2023)
BWArea Model: Learning World Model, Inverse Dynamics, and Policy for Controllable Language Generation
di: Jia, Chengxing, et al.
Pubblicazione: (2024)
di: Jia, Chengxing, et al.
Pubblicazione: (2024)
ACT: Empowering Decision Transformer with Dynamic Programming via Advantage Conditioning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2023)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2023)
Model-Based Proactive Cost Generation for Learning Safe Policies Offline with Limited Violation Data
di: Xue, Ruiqi, et al.
Pubblicazione: (2026)
di: Xue, Ruiqi, et al.
Pubblicazione: (2026)
Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning
di: Zhou, Xue, et al.
Pubblicazione: (2025)
di: Zhou, Xue, et al.
Pubblicazione: (2025)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
di: Wen, Xiaoyu, et al.
Pubblicazione: (2024)
di: Wen, Xiaoyu, et al.
Pubblicazione: (2024)
Counterfactual Learning-Driven Representation Disentanglement for Search-Enhanced Recommendation
di: Cui, Jiajun, et al.
Pubblicazione: (2024)
di: Cui, Jiajun, et al.
Pubblicazione: (2024)
Attention-Guided Contrastive Role Representations for Multi-Agent Reinforcement Learning
di: Hu, Zican, et al.
Pubblicazione: (2023)
di: Hu, Zican, et al.
Pubblicazione: (2023)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
di: Wang, Changhong, et al.
Pubblicazione: (2024)
di: Wang, Changhong, et al.
Pubblicazione: (2024)
Adversarial Data Augmentation for Single Domain Generalization via Lyapunov Exponent-Guided Optimization
di: Zhang, Zuyu, et al.
Pubblicazione: (2025)
di: Zhang, Zuyu, et al.
Pubblicazione: (2025)
DiffPoGAN: Diffusion Policies with Generative Adversarial Networks for Offline Reinforcement Learning
di: Hu, Xuemin, et al.
Pubblicazione: (2024)
di: Hu, Xuemin, et al.
Pubblicazione: (2024)
Policy Expansion for Bridging Offline-to-Online Reinforcement Learning
di: Zhang, Haichao, et al.
Pubblicazione: (2023)
di: Zhang, Haichao, et al.
Pubblicazione: (2023)
Multi-agent In-context Coordination via Decentralized Memory Retrieval
di: Jiang, Tao, et al.
Pubblicazione: (2025)
di: Jiang, Tao, et al.
Pubblicazione: (2025)
Rectifying Adversarial Sample with Low Entropy Prior for Test-Time Defense
di: Ma, Lina, et al.
Pubblicazione: (2025)
di: Ma, Lina, et al.
Pubblicazione: (2025)
Multi-Task Model Merging via Adaptive Weight Disentanglement
di: Xiong, Feng, et al.
Pubblicazione: (2024)
di: Xiong, Feng, et al.
Pubblicazione: (2024)
Urban-Focused Multi-Task Offline Reinforcement Learning with Contrastive Data Sharing
di: Zhao, Xinbo, et al.
Pubblicazione: (2024)
di: Zhao, Xinbo, et al.
Pubblicazione: (2024)
Conservative Offline Robot Policy Learning via Posterior-Transition Reweighting
di: Zhang, Wanpeng, et al.
Pubblicazione: (2026)
di: Zhang, Wanpeng, et al.
Pubblicazione: (2026)
Disentangled Representation Learning for Parametric Partial Differential Equations
di: Liu, Ning, et al.
Pubblicazione: (2024)
di: Liu, Ning, et al.
Pubblicazione: (2024)
MGDA: Model-based Goal Data Augmentation for Offline Goal-conditioned Weighted Supervised Learning
di: Lei, Xing, et al.
Pubblicazione: (2024)
di: Lei, Xing, et al.
Pubblicazione: (2024)
Policy-Guided Causal State Representation for Offline Reinforcement Learning Recommendation
di: Wang, Siyu, et al.
Pubblicazione: (2025)
di: Wang, Siyu, et al.
Pubblicazione: (2025)
DisenSemi: Semi-supervised Graph Classification via Disentangled Representation Learning
di: Wang, Yifan, et al.
Pubblicazione: (2024)
di: Wang, Yifan, et al.
Pubblicazione: (2024)
Cross-Camera Cow Identification via Disentangled Representation Learning
di: Wang, Runcheng, et al.
Pubblicazione: (2026)
di: Wang, Runcheng, et al.
Pubblicazione: (2026)
Balancing Stylization and Truth via Disentangled Representation Steering
di: Shen, Chenglei, et al.
Pubblicazione: (2025)
di: Shen, Chenglei, et al.
Pubblicazione: (2025)
Language-Augmented Symbolic Planner for Open-World Task Planning
di: Chen, Guanqi, et al.
Pubblicazione: (2024)
di: Chen, Guanqi, et al.
Pubblicazione: (2024)
Reward Models in Deep Reinforcement Learning: A Survey
di: Yu, Rui, et al.
Pubblicazione: (2025)
di: Yu, Rui, et al.
Pubblicazione: (2025)
Energy-Guided Diffusion Sampling for Offline-to-Online Reinforcement Learning
di: Liu, Xu-Hui, et al.
Pubblicazione: (2024)
di: Liu, Xu-Hui, et al.
Pubblicazione: (2024)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
di: Yang, Rui, et al.
Pubblicazione: (2023)
di: Yang, Rui, et al.
Pubblicazione: (2023)
Attacking All Tasks at Once Using Adversarial Examples in Multi-Task Learning
di: Zhang, Lijun, et al.
Pubblicazione: (2023)
di: Zhang, Lijun, et al.
Pubblicazione: (2023)
Disentangling Foreground and Background for vision-Language Navigation via Online Augmentation
di: Xu, Yunbo, et al.
Pubblicazione: (2025)
di: Xu, Yunbo, et al.
Pubblicazione: (2025)
Augmenting Offline RL with Unlabeled Data
di: Wang, Zhao, et al.
Pubblicazione: (2024)
di: Wang, Zhao, et al.
Pubblicazione: (2024)
Your Offline Policy is Not Trustworthy: Bilevel Reinforcement Learning for Sequential Portfolio Optimization
di: Yuan, Haochen, et al.
Pubblicazione: (2025)
di: Yuan, Haochen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Debiased Offline Representation Learning for Fast Online Adaptation in Non-stationary Dynamics
di: Zhang, Xinyu, et al.
Pubblicazione: (2024) -
Q-Adapter: Customizing Pre-trained LLMs to New Preferences with Forgetting Mitigation
di: Li, Yi-Chen, et al.
Pubblicazione: (2024) -
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025) -
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024) -
Improving Sample Efficiency of Reinforcement Learning with Background Knowledge from Large Language Models
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)