Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Cao, Hongye, Feng, Fan, Huo, Jing, Yang, Shangdong, Fang, Meng, Yang, Tianpei, Gao, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Causal Information Prioritization for Efficient Reinforcement Learning
di: Cao, Hongye, et al.
Pubblicazione: (2025)
di: Cao, Hongye, et al.
Pubblicazione: (2025)
Towards Empowerment Gain through Causal Structure Learning in Model-Based RL
di: Cao, Hongye, et al.
Pubblicazione: (2025)
di: Cao, Hongye, et al.
Pubblicazione: (2025)
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
di: Xu, Jiawei, et al.
Pubblicazione: (2024)
di: Xu, Jiawei, et al.
Pubblicazione: (2024)
Disentangling Policy from Offline Task Representation Learning via Adversarial Data Augmentation
di: Jia, Chengxing, et al.
Pubblicazione: (2024)
di: Jia, Chengxing, et al.
Pubblicazione: (2024)
GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models
di: Wang, Mianchu, et al.
Pubblicazione: (2023)
di: Wang, Mianchu, et al.
Pubblicazione: (2023)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024)
Model-Based Proactive Cost Generation for Learning Safe Policies Offline with Limited Violation Data
di: Xue, Ruiqi, et al.
Pubblicazione: (2026)
di: Xue, Ruiqi, et al.
Pubblicazione: (2026)
Efficient Last-iterate Convergence Algorithms in Solving Games
di: Meng, Linjian, et al.
Pubblicazione: (2023)
di: Meng, Linjian, et al.
Pubblicazione: (2023)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
Efficient Reinforcement Learning with Semantic and Token Entropy for LLM Reasoning
di: Cao, Hongye, et al.
Pubblicazione: (2025)
di: Cao, Hongye, et al.
Pubblicazione: (2025)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
di: Guo, Yihong, et al.
Pubblicazione: (2025)
di: Guo, Yihong, et al.
Pubblicazione: (2025)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
di: Pan, Minting, et al.
Pubblicazione: (2023)
di: Pan, Minting, et al.
Pubblicazione: (2023)
Offline Imitation Learning with Model-based Reverse Augmentation
di: Shao, Jie-Jing, et al.
Pubblicazione: (2024)
di: Shao, Jie-Jing, et al.
Pubblicazione: (2024)
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
di: Huang, Xingshuai, et al.
Pubblicazione: (2024)
di: Huang, Xingshuai, et al.
Pubblicazione: (2024)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
di: Yang, Yiqin, et al.
Pubblicazione: (2026)
di: Yang, Yiqin, et al.
Pubblicazione: (2026)
Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach
di: Pan, Minting, et al.
Pubblicazione: (2025)
di: Pan, Minting, et al.
Pubblicazione: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
Manifold-Constrained Energy-Based Transition Models for Offline Reinforcement Learning
di: Fang, Zeyu, et al.
Pubblicazione: (2026)
di: Fang, Zeyu, et al.
Pubblicazione: (2026)
A Variance Minimization Approach to Temporal-Difference Learning
di: Chen, Xingguo, et al.
Pubblicazione: (2024)
di: Chen, Xingguo, et al.
Pubblicazione: (2024)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
di: Wen, Xiaoyu, et al.
Pubblicazione: (2024)
di: Wen, Xiaoyu, et al.
Pubblicazione: (2024)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
di: Yang, Rui, et al.
Pubblicazione: (2023)
di: Yang, Rui, et al.
Pubblicazione: (2023)
Knowledgeable Agents by Offline Reinforcement Learning from Large Language Model Rollouts
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2024)
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2024)
Policy Constraint by Only Support Constraint for Offline Reinforcement Learning
di: Gao, Yunkai, et al.
Pubblicazione: (2025)
di: Gao, Yunkai, et al.
Pubblicazione: (2025)
Adversarial Policy Optimization for Offline Preference-based Reinforcement Learning
di: Kang, Hyungkyu, et al.
Pubblicazione: (2025)
di: Kang, Hyungkyu, et al.
Pubblicazione: (2025)
Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning
di: Zhou, Xue, et al.
Pubblicazione: (2025)
di: Zhou, Xue, et al.
Pubblicazione: (2025)
Uncertainty-based Offline Variational Bayesian Reinforcement Learning for Robustness under Diverse Data Corruptions
di: Yang, Rui, et al.
Pubblicazione: (2024)
di: Yang, Rui, et al.
Pubblicazione: (2024)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2025)
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2025)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
Provable Zero-Shot Generalization in Offline Reinforcement Learning
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
di: Gao, Xiancheng, et al.
Pubblicazione: (2025)
di: Gao, Xiancheng, et al.
Pubblicazione: (2025)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
Offline Model-Based Reinforcement Learning with Anti-Exploration
di: Srinivasan, Padmanaba, et al.
Pubblicazione: (2024)
di: Srinivasan, Padmanaba, et al.
Pubblicazione: (2024)
GTA: Generative Trajectory Augmentation with Guidance for Offline Reinforcement Learning
di: Lee, Jaewoo, et al.
Pubblicazione: (2024)
di: Lee, Jaewoo, et al.
Pubblicazione: (2024)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
di: Yang, Letian, et al.
Pubblicazione: (2026)
di: Yang, Letian, et al.
Pubblicazione: (2026)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
di: Chen, Rufeng, et al.
Pubblicazione: (2026)
di: Chen, Rufeng, et al.
Pubblicazione: (2026)
Bellman Error Centering
di: Chen, Xingguo, et al.
Pubblicazione: (2025)
di: Chen, Xingguo, et al.
Pubblicazione: (2025)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
di: Sims, Anya, et al.
Pubblicazione: (2024)
di: Sims, Anya, et al.
Pubblicazione: (2024)
FPGA Divide-and-Conquer Placement using Deep Reinforcement Learning
di: Wang, Shang, et al.
Pubblicazione: (2024)
di: Wang, Shang, et al.
Pubblicazione: (2024)
Model-Based Offline Reinforcement Learning with Reliability-Guaranteed Sequence Modeling
di: He, Shenghong
Pubblicazione: (2025)
di: He, Shenghong
Pubblicazione: (2025)
Documenti analoghi
-
Causal Information Prioritization for Efficient Reinforcement Learning
di: Cao, Hongye, et al.
Pubblicazione: (2025) -
Towards Empowerment Gain through Causal Structure Learning in Model-Based RL
di: Cao, Hongye, et al.
Pubblicazione: (2025) -
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
di: Xu, Jiawei, et al.
Pubblicazione: (2024) -
Disentangling Policy from Offline Task Representation Learning via Adversarial Data Augmentation
di: Jia, Chengxing, et al.
Pubblicazione: (2024) -
GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models
di: Wang, Mianchu, et al.
Pubblicazione: (2023)