Continual Offline Reinforcement Learning via Diffusion-based Dual Generative Replay
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Jinmei, Li, Wenbin, Yue, Xiangyu, Zhang, Shilin, Chen, Chunlin, Wang, Zhi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
Beyond the Dirac Delta: Mitigating Diversity Collapse in Reinforcement Fine-Tuning for Versatile Image Generation
di: Liu, Jinmei, et al.
Pubblicazione: (2026)
di: Liu, Jinmei, et al.
Pubblicazione: (2026)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
di: Huang, Xiao, et al.
Pubblicazione: (2025)
di: Huang, Xiao, et al.
Pubblicazione: (2025)
Continual Diffuser (CoD): Mastering Continual Offline Reinforcement Learning with Experience Rehearsal
di: Hu, Jifeng, et al.
Pubblicazione: (2024)
di: Hu, Jifeng, et al.
Pubblicazione: (2024)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
Discretizing Continuous Action Space with Unimodal Probability Distributions for On-Policy Reinforcement Learning
di: Zhu, Yuanyang, et al.
Pubblicazione: (2024)
di: Zhu, Yuanyang, et al.
Pubblicazione: (2024)
EFRame: Deeper Reasoning via Exploration-Filter-Replay Reinforcement Learning Framework
di: Wang, Chen, et al.
Pubblicazione: (2025)
di: Wang, Chen, et al.
Pubblicazione: (2025)
Better Generative Replay for Continual Federated Learning
di: Qi, Daiqing, et al.
Pubblicazione: (2023)
di: Qi, Daiqing, et al.
Pubblicazione: (2023)
Solving Continual Offline Reinforcement Learning with Decision Transformer
di: Huang, Kaixin, et al.
Pubblicazione: (2024)
di: Huang, Kaixin, et al.
Pubblicazione: (2024)
LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning
di: Zhang, Hanping, et al.
Pubblicazione: (2025)
di: Zhang, Hanping, et al.
Pubblicazione: (2025)
Scalable In-Context Q-Learning
di: Liu, Jinmei, et al.
Pubblicazione: (2025)
di: Liu, Jinmei, et al.
Pubblicazione: (2025)
DiffStitch: Boosting Offline Reinforcement Learning with Diffusion-based Trajectory Stitching
di: Li, Guanghe, et al.
Pubblicazione: (2024)
di: Li, Guanghe, et al.
Pubblicazione: (2024)
Efficient Diversity-based Experience Replay for Deep Reinforcement Learning
di: Zhao, Kaiyan, et al.
Pubblicazione: (2024)
di: Zhao, Kaiyan, et al.
Pubblicazione: (2024)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
di: Chen, Rufeng, et al.
Pubblicazione: (2026)
di: Chen, Rufeng, et al.
Pubblicazione: (2026)
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
di: Mao, Liyuan, et al.
Pubblicazione: (2024)
di: Mao, Liyuan, et al.
Pubblicazione: (2024)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
di: Yang, Yiqin, et al.
Pubblicazione: (2026)
di: Yang, Yiqin, et al.
Pubblicazione: (2026)
Dual-LoRA and Quality-Enhanced Pseudo Replay for Multimodal Continual Food Learning
di: Wu, Xinlan, et al.
Pubblicazione: (2025)
di: Wu, Xinlan, et al.
Pubblicazione: (2025)
AL-GNN: Privacy-Preserving and Replay-Free Continual Graph Learning via Analytic Learning
di: Zhang, Xuling, et al.
Pubblicazione: (2025)
di: Zhang, Xuling, et al.
Pubblicazione: (2025)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024)
MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning
di: Yuan, Yifu, et al.
Pubblicazione: (2024)
di: Yuan, Yifu, et al.
Pubblicazione: (2024)
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning
di: Liu, Jinyi, et al.
Pubblicazione: (2023)
di: Liu, Jinyi, et al.
Pubblicazione: (2023)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
di: Tu, Songjun, et al.
Pubblicazione: (2024)
di: Tu, Songjun, et al.
Pubblicazione: (2024)
Mixture-of-Experts Meets In-Context Reinforcement Learning
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
State-Constrained Offline Reinforcement Learning
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Generative Trajectory Policies
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
Beyond Penalization: Diffusion-based Out-of-Distribution Detection and Selective Regularization in Offline Reinforcement Learning
di: Wang, Qingjun, et al.
Pubblicazione: (2026)
di: Wang, Qingjun, et al.
Pubblicazione: (2026)
DAWM: Diffusion Action World Models for Offline Reinforcement Learning via Action-Inferred Transitions
di: Li, Zongyue, et al.
Pubblicazione: (2025)
di: Li, Zongyue, et al.
Pubblicazione: (2025)
The Generalization Gap in Offline Reinforcement Learning
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
Diffusion Policies creating a Trust Region for Offline Reinforcement Learning
di: Chen, Tianyu, et al.
Pubblicazione: (2024)
di: Chen, Tianyu, et al.
Pubblicazione: (2024)
Provable Zero-Shot Generalization in Offline Reinforcement Learning
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
FOVA: Offline Federated Reinforcement Learning with Mixed-Quality Data
di: Qiao, Nan, et al.
Pubblicazione: (2025)
di: Qiao, Nan, et al.
Pubblicazione: (2025)
CCD: Continual Consistency Diffusion for Lifelong Generative Modeling
di: Liu, Jingren, et al.
Pubblicazione: (2025)
di: Liu, Jingren, et al.
Pubblicazione: (2025)
KAN v.s. MLP for Offline Reinforcement Learning
di: Guo, Haihong, et al.
Pubblicazione: (2024)
di: Guo, Haihong, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Discrete Diffusion Skills
di: Qiao, RuiXi, et al.
Pubblicazione: (2025)
di: Qiao, RuiXi, et al.
Pubblicazione: (2025)
GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay
di: Zhang, Yunan, et al.
Pubblicazione: (2025)
di: Zhang, Yunan, et al.
Pubblicazione: (2025)
t-DGR: A Trajectory-Based Deep Generative Replay Method for Continual Learning in Decision Making
di: Yue, William, et al.
Pubblicazione: (2024)
di: Yue, William, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
di: Song, Chihyeon, et al.
Pubblicazione: (2025) -
Beyond the Dirac Delta: Mitigating Diversity Collapse in Reinforcement Fine-Tuning for Versatile Image Generation
di: Liu, Jinmei, et al.
Pubblicazione: (2026) -
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
di: Huang, Xiao, et al.
Pubblicazione: (2025) -
Continual Diffuser (CoD): Mastering Continual Offline Reinforcement Learning with Experience Rehearsal
di: Hu, Jifeng, et al.
Pubblicazione: (2024) -
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
di: Zhang, Tianle, et al.
Pubblicazione: (2024)