DyDiff: Long-Horizon Rollout via Dynamics Diffusion for Offline Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Hanye, Han, Xiaoshen, Zhu, Zhengbang, Liu, Minghuan, Yu, Yong, Zhan, De-Chuan, Zhang, Weinan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DiffStitch: Boosting Offline Reinforcement Learning with Diffusion-based Trajectory Stitching
por: Li, Guanghe, et al.
Publicado: (2024)
por: Li, Guanghe, et al.
Publicado: (2024)
MADiff: Offline Multi-agent Learning with Diffusion Models
por: Zhu, Zhengbang, et al.
Publicado: (2023)
por: Zhu, Zhengbang, et al.
Publicado: (2023)
Diffusion Models for Reinforcement Learning: A Survey
por: Zhu, Zhengbang, et al.
Publicado: (2023)
por: Zhu, Zhengbang, et al.
Publicado: (2023)
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
por: Mao, Liyuan, et al.
Publicado: (2024)
por: Mao, Liyuan, et al.
Publicado: (2024)
DiffusionRollout: Uncertainty-Aware Rollout Planning in Long-Horizon PDE Solving
por: Yoo, Seungwoo, et al.
Publicado: (2026)
por: Yoo, Seungwoo, et al.
Publicado: (2026)
Re$^3$Sim: Generating High-Fidelity Simulation Data via 3D-Photorealistic Real-to-Sim for Robotic Manipulation
por: Han, Xiaoshen, et al.
Publicado: (2025)
por: Han, Xiaoshen, et al.
Publicado: (2025)
RHINO: Learning Real-Time Humanoid-Human-Object Interaction from Human Demonstrations
por: Chen, Jingxiao, et al.
Publicado: (2025)
por: Chen, Jingxiao, et al.
Publicado: (2025)
Manipulation as in Simulation: Enabling Accurate Geometry Perception in Robots
por: Liu, Minghuan, et al.
Publicado: (2025)
por: Liu, Minghuan, et al.
Publicado: (2025)
Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning
por: Ding, Zihan, et al.
Publicado: (2024)
por: Ding, Zihan, et al.
Publicado: (2024)
Contrastive Diffuser: Planning Towards High Return States via Contrastive Learning
por: Shan, Yixiang, et al.
Publicado: (2024)
por: Shan, Yixiang, et al.
Publicado: (2024)
Knowledgeable Agents by Offline Reinforcement Learning from Large Language Model Rollouts
por: Pang, Jing-Cheng, et al.
Publicado: (2024)
por: Pang, Jing-Cheng, et al.
Publicado: (2024)
Planning Transformer: Long-Horizon Offline Reinforcement Learning with Planning Tokens
por: Clinton, Joseph, et al.
Publicado: (2024)
por: Clinton, Joseph, et al.
Publicado: (2024)
APRIL: Active Partial Rollouts in Reinforcement Learning to Tame Long-tail Generation
por: Zhou, Yuzhen, et al.
Publicado: (2025)
por: Zhou, Yuzhen, et al.
Publicado: (2025)
Long-Horizon Model-Based Offline Reinforcement Learning Without Explicit Conservatism
por: Ni, Tianwei, et al.
Publicado: (2025)
por: Ni, Tianwei, et al.
Publicado: (2025)
BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning
por: Qing, Yunpeng, et al.
Publicado: (2025)
por: Qing, Yunpeng, et al.
Publicado: (2025)
DiffCPS: Diffusion Model based Constrained Policy Search for Offline Reinforcement Learning
por: He, Longxiang, et al.
Publicado: (2023)
por: He, Longxiang, et al.
Publicado: (2023)
DiffPoGAN: Diffusion Policies with Generative Adversarial Networks for Offline Reinforcement Learning
por: Hu, Xuemin, et al.
Publicado: (2024)
por: Hu, Xuemin, et al.
Publicado: (2024)
Is Risk-Sensitive Reinforcement Learning Properly Resolved?
por: Zhou, Ruiwen, et al.
Publicado: (2023)
por: Zhou, Ruiwen, et al.
Publicado: (2023)
Adaptive Coarse-to-Fine Subgoal Refinement for Long-Horizon Offline Goal-Conditioned Reinforcement Learning
por: Ke, Kaiqiang, et al.
Publicado: (2026)
por: Ke, Kaiqiang, et al.
Publicado: (2026)
Offline Reinforcement Learning with Universal Horizon Models
por: Chung, Hojun, et al.
Publicado: (2026)
por: Chung, Hojun, et al.
Publicado: (2026)
Horizon Imagination: Efficient On-Policy Rollout in Diffusion World Models
por: Cohen, Lior, et al.
Publicado: (2026)
por: Cohen, Lior, et al.
Publicado: (2026)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
por: Zheng, Yinan, et al.
Publicado: (2024)
por: Zheng, Yinan, et al.
Publicado: (2024)
ShieldDiff: Suppressing Sexual Content Generation from Diffusion Models through Reinforcement Learning
por: Han, Dong, et al.
Publicado: (2024)
por: Han, Dong, et al.
Publicado: (2024)
Horizon Reduction as Information Loss in Offline Reinforcement Learning
por: Nidadala, Uday Kumar, et al.
Publicado: (2025)
por: Nidadala, Uday Kumar, et al.
Publicado: (2025)
D4W: Dependable Data-Driven Dynamics for Wheeled Robots
por: Lin, Yunfeng, et al.
Publicado: (2024)
por: Lin, Yunfeng, et al.
Publicado: (2024)
Distribution Corrected Offline Data Distillation for Large Language Models
por: Zhang, Yumeng, et al.
Publicado: (2026)
por: Zhang, Yumeng, et al.
Publicado: (2026)
FP4 Explore, BF16 Train: Diffusion Reinforcement Learning via Efficient Rollout Scaling
por: Li, Yitong, et al.
Publicado: (2026)
por: Li, Yitong, et al.
Publicado: (2026)
Residuals-based Offline Reinforcement Learning
por: Zhu, Qing, et al.
Publicado: (2026)
por: Zhu, Qing, et al.
Publicado: (2026)
SGNO: Spectral Generator Neural Operators for Stable Long Horizon PDE Rollouts
por: Li, Jiayi, et al.
Publicado: (2026)
por: Li, Jiayi, et al.
Publicado: (2026)
EchoRL: Reinforcement Learning via Rollout Echoing
por: Bi, Jinhe, et al.
Publicado: (2026)
por: Bi, Jinhe, et al.
Publicado: (2026)
Not All Rollouts are Useful: Down-Sampling Rollouts in LLM Reinforcement Learning
por: Xu, Yixuan Even, et al.
Publicado: (2025)
por: Xu, Yixuan Even, et al.
Publicado: (2025)
$V_{0.5}$: Generalist Value Model as a Prior for Sparse RL Rollouts
por: Zhang, Yi-Kai, et al.
Publicado: (2026)
por: Zhang, Yi-Kai, et al.
Publicado: (2026)
Looking Ahead to Avoid Being Late: Solving Hard-Constrained Traveling Salesman Problem
por: Chen, Jingxiao, et al.
Publicado: (2024)
por: Chen, Jingxiao, et al.
Publicado: (2024)
On Rollouts in Model-Based Reinforcement Learning
por: Frauenknecht, Bernd, et al.
Publicado: (2025)
por: Frauenknecht, Bernd, et al.
Publicado: (2025)
ASTRO: Adaptive Stitching via Dynamics-Guided Trajectory Rollouts
por: Yu, Hang, et al.
Publicado: (2025)
por: Yu, Hang, et al.
Publicado: (2025)
DiffClass: Diffusion-Based Class Incremental Learning
por: Meng, Zichong, et al.
Publicado: (2024)
por: Meng, Zichong, et al.
Publicado: (2024)
SRT: Accelerating Reinforcement Learning via Speculative Rollout with Tree-Structured Cache
por: Chang, Chi-Chih, et al.
Publicado: (2026)
por: Chang, Chi-Chih, et al.
Publicado: (2026)
BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning
por: Xu, Yuhang, et al.
Publicado: (2026)
por: Xu, Yuhang, et al.
Publicado: (2026)
Optimistic Model Rollouts for Pessimistic Offline Policy Optimization
por: Zhai, Yuanzhao, et al.
Publicado: (2024)
por: Zhai, Yuanzhao, et al.
Publicado: (2024)
Jet-RL: Enabling On-Policy FP8 Reinforcement Learning with Unified Training and Rollout Precision Flow
por: Xi, Haocheng, et al.
Publicado: (2026)
por: Xi, Haocheng, et al.
Publicado: (2026)
Ejemplares similares
-
DiffStitch: Boosting Offline Reinforcement Learning with Diffusion-based Trajectory Stitching
por: Li, Guanghe, et al.
Publicado: (2024) -
MADiff: Offline Multi-agent Learning with Diffusion Models
por: Zhu, Zhengbang, et al.
Publicado: (2023) -
Diffusion Models for Reinforcement Learning: A Survey
por: Zhu, Zhengbang, et al.
Publicado: (2023) -
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
por: Mao, Liyuan, et al.
Publicado: (2024) -
DiffusionRollout: Uncertainty-Aware Rollout Planning in Long-Horizon PDE Solving
por: Yoo, Seungwoo, et al.
Publicado: (2026)