Sample-Efficient Diffusion-based Reinforcement Learning with Critic Guidance
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ding, Shutong, Zhong, Zejia, Wang, Zhongyi, Hu, Ke, Pan, Bikang, Wang, Jingya, Shi, Ye |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Distributional Reinforcement Learning with Diffusion Bridge Critics
von: Ding, Shutong, et al.
Veröffentlicht: (2026)
von: Ding, Shutong, et al.
Veröffentlicht: (2026)
GenPO: Generative Diffusion Models Meet On-Policy Reinforcement Learning
von: Ding, Shutong, et al.
Veröffentlicht: (2025)
von: Ding, Shutong, et al.
Veröffentlicht: (2025)
Diffusion-based Reinforcement Learning via Q-weighted Variational Policy Optimization
von: Ding, Shutong, et al.
Veröffentlicht: (2024)
von: Ding, Shutong, et al.
Veröffentlicht: (2024)
Guidance with Spherical Gaussian Constraint for Conditional Diffusion
von: Yang, Lingxiao, et al.
Veröffentlicht: (2024)
von: Yang, Lingxiao, et al.
Veröffentlicht: (2024)
DreamPolicy: A Unified World-model Policy for Scalable Humanoid Locomotion
von: Fan, Yahao, et al.
Veröffentlicht: (2025)
von: Fan, Yahao, et al.
Veröffentlicht: (2025)
Drama: Mamba-Enabled Model-Based Reinforcement Learning Is Sample and Parameter Efficient
von: Wang, Wenlong, et al.
Veröffentlicht: (2024)
von: Wang, Wenlong, et al.
Veröffentlicht: (2024)
Robot Deformable Object Manipulation via NMPC-generated Demonstrations in Deep Reinforcement Learning
von: Wang, Haoyuan, et al.
Veröffentlicht: (2025)
von: Wang, Haoyuan, et al.
Veröffentlicht: (2025)
A Review of Online Diffusion Policy RL Algorithms for Scalable Robotic Control
von: Choi, Wonhyeok, et al.
Veröffentlicht: (2026)
von: Choi, Wonhyeok, et al.
Veröffentlicht: (2026)
SAC Flow: Sample-Efficient Reinforcement Learning of Flow-Based Policies via Velocity-Reparameterized Sequential Modeling
von: Zhang, Yixian, et al.
Veröffentlicht: (2025)
von: Zhang, Yixian, et al.
Veröffentlicht: (2025)
Disentangled Unsupervised Skill Discovery for Efficient Hierarchical Reinforcement Learning
von: Hu, Jiaheng, et al.
Veröffentlicht: (2024)
von: Hu, Jiaheng, et al.
Veröffentlicht: (2024)
SigmaRL: A Sample-Efficient and Generalizable Multi-Agent Reinforcement Learning Framework for Motion Planning
von: Xu, Jianye, et al.
Veröffentlicht: (2024)
von: Xu, Jianye, et al.
Veröffentlicht: (2024)
Novelty-based Sample Reuse for Continuous Robotics Control
von: Duan, Ke, et al.
Veröffentlicht: (2024)
von: Duan, Ke, et al.
Veröffentlicht: (2024)
Efficient Model-Based Reinforcement Learning Through Optimistic Thompson Sampling
von: Bayrooti, Jasmine, et al.
Veröffentlicht: (2024)
von: Bayrooti, Jasmine, et al.
Veröffentlicht: (2024)
Learning Diverse Robot Striking Motions with Diffusion Models and Kinematically Constrained Gradient Guidance
von: Lee, Kin Man, et al.
Veröffentlicht: (2024)
von: Lee, Kin Man, et al.
Veröffentlicht: (2024)
Sample Complexity of Distributionally Robust Off-Dynamics Reinforcement Learning with Online Interaction
von: He, Yiting, et al.
Veröffentlicht: (2025)
von: He, Yiting, et al.
Veröffentlicht: (2025)
Sample from What You See: Visuomotor Policy Learning via Diffusion Bridge with Observation-Embedded Stochastic Differential Equation
von: Liu, Zhaoyang, et al.
Veröffentlicht: (2025)
von: Liu, Zhaoyang, et al.
Veröffentlicht: (2025)
E2HiL: Entropy-Guided Sample Selection for Efficient Real-World Human-in-the-Loop Reinforcement Learning
von: Deng, Haoyuan, et al.
Veröffentlicht: (2026)
von: Deng, Haoyuan, et al.
Veröffentlicht: (2026)
Federated Learning from Vision-Language Foundation Models: Theoretical Analysis and Method
von: Pan, Bikang, et al.
Veröffentlicht: (2024)
von: Pan, Bikang, et al.
Veröffentlicht: (2024)
Certificated Actor-Critic: Hierarchical Reinforcement Learning with Control Barrier Functions for Safe Navigation
von: Xie, Junjun, et al.
Veröffentlicht: (2025)
von: Xie, Junjun, et al.
Veröffentlicht: (2025)
Enhancing Sample Efficiency and Exploration in Reinforcement Learning through the Integration of Diffusion Models and Proximal Policy Optimization
von: Gao, Tianci, et al.
Veröffentlicht: (2024)
von: Gao, Tianci, et al.
Veröffentlicht: (2024)
Optimal Actuator Attacks on Autonomous Vehicles Using Reinforcement Learning
von: Wang, Pengyu, et al.
Veröffentlicht: (2025)
von: Wang, Pengyu, et al.
Veröffentlicht: (2025)
Learn to Teach: Sample-Efficient Privileged Learning for Humanoid Locomotion over Diverse Terrains
von: Wu, Feiyang, et al.
Veröffentlicht: (2024)
von: Wu, Feiyang, et al.
Veröffentlicht: (2024)
Pretraining in Actor-Critic Reinforcement Learning for Robot Locomotion
von: Fan, Jiale, et al.
Veröffentlicht: (2025)
von: Fan, Jiale, et al.
Veröffentlicht: (2025)
XPG-RL: Reinforcement Learning with Explainable Priority Guidance for Efficiency-Boosted Mechanical Search
von: Zhang, Yiting, et al.
Veröffentlicht: (2025)
von: Zhang, Yiting, et al.
Veröffentlicht: (2025)
SCRIPT: Scalable Diffusion Policy with Multi-stage Training for Language-driven Physics-based Humanoid Control
von: Zhang, Jingyan, et al.
Veröffentlicht: (2026)
von: Zhang, Jingyan, et al.
Veröffentlicht: (2026)
Time Reversal Symmetry for Efficient Robotic Manipulations in Deep Reinforcement Learning
von: Jiang, Yunpeng, et al.
Veröffentlicht: (2025)
von: Jiang, Yunpeng, et al.
Veröffentlicht: (2025)
Frugal Actor-Critic: Sample Efficient Off-Policy Deep Reinforcement Learning Using Unique Experiences
von: Singh, Nikhil Kumar, et al.
Veröffentlicht: (2024)
von: Singh, Nikhil Kumar, et al.
Veröffentlicht: (2024)
CoVO-MPC: Theoretical Analysis of Sampling-based MPC and Optimal Covariance Design
von: Yi, Zeji, et al.
Veröffentlicht: (2024)
von: Yi, Zeji, et al.
Veröffentlicht: (2024)
Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own
von: Ye, Weirui, et al.
Veröffentlicht: (2023)
von: Ye, Weirui, et al.
Veröffentlicht: (2023)
AdvDiffuser: Generating Adversarial Safety-Critical Driving Scenarios via Guided Diffusion
von: Xie, Yuting, et al.
Veröffentlicht: (2024)
von: Xie, Yuting, et al.
Veröffentlicht: (2024)
DreamerAD: Efficient Reinforcement Learning via Latent World Model for Autonomous Driving
von: Yang, Pengxuan, et al.
Veröffentlicht: (2026)
von: Yang, Pengxuan, et al.
Veröffentlicht: (2026)
Sum of Costs Diffusion with Dynamic Guidance for Motion Planning
von: Kaplan, Aysu Aylin, et al.
Veröffentlicht: (2026)
von: Kaplan, Aysu Aylin, et al.
Veröffentlicht: (2026)
Off-Dynamics Reinforcement Learning via Domain Adaptation and Reward Augmented Imitation
von: Guo, Yihong, et al.
Veröffentlicht: (2024)
von: Guo, Yihong, et al.
Veröffentlicht: (2024)
Deep Reinforcement Learning-Based User Scheduling for Collaborative Perception
von: Liu, Yandi, et al.
Veröffentlicht: (2025)
von: Liu, Yandi, et al.
Veröffentlicht: (2025)
DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy
von: Zhou, Weitao, et al.
Veröffentlicht: (2025)
von: Zhou, Weitao, et al.
Veröffentlicht: (2025)
Safety-Critical Scenario Generation Via Reinforcement Learning Based Editing
von: Liu, Haolan, et al.
Veröffentlicht: (2023)
von: Liu, Haolan, et al.
Veröffentlicht: (2023)
Data-Efficient Task Generalization via Probabilistic Model-based Meta Reinforcement Learning
von: Bhardwaj, Arjun, et al.
Veröffentlicht: (2023)
von: Bhardwaj, Arjun, et al.
Veröffentlicht: (2023)
Goal-Reaching Policy Learning from Non-Expert Observations via Effective Subgoal Guidance
von: Huang, RenMing, et al.
Veröffentlicht: (2024)
von: Huang, RenMing, et al.
Veröffentlicht: (2024)
Research on Autonomous Robots Navigation based on Reinforcement Learning
von: Wang, Zixiang, et al.
Veröffentlicht: (2024)
von: Wang, Zixiang, et al.
Veröffentlicht: (2024)
Diffusion-based learning framework for Constrained Nonconvex Optimization with Weighted Bootstrapped Refinement
von: Ding, Shutong, et al.
Veröffentlicht: (2025)
von: Ding, Shutong, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Distributional Reinforcement Learning with Diffusion Bridge Critics
von: Ding, Shutong, et al.
Veröffentlicht: (2026) -
GenPO: Generative Diffusion Models Meet On-Policy Reinforcement Learning
von: Ding, Shutong, et al.
Veröffentlicht: (2025) -
Diffusion-based Reinforcement Learning via Q-weighted Variational Policy Optimization
von: Ding, Shutong, et al.
Veröffentlicht: (2024) -
Guidance with Spherical Gaussian Constraint for Conditional Diffusion
von: Yang, Lingxiao, et al.
Veröffentlicht: (2024) -
DreamPolicy: A Unified World-model Policy for Scalable Humanoid Locomotion
von: Fan, Yahao, et al.
Veröffentlicht: (2025)