Diffusion Policy through Conditional Proximal Policy Optimization
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Ben, Yang, Shunpeng, Chen, Hua |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
by: Yang, Shunpeng, et al.
Published: (2026)
by: Yang, Shunpeng, et al.
Published: (2026)
Enhancing Sample Efficiency and Exploration in Reinforcement Learning through the Integration of Diffusion Models and Proximal Policy Optimization
by: Gao, Tianci, et al.
Published: (2024)
by: Gao, Tianci, et al.
Published: (2024)
Diffusion Policy Policy Optimization
by: Ren, Allen Z., et al.
Published: (2024)
by: Ren, Allen Z., et al.
Published: (2024)
ERPPO: Entropy Regularization-based Proximal Policy Optimization
by: Lee, Changha, et al.
Published: (2026)
by: Lee, Changha, et al.
Published: (2026)
Dichotomous Diffusion Policy Optimization
by: Liang, Ruiming, et al.
Published: (2025)
by: Liang, Ruiming, et al.
Published: (2025)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
by: Ma, Yunchang, et al.
Published: (2025)
by: Ma, Yunchang, et al.
Published: (2025)
Encoding Predictability and Legibility for Style-Conditioned Diffusion Policy
by: Crétides, Adrien Jacquet, et al.
Published: (2026)
by: Crétides, Adrien Jacquet, et al.
Published: (2026)
Adaptive Diffusion Policy Optimization for Robotic Manipulation
by: Jiang, Huiyun, et al.
Published: (2025)
by: Jiang, Huiyun, et al.
Published: (2025)
One-Step Diffusion Policy: Fast Visuomotor Policies via Diffusion Distillation
by: Wang, Zhendong, et al.
Published: (2024)
by: Wang, Zhendong, et al.
Published: (2024)
VEGA: Electric Vehicle Navigation Agent via Physics-Informed Neural Operator and Proximal Policy Optimization
by: Lim, Hansol, et al.
Published: (2025)
by: Lim, Hansol, et al.
Published: (2025)
State-wise Constrained Policy Optimization
by: Zhao, Weiye, et al.
Published: (2023)
by: Zhao, Weiye, et al.
Published: (2023)
Equivariant Diffusion Policy
by: Wang, Dian, et al.
Published: (2024)
by: Wang, Dian, et al.
Published: (2024)
DADP: Domain Adaptive Diffusion Policy
by: Wang, Pengcheng, et al.
Published: (2026)
by: Wang, Pengcheng, et al.
Published: (2026)
Absolute Policy Optimization
by: Zhao, Weiye, et al.
Published: (2023)
by: Zhao, Weiye, et al.
Published: (2023)
Latent Policy Steering through One-Step Flow Policies
by: Im, Hokyun, et al.
Published: (2026)
by: Im, Hokyun, et al.
Published: (2026)
FocalPolicy: Frequency-Optimized Chunking and Locally Anchored Flow Matching for Coherent Visuomotor Policy
by: He, Qian, et al.
Published: (2026)
by: He, Qian, et al.
Published: (2026)
Query-Centric Diffusion Policy for Generalizable Robotic Assembly
by: Xu, Ziyi, et al.
Published: (2025)
by: Xu, Ziyi, et al.
Published: (2025)
Sparse Diffusion Policy: A Sparse, Reusable, and Flexible Policy for Robot Learning
by: Wang, Yixiao, et al.
Published: (2024)
by: Wang, Yixiao, et al.
Published: (2024)
FDPP: Fine-tune Diffusion Policy with Human Preference
by: Chen, Yuxin, et al.
Published: (2025)
by: Chen, Yuxin, et al.
Published: (2025)
Unpacking the Individual Components of Diffusion Policy
by: Yuan, Xiu
Published: (2024)
by: Yuan, Xiu
Published: (2024)
MePoly: Max Entropy Polynomial Policy Optimization
by: Liu, Hang, et al.
Published: (2026)
by: Liu, Hang, et al.
Published: (2026)
BiKC: Keypose-Conditioned Consistency Policy for Bimanual Robotic Manipulation
by: Yu, Dongjie, et al.
Published: (2024)
by: Yu, Dongjie, et al.
Published: (2024)
Assigning Credit with Partial Reward Decoupling in Multi-Agent Proximal Policy Optimization
by: Kapoor, Aditya, et al.
Published: (2024)
by: Kapoor, Aditya, et al.
Published: (2024)
Discrete GCBF Proximal Policy Optimization for Multi-agent Safe Optimal Control
by: Zhang, Songyuan, et al.
Published: (2025)
by: Zhang, Songyuan, et al.
Published: (2025)
Tempered Sequential Monte Carlo for Trajectory and Policy Optimization with Differentiable Dynamics
by: Yang, Heng
Published: (2026)
by: Yang, Heng
Published: (2026)
Accelerating Visual-Policy Learning through Parallel Differentiable Simulation
by: You, Haoxiang, et al.
Published: (2025)
by: You, Haoxiang, et al.
Published: (2025)
Policy-Guided Diffusion
by: Jackson, Matthew Thomas, et al.
Published: (2024)
by: Jackson, Matthew Thomas, et al.
Published: (2024)
Language-Conditioned Representations and Mixture-of-Experts Policy for Robust Multi-Task Robotic Manipulation
by: Zhang, Xiucheng, et al.
Published: (2025)
by: Zhang, Xiucheng, et al.
Published: (2025)
Evolutionary Policy Optimization
by: Wang, Jianren, et al.
Published: (2025)
by: Wang, Jianren, et al.
Published: (2025)
Latent-Conditioned Policy Gradient for Multi-Objective Deep Reinforcement Learning
by: Kanazawa, Takuya, et al.
Published: (2023)
by: Kanazawa, Takuya, et al.
Published: (2023)
Learning Generalizable Visuomotor Policy through Dynamics-Alignment
by: Lee, Dohyeok, et al.
Published: (2025)
by: Lee, Dohyeok, et al.
Published: (2025)
Training-Free Imitation Learning with Closed-Form Diffusion Policies
by: Mishra, Raghav, et al.
Published: (2026)
by: Mishra, Raghav, et al.
Published: (2026)
Time-Unified Diffusion Policy with Action Discrimination for Robotic Manipulation
by: Niu, Ye, et al.
Published: (2025)
by: Niu, Ye, et al.
Published: (2025)
Uncertainty Comes for Free: Human-in-the-Loop Policies with Diffusion Models
by: He, Zhanpeng, et al.
Published: (2025)
by: He, Zhanpeng, et al.
Published: (2025)
From Code to Action: Hierarchical Learning of Diffusion-VLM Policies
by: Peschl, Markus, et al.
Published: (2025)
by: Peschl, Markus, et al.
Published: (2025)
Symmetry-Aware Steering of Equivariant Diffusion Policies: Benefits and Limits
by: Park, Minwoo, et al.
Published: (2025)
by: Park, Minwoo, et al.
Published: (2025)
Steering Your Diffusion Policy with Latent Space Reinforcement Learning
by: Wagenmaker, Andrew, et al.
Published: (2025)
by: Wagenmaker, Andrew, et al.
Published: (2025)
Real-Time Operator Takeover for Visuomotor Diffusion Policy Training
by: Moletta, Marco, et al.
Published: (2025)
by: Moletta, Marco, et al.
Published: (2025)
Robust Adversarial Policy Optimization Under Dynamics Uncertainty
by: Kim, Mintae, et al.
Published: (2026)
by: Kim, Mintae, et al.
Published: (2026)
Reactive Diffusion Policy: Slow-Fast Visual-Tactile Policy Learning for Contact-Rich Manipulation
by: Xue, Han, et al.
Published: (2025)
by: Xue, Han, et al.
Published: (2025)
Similar Items
-
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
by: Yang, Shunpeng, et al.
Published: (2026) -
Enhancing Sample Efficiency and Exploration in Reinforcement Learning through the Integration of Diffusion Models and Proximal Policy Optimization
by: Gao, Tianci, et al.
Published: (2024) -
Diffusion Policy Policy Optimization
by: Ren, Allen Z., et al.
Published: (2024) -
ERPPO: Entropy Regularization-based Proximal Policy Optimization
by: Lee, Changha, et al.
Published: (2026) -
Dichotomous Diffusion Policy Optimization
by: Liang, Ruiming, et al.
Published: (2025)