Diffusion Policy Policy Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ren, Allen Z., Lidard, Justin, Ankile, Lars L., Simeonov, Anthony, Agrawal, Pulkit, Majumdar, Anirudha, Burchfiel, Benjamin, Dai, Hongkai, Simchowitz, Max |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
JUICER: Data-Efficient Imitation Learning for Robotic Assembly
par: Ankile, Lars, et autres
Publié: (2024)
par: Ankile, Lars, et autres
Publié: (2024)
From Imitation to Refinement -- Residual RL for Precise Assembly
par: Ankile, Lars, et autres
Publié: (2024)
par: Ankile, Lars, et autres
Publié: (2024)
Robot Learning with Super-Linear Scaling
par: Torne, Marcel, et autres
Publié: (2024)
par: Torne, Marcel, et autres
Publié: (2024)
Run-time Observation Interventions Make Vision-Language-Action Models More Visually Robust
par: Hancock, Asher J., et autres
Publié: (2024)
par: Hancock, Asher J., et autres
Publié: (2024)
Residual Off-Policy RL for Finetuning Behavior Cloning Policies
par: Ankile, Lars, et autres
Publié: (2025)
par: Ankile, Lars, et autres
Publié: (2025)
DexHub and DART: Towards Internet Scale Robot Data Collection
par: Park, Younghyo, et autres
Publié: (2024)
par: Park, Younghyo, et autres
Publié: (2024)
Efficient Diffusion Transformer Policies with Mixture of Expert Denoisers for Multitask Learning
par: Reuss, Moritz, et autres
Publié: (2024)
par: Reuss, Moritz, et autres
Publié: (2024)
Guiding Data Collection via Factored Scaling Curves
par: Zha, Lihan, et autres
Publié: (2025)
par: Zha, Lihan, et autres
Publié: (2025)
Risk-Calibrated Human-Robot Interaction via Set-Valued Intent Prediction
par: Lidard, Justin, et autres
Publié: (2024)
par: Lidard, Justin, et autres
Publié: (2024)
Robot Fleet Learning via Policy Merging
par: Wang, Lirui, et autres
Publié: (2023)
par: Wang, Lirui, et autres
Publié: (2023)
Deceptive Risk Minimization: Out-of-Distribution Generalization by Deceiving Distribution Shift Detectors
par: Majumdar, Anirudha
Publié: (2025)
par: Majumdar, Anirudha
Publié: (2025)
Reconciling Reality through Simulation: A Real-to-Sim-to-Real Approach for Robust Manipulation
par: Torne, Marcel, et autres
Publié: (2024)
par: Torne, Marcel, et autres
Publié: (2024)
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
Diffusion Policy: Visuomotor Policy Learning via Action Diffusion
par: Chi, Cheng, et autres
Publié: (2023)
par: Chi, Cheng, et autres
Publié: (2023)
Bridging the Sim2Real Gap: Vision Encoder Pre-Training for Visuomotor Policy Transfer
par: Yardi, Yash, et autres
Publié: (2025)
par: Yardi, Yash, et autres
Publié: (2025)
Is Your Imitation Learning Policy Better than Mine? Policy Comparison with Near-Optimal Stopping
par: Snyder, David, et autres
Publié: (2025)
par: Snyder, David, et autres
Publié: (2025)
Predictive Red Teaming: Breaking Policies Without Breaking Robots
par: Majumdar, Anirudha, et autres
Publié: (2025)
par: Majumdar, Anirudha, et autres
Publié: (2025)
OGPO: Sample Efficient Full-Finetuning of Generative Control Policies
par: Patil, Sarvesh, et autres
Publié: (2026)
par: Patil, Sarvesh, et autres
Publié: (2026)
A Survey on Uncertainty Quantification of Large Language Models: Taxonomy, Open Research Challenges, and Future Directions
par: Shorinwa, Ola, et autres
Publié: (2024)
par: Shorinwa, Ola, et autres
Publié: (2024)
Tune to Learn: How Controller Gains Shape Robot Policy Learning
par: Bronars, Antonia, et autres
Publié: (2026)
par: Bronars, Antonia, et autres
Publié: (2026)
Diffusion Policy through Conditional Proximal Policy Optimization
par: Liu, Ben, et autres
Publié: (2026)
par: Liu, Ben, et autres
Publié: (2026)
Dichotomous Diffusion Policy Optimization
par: Liang, Ruiming, et autres
Publié: (2025)
par: Liang, Ruiming, et autres
Publié: (2025)
Explore until Confident: Efficient Exploration for Embodied Question Answering
par: Ren, Allen Z., et autres
Publié: (2024)
par: Ren, Allen Z., et autres
Publié: (2024)
Turning Video Models into Generalist Robot Policies
par: Li, Sizhe Lester, et autres
Publié: (2026)
par: Li, Sizhe Lester, et autres
Publié: (2026)
PolyTouch: A Robust Multi-Modal Tactile Sensor for Contact-rich Manipulation Using Tactile-Diffusion Policies
par: Zhao, Jialiang, et autres
Publié: (2025)
par: Zhao, Jialiang, et autres
Publié: (2025)
Adaptive Compliance Policy: Learning Approximate Compliance for Diffusion Guided Control
par: Hou, Yifan, et autres
Publié: (2024)
par: Hou, Yifan, et autres
Publié: (2024)
Policy-Guided Diffusion
par: Jackson, Matthew Thomas, et autres
Publié: (2024)
par: Jackson, Matthew Thomas, et autres
Publié: (2024)
Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets
par: Zhu, Chuning, et autres
Publié: (2025)
par: Zhu, Chuning, et autres
Publié: (2025)
Diffusion Forcing: Next-token Prediction Meets Full-Sequence Diffusion
par: Chen, Boyuan, et autres
Publié: (2024)
par: Chen, Boyuan, et autres
Publié: (2024)
Equivariant Diffusion Policy
par: Wang, Dian, et autres
Publié: (2024)
par: Wang, Dian, et autres
Publié: (2024)
One-Step Diffusion Policy: Fast Visuomotor Policies via Diffusion Distillation
par: Wang, Zhendong, et autres
Publié: (2024)
par: Wang, Zhendong, et autres
Publié: (2024)
Adaptive Diffusion Policy Optimization for Robotic Manipulation
par: Jiang, Huiyun, et autres
Publié: (2025)
par: Jiang, Huiyun, et autres
Publié: (2025)
Thinking Forward and Backward: Effective Backward Planning with Large Language Models
par: Ren, Allen Z., et autres
Publié: (2024)
par: Ren, Allen Z., et autres
Publié: (2024)
Automatic Environment Shaping is the Next Frontier in RL
par: Park, Younghyo, et autres
Publié: (2024)
par: Park, Younghyo, et autres
Publié: (2024)
Delay-Aware Diffusion Policy: Bridging the Observation-Execution Gap in Dynamic Tasks
par: Liao, Aileen, et autres
Publié: (2025)
par: Liao, Aileen, et autres
Publié: (2025)
Sparse Diffusion Policy: A Sparse, Reusable, and Flexible Policy for Robot Learning
par: Wang, Yixiao, et autres
Publié: (2024)
par: Wang, Yixiao, et autres
Publié: (2024)
Beyond Binary Success: Sample-Efficient and Statistically Rigorous Robot Policy Comparison
par: Snyder, David, et autres
Publié: (2026)
par: Snyder, David, et autres
Publié: (2026)
Reactive Diffusion Policy: Slow-Fast Visual-Tactile Policy Learning for Contact-Rich Manipulation
par: Xue, Han, et autres
Publié: (2025)
par: Xue, Han, et autres
Publié: (2025)
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
par: Yang, Shunpeng, et autres
Publié: (2026)
par: Yang, Shunpeng, et autres
Publié: (2026)
DADP: Domain Adaptive Diffusion Policy
par: Wang, Pengcheng, et autres
Publié: (2026)
par: Wang, Pengcheng, et autres
Publié: (2026)
Documents similaires
-
JUICER: Data-Efficient Imitation Learning for Robotic Assembly
par: Ankile, Lars, et autres
Publié: (2024) -
From Imitation to Refinement -- Residual RL for Precise Assembly
par: Ankile, Lars, et autres
Publié: (2024) -
Robot Learning with Super-Linear Scaling
par: Torne, Marcel, et autres
Publié: (2024) -
Run-time Observation Interventions Make Vision-Language-Action Models More Visually Robust
par: Hancock, Asher J., et autres
Publié: (2024) -
Residual Off-Policy RL for Finetuning Behavior Cloning Policies
par: Ankile, Lars, et autres
Publié: (2025)