H$^3$DP: Triply-Hierarchical Diffusion Policy for Visuomotor Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Yiyang, Tian, Yufeng, Yuan, Zhecheng, Wang, Xianbang, Hua, Pu, Xue, Zhengrong, Xu, Huazhe |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DemoGen: Synthetic Demonstration Generation for Data-Efficient Visuomotor Policy Learning
par: Xue, Zhengrong, et autres
Publié: (2025)
par: Xue, Zhengrong, et autres
Publié: (2025)
ViTaS: Visual Tactile Soft Fusion Contrastive Learning for Visuomotor Learning
par: Tian, Yufeng, et autres
Publié: (2026)
par: Tian, Yufeng, et autres
Publié: (2026)
3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D Representations
par: Ze, Yanjie, et autres
Publié: (2024)
par: Ze, Yanjie, et autres
Publié: (2024)
DemoSpeedup: Accelerating Visuomotor Policies via Entropy-Guided Demonstration Acceleration
par: Guo, Lingxiao, et autres
Publié: (2025)
par: Guo, Lingxiao, et autres
Publié: (2025)
DenseMatcher: Learning 3D Semantic Correspondence for Category-Level Manipulation from a Single Demo
par: Zhu, Junzhe, et autres
Publié: (2024)
par: Zhu, Junzhe, et autres
Publié: (2024)
Stem-OB: Generalizable Visual Imitation Learning with Stem-Like Convergent Observation through Diffusion Inversion
par: Hu, Kaizhe, et autres
Publié: (2024)
par: Hu, Kaizhe, et autres
Publié: (2024)
DINOv3-Diffusion Policy: Self-Supervised Large Visual Model for Visuomotor Diffusion Policy Learning
par: Egbe, ThankGod, et autres
Publié: (2025)
par: Egbe, ThankGod, et autres
Publié: (2025)
Learning to Manipulate Anywhere: A Visual Generalizable Framework For Reinforcement Learning
par: Yuan, Zhecheng, et autres
Publié: (2024)
par: Yuan, Zhecheng, et autres
Publié: (2024)
X-Distill: Cross-Architecture Vision Distillation for Visuomotor Learning
par: Shao, Maanping, et autres
Publié: (2026)
par: Shao, Maanping, et autres
Publié: (2026)
CDP: Towards Robust Autoregressive Visuomotor Policy Learning via Causal Diffusion
par: Ma, Jiahua, et autres
Publié: (2025)
par: Ma, Jiahua, et autres
Publié: (2025)
Crossway Diffusion: Improving Diffusion-based Visuomotor Policy via Self-supervised Learning
par: Li, Xiang, et autres
Publié: (2023)
par: Li, Xiang, et autres
Publié: (2023)
Fast Visuomotor Policy for Robotic Manipulation
par: Jia, Jingkai, et autres
Publié: (2025)
par: Jia, Jingkai, et autres
Publié: (2025)
Learning Predictive Visuomotor Coordination
par: Jia, Wenqi, et autres
Publié: (2025)
par: Jia, Wenqi, et autres
Publié: (2025)
Referring-Aware Visuomotor Policy Learning for Closed-Loop Manipulation
par: Ma, Jiahua, et autres
Publié: (2026)
par: Ma, Jiahua, et autres
Publié: (2026)
Diffusion Reward: Learning Rewards via Conditional Video Diffusion
par: Huang, Tao, et autres
Publié: (2023)
par: Huang, Tao, et autres
Publié: (2023)
GenSim: Generating Robotic Simulation Tasks via Large Language Models
par: Wang, Lirui, et autres
Publié: (2023)
par: Wang, Lirui, et autres
Publié: (2023)
Dreamitate: Real-World Visuomotor Policy Learning via Video Generation
par: Liang, Junbang, et autres
Publié: (2024)
par: Liang, Junbang, et autres
Publié: (2024)
CARP: Visuomotor Policy Learning via Coarse-to-Fine Autoregressive Prediction
par: Gong, Zhefei, et autres
Publié: (2024)
par: Gong, Zhefei, et autres
Publié: (2024)
MoE-DP: An MoE-Enhanced Diffusion Policy for Robust Long-Horizon Robotic Manipulation with Skill Decomposition and Failure Recovery
par: Cheng, Baiye, et autres
Publié: (2025)
par: Cheng, Baiye, et autres
Publié: (2025)
FLASH: Efficient Visuomotor Policy via Sparse Sampling
par: Bai, Jiaqi, et autres
Publié: (2026)
par: Bai, Jiaqi, et autres
Publié: (2026)
Efficient Training of Generalizable Visuomotor Policies via Control-Aware Augmentation
par: Zhao, Yinuo, et autres
Publié: (2024)
par: Zhao, Yinuo, et autres
Publié: (2024)
Maximizing Alignment with Minimal Feedback: Efficiently Learning Rewards for Visuomotor Robot Policy Alignment
par: Tian, Ran, et autres
Publié: (2024)
par: Tian, Ran, et autres
Publié: (2024)
R3DP: Real-Time 3D-Aware Policy for Embodied Manipulation
par: Zhang, Yuhao, et autres
Publié: (2026)
par: Zhang, Yuhao, et autres
Publié: (2026)
ImitDiff: Transferring Foundation-Model Priors for Distraction Robust Visuomotor Policy
par: Dong, Yuhang, et autres
Publié: (2025)
par: Dong, Yuhang, et autres
Publié: (2025)
GenDP: 3D Semantic Fields for Category-Level Generalizable Diffusion Policy
par: Wang, Yixuan, et autres
Publié: (2024)
par: Wang, Yixuan, et autres
Publié: (2024)
FreqPolicy: Frequency Autoregressive Visuomotor Policy with Continuous Tokens
par: Zhong, Yiming, et autres
Publié: (2025)
par: Zhong, Yiming, et autres
Publié: (2025)
The Temporal Trap: Entanglement in Pre-Trained Visual Representations for Visuomotor Policy Learning
par: Tsagkas, Nikolaos, et autres
Publié: (2025)
par: Tsagkas, Nikolaos, et autres
Publié: (2025)
Beyond the Patch: Exploring Vulnerabilities of Visuomotor Policies via Viewpoint-Consistent 3D Adversarial Object
par: Lee, Chanmi, et autres
Publié: (2026)
par: Lee, Chanmi, et autres
Publié: (2026)
Spatial Policy: Guiding Visuomotor Robotic Manipulation with Spatial-Aware Modeling and Reasoning
par: Liu, Yijun, et autres
Publié: (2025)
par: Liu, Yijun, et autres
Publié: (2025)
Bridging the Sim2Real Gap: Vision Encoder Pre-Training for Visuomotor Policy Transfer
par: Yardi, Yash, et autres
Publié: (2025)
par: Yardi, Yash, et autres
Publié: (2025)
VO-DP: Semantic-Geometric Adaptive Diffusion Policy for Vision-Only Robotic Manipulation
par: Ni, Zehao, et autres
Publié: (2025)
par: Ni, Zehao, et autres
Publié: (2025)
Diffusion Transformer Policy
par: Hou, Zhi, et autres
Publié: (2024)
par: Hou, Zhi, et autres
Publié: (2024)
Adapting by Analogy: OOD Generalization of Visuomotor Policies via Functional Correspondence
par: Gupta, Pranay, et autres
Publié: (2025)
par: Gupta, Pranay, et autres
Publié: (2025)
HERMES: Human-to-Robot Embodied Learning from Multi-Source Motion Data for Mobile Dexterous Manipulation
par: Yuan, Zhecheng, et autres
Publié: (2025)
par: Yuan, Zhecheng, et autres
Publié: (2025)
DNAct: Diffusion Guided Multi-Task 3D Policy Learning
par: Yan, Ge, et autres
Publié: (2024)
par: Yan, Ge, et autres
Publié: (2024)
On the Evaluation of Generative Robotic Simulations
par: Chen, Feng, et autres
Publié: (2024)
par: Chen, Feng, et autres
Publié: (2024)
R3D: Revisiting 3D Policy Learning
par: Hong, Zhengdong, et autres
Publié: (2026)
par: Hong, Zhengdong, et autres
Publié: (2026)
GenSim2: Scaling Robot Data Generation with Multi-modal and Reasoning LLMs
par: Hua, Pu, et autres
Publié: (2024)
par: Hua, Pu, et autres
Publié: (2024)
Generalizable Humanoid Manipulation with 3D Diffusion Policies
par: Ze, Yanjie, et autres
Publié: (2024)
par: Ze, Yanjie, et autres
Publié: (2024)
Two by Two: Learning Multi-Task Pairwise Objects Assembly for Generalizable Robot Manipulation
par: Qi, Yu, et autres
Publié: (2025)
par: Qi, Yu, et autres
Publié: (2025)
Documents similaires
-
DemoGen: Synthetic Demonstration Generation for Data-Efficient Visuomotor Policy Learning
par: Xue, Zhengrong, et autres
Publié: (2025) -
ViTaS: Visual Tactile Soft Fusion Contrastive Learning for Visuomotor Learning
par: Tian, Yufeng, et autres
Publié: (2026) -
3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D Representations
par: Ze, Yanjie, et autres
Publié: (2024) -
DemoSpeedup: Accelerating Visuomotor Policies via Entropy-Guided Demonstration Acceleration
par: Guo, Lingxiao, et autres
Publié: (2025) -
DenseMatcher: Learning 3D Semantic Correspondence for Category-Level Manipulation from a Single Demo
par: Zhu, Junzhe, et autres
Publié: (2024)