DIPOLE: Fusing Vision and Geometry for Robust Visuomotor Generalization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tang, Yikai, Geng, Haoran, Jia, Jindou, Hu, Yuxuan, Zang, Sheng, Yang, Jianfei, Abbeel, Pieter, Malik, Jitendra |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation
par: Heng, Liang, et autres
Publié: (2025)
par: Heng, Liang, et autres
Publié: (2025)
FLASH: Efficient Visuomotor Policy via Sparse Sampling
par: Bai, Jiaqi, et autres
Publié: (2026)
par: Bai, Jiaqi, et autres
Publié: (2026)
SkillBlender: Towards Versatile Humanoid Whole-Body Loco-Manipulation via Skill Blending
par: Kuang, Yuxuan, et autres
Publié: (2025)
par: Kuang, Yuxuan, et autres
Publié: (2025)
Rodrigues Network for Learning Robot Actions
par: Zhang, Jialiang, et autres
Publié: (2025)
par: Zhang, Jialiang, et autres
Publié: (2025)
Deep Sensorimotor Control by Imitating Predictive Models of Human Motion
par: Singh, Himanshu Gaurav, et autres
Publié: (2025)
par: Singh, Himanshu Gaurav, et autres
Publié: (2025)
Interactive Task Planning with Language Models
par: Li, Boyi, et autres
Publié: (2023)
par: Li, Boyi, et autres
Publié: (2023)
Trace-Focused Diffusion Policy for Multi-Modal Action Disambiguation in Long-Horizon Robotic Manipulation
par: Hu, Yuxuan, et autres
Publié: (2026)
par: Hu, Yuxuan, et autres
Publié: (2026)
World Model for Robot Learning: A Comprehensive Survey
par: Hou, Bohan, et autres
Publié: (2026)
par: Hou, Bohan, et autres
Publié: (2026)
The Sound of Simulation: Learning Multimodal Sim-to-Real Robot Policies with Generative Audio
par: Wang, Renhao, et autres
Publié: (2025)
par: Wang, Renhao, et autres
Publié: (2025)
End-to-end RL Improves Dexterous Grasping Policies
par: Singh, Ritvik, et autres
Publié: (2025)
par: Singh, Ritvik, et autres
Publié: (2025)
OTTER: A Vision-Language-Action Model with Text-Aware Visual Feature Extraction
par: Huang, Huang, et autres
Publié: (2025)
par: Huang, Huang, et autres
Publié: (2025)
Action-to-Action Flow Matching
par: Jia, Jindou, et autres
Publié: (2026)
par: Jia, Jindou, et autres
Publié: (2026)
Twisting Lids Off with Two Hands
par: Lin, Toru, et autres
Publié: (2024)
par: Lin, Toru, et autres
Publié: (2024)
How to Peel with a Knife: Aligning Fine-Grained Manipulation with Human Preference
par: Lin, Toru, et autres
Publié: (2026)
par: Lin, Toru, et autres
Publié: (2026)
DexGarmentLab: Dexterous Garment Manipulation Environment with Generalizable Policy
par: Wang, Yuran, et autres
Publié: (2025)
par: Wang, Yuran, et autres
Publié: (2025)
Fast and Robust Visuomotor Riemannian Flow Matching Policy
par: Ding, Haoran, et autres
Publié: (2024)
par: Ding, Haoran, et autres
Publié: (2024)
$\mathbf{M^3A}$ Policy: Mutable Material Manipulation Augmentation Policy through Photometric Re-rendering
par: Li, Jiayi, et autres
Publié: (2025)
par: Li, Jiayi, et autres
Publié: (2025)
MARS Policy: Multimodality Only When It Matters
par: Jia, Jindou, et autres
Publié: (2026)
par: Jia, Jindou, et autres
Publié: (2026)
Imagination at Inference: Synthesizing In-Hand Views for Robust Visuomotor Policy Inference
par: Ding, Haoran, et autres
Publié: (2025)
par: Ding, Haoran, et autres
Publié: (2025)
Spatial-Temporal Aware Visuomotor Diffusion Policy Learning
par: Liu, Zhenyang, et autres
Publié: (2025)
par: Liu, Zhenyang, et autres
Publié: (2025)
Large Video Planner Enables Generalizable Robot Control
par: Chen, Boyuan, et autres
Publié: (2025)
par: Chen, Boyuan, et autres
Publié: (2025)
D-REX: Differentiable Real-to-Sim-to-Real Engine for Learning Dexterous Grasping
par: Lou, Haozhe, et autres
Publié: (2026)
par: Lou, Haozhe, et autres
Publié: (2026)
Hand-Object Interaction Pretraining from Videos
par: Singh, Himanshu Gaurav, et autres
Publié: (2024)
par: Singh, Himanshu Gaurav, et autres
Publié: (2024)
FastTD3: Simple, Fast, and Capable Reinforcement Learning for Humanoid Control
par: Seo, Younggyo, et autres
Publié: (2025)
par: Seo, Younggyo, et autres
Publié: (2025)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
par: Seo, Younggyo, et autres
Publié: (2024)
par: Seo, Younggyo, et autres
Publié: (2024)
Maximizing Alignment with Minimal Feedback: Efficiently Learning Rewards for Visuomotor Robot Policy Alignment
par: Tian, Ran, et autres
Publié: (2024)
par: Tian, Ran, et autres
Publié: (2024)
FutureVLA: Joint Visuomotor Prediction for Vision-Language-Action Model
par: Xu, Xiaoxu, et autres
Publié: (2026)
par: Xu, Xiaoxu, et autres
Publié: (2026)
Cross-Hand Latent Representation for Vision-Language-Action Models
par: Jiang, Guangqi, et autres
Publié: (2026)
par: Jiang, Guangqi, et autres
Publié: (2026)
Closed-Loop Visuomotor Control with Generative Expectation for Robotic Manipulation
par: Bu, Qingwen, et autres
Publié: (2024)
par: Bu, Qingwen, et autres
Publié: (2024)
Offline Imitation Learning Through Graph Search and Retrieval
par: Yin, Zhao-Heng, et autres
Publié: (2024)
par: Yin, Zhao-Heng, et autres
Publié: (2024)
GELLO: A General, Low-Cost, and Intuitive Teleoperation Framework for Robot Manipulators
par: Wu, Philipp, et autres
Publié: (2023)
par: Wu, Philipp, et autres
Publié: (2023)
EgoMI: Learning Active Vision and Whole-Body Manipulation from Egocentric Human Demonstrations
par: Yu, Justin, et autres
Publié: (2025)
par: Yu, Justin, et autres
Publié: (2025)
Feedback World Model Enables Precise Guidance of Diffusion Policy
par: An, Tuo, et autres
Publié: (2026)
par: An, Tuo, et autres
Publié: (2026)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
par: Lee, Vint, et autres
Publié: (2023)
par: Lee, Vint, et autres
Publié: (2023)
Trajectory-Consistent Flow Matching for Robust Visuomotor Policy Learning
par: Ahmed, Riad, et autres
Publié: (2026)
par: Ahmed, Riad, et autres
Publié: (2026)
Choose What to Observe: Task-Aware Semantic-Geometric Representations for Visuomotor Policy
par: Ding, Haoran, et autres
Publié: (2026)
par: Ding, Haoran, et autres
Publié: (2026)
Accurate Control under Voltage Drop for Rotor Drones
par: Liu, Yuhang, et autres
Publié: (2025)
par: Liu, Yuhang, et autres
Publié: (2025)
Fast Visuomotor Policy for Robotic Manipulation
par: Jia, Jingkai, et autres
Publié: (2025)
par: Jia, Jingkai, et autres
Publié: (2025)
Latent Policy Barrier: Learning Robust Visuomotor Policies by Staying In-Distribution
par: Sun, Zhanyi, et autres
Publié: (2025)
par: Sun, Zhanyi, et autres
Publié: (2025)
Unified Meta-Representation and Feedback Calibration for General Disturbance Estimation
par: Yang, Zihan, et autres
Publié: (2026)
par: Yang, Zihan, et autres
Publié: (2026)
Documents similaires
-
ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation
par: Heng, Liang, et autres
Publié: (2025) -
FLASH: Efficient Visuomotor Policy via Sparse Sampling
par: Bai, Jiaqi, et autres
Publié: (2026) -
SkillBlender: Towards Versatile Humanoid Whole-Body Loco-Manipulation via Skill Blending
par: Kuang, Yuxuan, et autres
Publié: (2025) -
Rodrigues Network for Learning Robot Actions
par: Zhang, Jialiang, et autres
Publié: (2025) -
Deep Sensorimotor Control by Imitating Predictive Models of Human Motion
par: Singh, Himanshu Gaurav, et autres
Publié: (2025)