RoboTransfer: Controllable Geometry-Consistent Video Diffusion for Manipulation Policy Transfer
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Liu, Wang, Xiaofeng, Zhao, Guosheng, Li, Keyu, Qin, Wenkang, Zhu, Jiagang, Qiu, Jiaxiong, Zhu, Zheng, Huang, Guan, Su, Zhizhong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DriveDreamer-Policy: A Geometry-Grounded World-Action Model for Unified Generation and Planning
por: Zhou, Yang, et al.
Publicado: (2026)
por: Zhou, Yang, et al.
Publicado: (2026)
GLS: Geometry-aware 3D Language Gaussian Splatting
por: Qiu, Jiaxiong, et al.
Publicado: (2024)
por: Qiu, Jiaxiong, et al.
Publicado: (2024)
ReconDreamer++: Harmonizing Generative and Reconstructive Models for Driving Scene Representation
por: Zhao, Guosheng, et al.
Publicado: (2025)
por: Zhao, Guosheng, et al.
Publicado: (2025)
ReconDreamer-RL: Enhancing Reinforcement Learning via Diffusion-based Scene Reconstruction
por: Ni, Chaojun, et al.
Publicado: (2025)
por: Ni, Chaojun, et al.
Publicado: (2025)
DriveGen3D: Boosting Feed-Forward Driving Scene Generation with Efficient Video Diffusion
por: Wang, Weijie, et al.
Publicado: (2025)
por: Wang, Weijie, et al.
Publicado: (2025)
EMMA: Generalizing Real-World Robot Manipulation via Generative Visual Transfer
por: Dong, Zhehao, et al.
Publicado: (2025)
por: Dong, Zhehao, et al.
Publicado: (2025)
DeCo: Decoupled Human-Centered Diffusion Video Editing with Motion Consistency
por: Zhong, Xiaojing, et al.
Publicado: (2024)
por: Zhong, Xiaojing, et al.
Publicado: (2024)
Gaussian Object Carver: Object-Compositional Gaussian Splatting with surfaces completion
por: Liu, Liu, et al.
Publicado: (2024)
por: Liu, Liu, et al.
Publicado: (2024)
Cross Domain Policy Transfer with Effect Cycle-Consistency
por: Zhu, Ruiqi, et al.
Publicado: (2024)
por: Zhu, Ruiqi, et al.
Publicado: (2024)
WonderTurbo: Generating Interactive 3D World in 0.72 Seconds
por: Ni, Chaojun, et al.
Publicado: (2025)
por: Ni, Chaojun, et al.
Publicado: (2025)
DreamLifting: A Plug-in Module Lifting MV Diffusion Models for 3D Asset Generation
por: Yin, Ze-Xin, et al.
Publicado: (2025)
por: Yin, Ze-Xin, et al.
Publicado: (2025)
DataTransfer: Neural network based interpolation across non-nested meshes
por: Hao, Jiaxiong, et al.
Publicado: (2025)
por: Hao, Jiaxiong, et al.
Publicado: (2025)
AffordDP: Generalizable Diffusion Policy with Transferable Affordance
por: Wu, Shijie, et al.
Publicado: (2024)
por: Wu, Shijie, et al.
Publicado: (2024)
DIPO: Dual-State Images Controlled Articulated Object Generation Powered by Diverse Data
por: Wu, Ruiqi, et al.
Publicado: (2025)
por: Wu, Ruiqi, et al.
Publicado: (2025)
DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation
por: Zhao, Guosheng, et al.
Publicado: (2024)
por: Zhao, Guosheng, et al.
Publicado: (2024)
RoboTron-Mani: All-in-One Multimodal Large Model for Robotic Manipulation
por: Yan, Feng, et al.
Publicado: (2024)
por: Yan, Feng, et al.
Publicado: (2024)
HumanDreamer: Generating Controllable Human-Motion Videos via Decoupled Generation
por: Wang, Boyuan, et al.
Publicado: (2025)
por: Wang, Boyuan, et al.
Publicado: (2025)
Vidar: Embodied Video Diffusion Model for Generalist Manipulation
por: Feng, Yao, et al.
Publicado: (2025)
por: Feng, Yao, et al.
Publicado: (2025)
GeoFlow-SLAM: A Robust Tightly-Coupled RGBD-Inertial and Legged Odometry Fusion SLAM for Dynamic Legged Robotics
por: Xiao, Tingyang, et al.
Publicado: (2025)
por: Xiao, Tingyang, et al.
Publicado: (2025)
VAG: Dual-Stream Video-Action Generation for Embodied Data Synthesis
por: Lang, Xiaolei, et al.
Publicado: (2026)
por: Lang, Xiaolei, et al.
Publicado: (2026)
SEM: Enhancing Spatial Understanding for Robust Robot Manipulation
por: Lin, Xuewu, et al.
Publicado: (2025)
por: Lin, Xuewu, et al.
Publicado: (2025)
EmbodieDreamer: Advancing Real2Sim2Real Transfer for Policy Training via Embodied World Modeling
por: Wang, Boyuan, et al.
Publicado: (2025)
por: Wang, Boyuan, et al.
Publicado: (2025)
RoboTrustBench: Benchmarking the Trustworthiness of Video World Models for Robotic Manipulation
por: Li, Huiqiong, et al.
Publicado: (2026)
por: Li, Huiqiong, et al.
Publicado: (2026)
WonderFree: Enhancing Novel View Quality and Cross-View Consistency for 3D Scene Exploration
por: Ni, Chaojun, et al.
Publicado: (2025)
por: Ni, Chaojun, et al.
Publicado: (2025)
VidSplat: Gaussian Splatting Reconstruction with Geometry-Guided Video Diffusion Priors
por: Tang, Jimin, et al.
Publicado: (2026)
por: Tang, Jimin, et al.
Publicado: (2026)
Can Video Diffusion Models Predict Past Frames? Bidirectional Cycle Consistency for Reversible Interpolation
por: Liu, Lingyu, et al.
Publicado: (2026)
por: Liu, Lingyu, et al.
Publicado: (2026)
SARA: Controllable Makeup Transfer with Spatial Alignment and Region-Adaptive Normalization
por: Zhong, Xiaojing, et al.
Publicado: (2023)
por: Zhong, Xiaojing, et al.
Publicado: (2023)
H-RDT: Human Manipulation Enhanced Bimanual Robotic Manipulation
por: Bi, Hongzhe, et al.
Publicado: (2025)
por: Bi, Hongzhe, et al.
Publicado: (2025)
EmbodiedGen: Towards a Generative 3D World Engine for Embodied Intelligence
por: Wang, Xinjie, et al.
Publicado: (2025)
por: Wang, Xinjie, et al.
Publicado: (2025)
Geometry-Aware Rotary Position Embedding for Consistent Video World Model
por: Xiang, Chendong, et al.
Publicado: (2026)
por: Xiang, Chendong, et al.
Publicado: (2026)
RoboPearls: Editable Video Simulation for Robot Manipulation
por: Tang, Tao, et al.
Publicado: (2025)
por: Tang, Tao, et al.
Publicado: (2025)
Can Video Diffusion Model Reconstruct 4D Geometry?
por: Mai, Jinjie, et al.
Publicado: (2025)
por: Mai, Jinjie, et al.
Publicado: (2025)
RoboCerebra: A Large-scale Benchmark for Long-horizon Robotic Manipulation Evaluation
por: Han, Songhao, et al.
Publicado: (2025)
por: Han, Songhao, et al.
Publicado: (2025)
ADEPT: Adaptive Diffusion Environment for Policy Transfer Sim-to-Real
por: Yu, Youwei, et al.
Publicado: (2025)
por: Yu, Youwei, et al.
Publicado: (2025)
RoboRouter: Training-Free Policy Routing for Robotic Manipulation
por: Chen, Yiteng, et al.
Publicado: (2026)
por: Chen, Yiteng, et al.
Publicado: (2026)
EgoVid-5M: A Large-Scale Video-Action Dataset for Egocentric Video Generation
por: Wang, Xiaofeng, et al.
Publicado: (2024)
por: Wang, Xiaofeng, et al.
Publicado: (2024)
RoboUniView: Visual-Language Model with Unified View Representation for Robotic Manipulation
por: Liu, Fanfan, et al.
Publicado: (2024)
por: Liu, Fanfan, et al.
Publicado: (2024)
UniGeo: Taming Video Diffusion for Unified Consistent Geometry Estimation
por: Sun, Yang-Tian, et al.
Publicado: (2025)
por: Sun, Yang-Tian, et al.
Publicado: (2025)
EasyControl: Transfer ControlNet to Video Diffusion for Controllable Generation and Interpolation
por: Wang, Cong, et al.
Publicado: (2024)
por: Wang, Cong, et al.
Publicado: (2024)
FLUX-Makeup: High-Fidelity, Identity-Consistent, and Robust Makeup Transfer via Diffusion Transformer
por: Zhu, Jian, et al.
Publicado: (2025)
por: Zhu, Jian, et al.
Publicado: (2025)
Ejemplares similares
-
DriveDreamer-Policy: A Geometry-Grounded World-Action Model for Unified Generation and Planning
por: Zhou, Yang, et al.
Publicado: (2026) -
GLS: Geometry-aware 3D Language Gaussian Splatting
por: Qiu, Jiaxiong, et al.
Publicado: (2024) -
ReconDreamer++: Harmonizing Generative and Reconstructive Models for Driving Scene Representation
por: Zhao, Guosheng, et al.
Publicado: (2025) -
ReconDreamer-RL: Enhancing Reinforcement Learning via Diffusion-based Scene Reconstruction
por: Ni, Chaojun, et al.
Publicado: (2025) -
DriveGen3D: Boosting Feed-Forward Driving Scene Generation with Efficient Video Diffusion
por: Wang, Weijie, et al.
Publicado: (2025)