ORV: 4D Occupancy-centric Robot Video Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Xiuyu, Li, Bohan, Xu, Shaocong, Wang, Nan, Ye, Chongjie, Chen, Zhaoxi, Qin, Minghan, Ding, Yikang, Zhu, Zheng, Jin, Xin, Zhao, Hang, Zhao, Hao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
One View, Many Worlds: Single-Image to 3D Object Meets Generative Domain Randomization for One-Shot 6D Pose Estimation
por: Geng, Zheng, et al.
Publicado: (2025)
por: Geng, Zheng, et al.
Publicado: (2025)
Light-X: Generative 4D Video Rendering with Camera and Illumination Control
por: Liu, Tianqi, et al.
Publicado: (2025)
por: Liu, Tianqi, et al.
Publicado: (2025)
UniScene: Unified Occupancy-centric Driving Scene Generation
por: Li, Bohan, et al.
Publicado: (2024)
por: Li, Bohan, et al.
Publicado: (2024)
Relit-LiVE: Relight Video by Jointly Learning Environment Video
por: Xiao, Weiqing, et al.
Publicado: (2026)
por: Xiao, Weiqing, et al.
Publicado: (2026)
TrackOcc: Camera-based 4D Panoptic Occupancy Tracking
por: Chen, Zhuoguang, et al.
Publicado: (2025)
por: Chen, Zhuoguang, et al.
Publicado: (2025)
Diffusion-Based Generative Models for 3D Occupancy Prediction in Autonomous Driving
por: Wang, Yunshen, et al.
Publicado: (2025)
por: Wang, Yunshen, et al.
Publicado: (2025)
Unifying Appearance Codes and Bilateral Grids for Driving Scene Gaussian Splatting
por: Wang, Nan, et al.
Publicado: (2025)
por: Wang, Nan, et al.
Publicado: (2025)
Diffusion Knows Transparency: Repurposing Video Diffusion for Transparent Object Depth and Normal Estimation
por: Xu, Shaocong, et al.
Publicado: (2025)
por: Xu, Shaocong, et al.
Publicado: (2025)
GS-Occ3D: Scaling Vision-only Occupancy Reconstruction with Gaussian Splatting
por: Ye, Baijun, et al.
Publicado: (2025)
por: Ye, Baijun, et al.
Publicado: (2025)
ArtHOI: Articulated Human-Object Interaction Synthesis by 4D Reconstruction from Video Priors
por: Huang, Zihao, et al.
Publicado: (2026)
por: Huang, Zihao, et al.
Publicado: (2026)
Light of Normals: Unified Feature Representation for Universal Photometric Stereo
por: Chen, Houyuan, et al.
Publicado: (2025)
por: Chen, Houyuan, et al.
Publicado: (2025)
UniVidX: A Unified Multimodal Framework for Versatile Video Generation via Diffusion Priors
por: Chen, Houyuan, et al.
Publicado: (2026)
por: Chen, Houyuan, et al.
Publicado: (2026)
Object-centric 3D Motion Field for Robot Learning from Human Videos
por: Yin, Zhao-Heng, et al.
Publicado: (2025)
por: Yin, Zhao-Heng, et al.
Publicado: (2025)
CVT-Occ: Cost Volume Temporal Fusion for 3D Occupancy Prediction
por: Ye, Zhangchen, et al.
Publicado: (2024)
por: Ye, Zhangchen, et al.
Publicado: (2024)
ManipDreamer3D : Synthesizing Plausible Robotic Manipulation Video with Occupancy-aware 3D Trajectory
por: Li, Ying, et al.
Publicado: (2025)
por: Li, Ying, et al.
Publicado: (2025)
DiST-4D: Disentangled Spatiotemporal Diffusion with Metric Depth for 4D Driving Scene Generation
por: Guo, Jiazhe, et al.
Publicado: (2025)
por: Guo, Jiazhe, et al.
Publicado: (2025)
LiDAR-based 4D Occupancy Completion and Forecasting
por: Liu, Xinhao, et al.
Publicado: (2023)
por: Liu, Xinhao, et al.
Publicado: (2023)
Occupancy-SLAM: Simultaneously Optimizing Robot Poses and Continuous Occupancy Map
por: Zhao, Liang, et al.
Publicado: (2024)
por: Zhao, Liang, et al.
Publicado: (2024)
Humanoid Occupancy: Enabling A Generalized Multimodal Occupancy Perception System on Humanoid Robots
por: Cui, Wei, et al.
Publicado: (2025)
por: Cui, Wei, et al.
Publicado: (2025)
Occupancy-SLAM: An Efficient and Robust Algorithm for Simultaneously Optimizing Robot Poses and Occupancy Map
por: Wang, Yingyu, et al.
Publicado: (2025)
por: Wang, Yingyu, et al.
Publicado: (2025)
Ego3DT: Tracking Every 3D Object in Ego-centric Videos
por: Hao, Shengyu, et al.
Publicado: (2024)
por: Hao, Shengyu, et al.
Publicado: (2024)
Occupancy World Model for Robots
por: Zhang, Zhang, et al.
Publicado: (2025)
por: Zhang, Zhang, et al.
Publicado: (2025)
OccVLA: Vision-Language-Action Model with Implicit 3D Occupancy Supervision
por: Liu, Ruixun, et al.
Publicado: (2025)
por: Liu, Ruixun, et al.
Publicado: (2025)
NeAR: Coupled Neural Asset-Renderer Stack
por: Li, Hong, et al.
Publicado: (2025)
por: Li, Hong, et al.
Publicado: (2025)
Hierarchical Context Alignment with Disentangled Geometric and Temporal Modeling for Semantic Occupancy Prediction
por: Li, Bohan, et al.
Publicado: (2024)
por: Li, Bohan, et al.
Publicado: (2024)
Panoramic Multimodal Semantic Occupancy Prediction for Quadruped Robots
por: Zhao, Guoqiang, et al.
Publicado: (2026)
por: Zhao, Guoqiang, et al.
Publicado: (2026)
Super4DR: 4D Radar-centric Self-supervised Odometry and Gaussian-based Map Optimization
por: Li, Zhiheng, et al.
Publicado: (2025)
por: Li, Zhiheng, et al.
Publicado: (2025)
RadarOcc: Robust 3D Occupancy Prediction with 4D Imaging Radar
por: Ding, Fangqiang, et al.
Publicado: (2024)
por: Ding, Fangqiang, et al.
Publicado: (2024)
MonoOcc: Digging into Monocular Semantic Occupancy Prediction
por: Zheng, Yupeng, et al.
Publicado: (2024)
por: Zheng, Yupeng, et al.
Publicado: (2024)
Physics-informed Neural Network Predictive Control for Quadruped Locomotion
por: Li, Haolin, et al.
Publicado: (2025)
por: Li, Haolin, et al.
Publicado: (2025)
Rethinking Image-to-Video Adaptation: An Object-centric Perspective
por: Qian, Rui, et al.
Publicado: (2024)
por: Qian, Rui, et al.
Publicado: (2024)
GenieDrive: Towards Physics-Aware Driving World Model with 4D Occupancy Guided Video Generation
por: Yang, Zhenya, et al.
Publicado: (2025)
por: Yang, Zhenya, et al.
Publicado: (2025)
OccupancyDETR: Using DETR for Mixed Dense-sparse 3D Occupancy Prediction
por: Jia, Yupeng, et al.
Publicado: (2023)
por: Jia, Yupeng, et al.
Publicado: (2023)
A Unified Framework for Human-centric Point Cloud Video Understanding
por: Xu, Yiteng, et al.
Publicado: (2024)
por: Xu, Yiteng, et al.
Publicado: (2024)
LangSurf: Language-Embedded Surface Gaussians for 3D Scene Understanding
por: Li, Hao, et al.
Publicado: (2024)
por: Li, Hao, et al.
Publicado: (2024)
OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation
por: Li, Bohan, et al.
Publicado: (2024)
por: Li, Bohan, et al.
Publicado: (2024)
Hi3DGen: High-fidelity 3D Geometry Generation from Images via Normal Bridging
por: Ye, Chongjie, et al.
Publicado: (2025)
por: Ye, Chongjie, et al.
Publicado: (2025)
LoFA: Learning to Predict Personalized Priors for Fast Adaptation of Visual Generative Models
por: Hao, Yiming, et al.
Publicado: (2025)
por: Hao, Yiming, et al.
Publicado: (2025)
PAM: A Pose-Appearance-Motion Engine for Sim-to-Real HOI Video Generation
por: Gao, Mingju, et al.
Publicado: (2026)
por: Gao, Mingju, et al.
Publicado: (2026)
Track4World: Feedforward World-centric Dense 3D Tracking of All Pixels
por: Lu, Jiahao, et al.
Publicado: (2026)
por: Lu, Jiahao, et al.
Publicado: (2026)
Ejemplares similares
-
One View, Many Worlds: Single-Image to 3D Object Meets Generative Domain Randomization for One-Shot 6D Pose Estimation
por: Geng, Zheng, et al.
Publicado: (2025) -
Light-X: Generative 4D Video Rendering with Camera and Illumination Control
por: Liu, Tianqi, et al.
Publicado: (2025) -
UniScene: Unified Occupancy-centric Driving Scene Generation
por: Li, Bohan, et al.
Publicado: (2024) -
Relit-LiVE: Relight Video by Jointly Learning Environment Video
por: Xiao, Weiqing, et al.
Publicado: (2026) -
TrackOcc: Camera-based 4D Panoptic Occupancy Tracking
por: Chen, Zhuoguang, et al.
Publicado: (2025)