SpaceTimePilot: Generative Rendering of Dynamic Scenes Across Space and Time
Fuente:
arXiv
Saved in:
| Main Authors: | Huang, Zhening, Jeong, Hyeonho, Chen, Xuelin, Gryaditskaya, Yulia, Wang, Tuanfeng Y., Lasenby, Joan, Huang, Chun-Hao |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
EM-Vid: Training-Free Entity-Centric Memory for Efficient and Consistent Multi-Shot Video Generation
by: Vandersanden, Jente, et al.
Published: (2026)
by: Vandersanden, Jente, et al.
Published: (2026)
TrajectoryMover: Generative Movement of Object Trajectories in Videos
by: Chhatre, Kiran, et al.
Published: (2026)
by: Chhatre, Kiran, et al.
Published: (2026)
SmallGS: Gaussian Splatting-based Camera Pose Estimation for Small-Baseline Videos
by: Yao, Yuxin, et al.
Published: (2025)
by: Yao, Yuxin, et al.
Published: (2025)
Efficient Camera-Controlled Video Generation of Static Scenes via Sparse Diffusion and 3D Rendering
by: Chen, Jieying, et al.
Published: (2026)
by: Chen, Jieying, et al.
Published: (2026)
LiteReality: Graphics-Ready 3D Scene Reconstruction from RGB-D Scans
by: Huang, Zhening, et al.
Published: (2025)
by: Huang, Zhening, et al.
Published: (2025)
SketchingReality: From Freehand Scene Sketches To Photorealistic Images
by: Bourouis, Ahmed, et al.
Published: (2026)
by: Bourouis, Ahmed, et al.
Published: (2026)
Open Vocabulary Semantic Scene Sketch Understanding
by: Bourouis, Ahmed, et al.
Published: (2023)
by: Bourouis, Ahmed, et al.
Published: (2023)
OpenIns3D: Snap and Lookup for 3D Open-vocabulary Instance Segmentation
by: Huang, Zhening, et al.
Published: (2023)
by: Huang, Zhening, et al.
Published: (2023)
Generation Models Know Space: Unleashing Implicit 3D Priors for Scene Understanding
by: Wu, Xianjin, et al.
Published: (2026)
by: Wu, Xianjin, et al.
Published: (2026)
Neural Rendering based Urban Scene Reconstruction for Autonomous Driving
by: Shen, Shihao, et al.
Published: (2024)
by: Shen, Shihao, et al.
Published: (2024)
Agentic Scene Policies: Unifying Space, Semantics, and Affordances for Robot Action
by: Morin, Sacha, et al.
Published: (2025)
by: Morin, Sacha, et al.
Published: (2025)
SaLF: Sparse Local Fields for Multi-Sensor Rendering in Real-Time
by: Chen, Yun, et al.
Published: (2025)
by: Chen, Yun, et al.
Published: (2025)
World Guidance: World Modeling in Condition Space for Action Generation
by: Su, Yue, et al.
Published: (2026)
by: Su, Yue, et al.
Published: (2026)
DreamMotion: Space-Time Self-Similar Score Distillation for Zero-Shot Video Editing
by: Jeong, Hyeonho, et al.
Published: (2024)
by: Jeong, Hyeonho, et al.
Published: (2024)
MapBERT: Bitwise Masked Modeling for Real-Time Semantic Mapping Generation
by: Deng, Yijie, et al.
Published: (2025)
by: Deng, Yijie, et al.
Published: (2025)
Nav-R1: Reasoning and Navigation in Embodied Scenes
by: Liu, Qingxiang, et al.
Published: (2025)
by: Liu, Qingxiang, et al.
Published: (2025)
Hierarchical and Holistic Open-Vocabulary Functional 3D Scene Graphs for Indoor Spaces
by: Hu, Xinggang, et al.
Published: (2026)
by: Hu, Xinggang, et al.
Published: (2026)
DuoSpaceNet: Leveraging Both Bird's-Eye-View and Perspective View Representations for 3D Object Detection
by: Huang, Zhe, et al.
Published: (2024)
by: Huang, Zhe, et al.
Published: (2024)
3D Scene Rendering with Multimodal Gaussian Splatting
by: Gau, Chi-Shiang, et al.
Published: (2026)
by: Gau, Chi-Shiang, et al.
Published: (2026)
HR-INR: Continuous Space-Time Video Super-Resolution via Event Camera
by: Lu, Yunfan, et al.
Published: (2024)
by: Lu, Yunfan, et al.
Published: (2024)
Articraft: An Agentic System for Scalable Articulated 3D Asset Generation
by: Zhou, Matt, et al.
Published: (2026)
by: Zhou, Matt, et al.
Published: (2026)
Cross-modal State Space Modeling for Real-time RGB-thermal Wild Scene Semantic Segmentation
by: Guo, Xiaodong, et al.
Published: (2025)
by: Guo, Xiaodong, et al.
Published: (2025)
UniGS: Unified Geometry-Aware Gaussian Splatting for Multimodal Rendering
by: Xie, Yusen, et al.
Published: (2025)
by: Xie, Yusen, et al.
Published: (2025)
Estimating Scene Flow in Robot Surroundings with Distributed Miniaturized Time-of-Flight Sensors
by: Sander, Jack, et al.
Published: (2025)
by: Sander, Jack, et al.
Published: (2025)
Render and Diffuse: Aligning Image and Action Spaces for Diffusion-based Behaviour Cloning
by: Vosylius, Vitalis, et al.
Published: (2024)
by: Vosylius, Vitalis, et al.
Published: (2024)
Memory-V2V: Memory-Augmented Video-to-Video Diffusion for Consistent Multi-Turn Editing
by: Lee, Dohun, et al.
Published: (2026)
by: Lee, Dohun, et al.
Published: (2026)
TraceGen: World Modeling in 3D Trace Space Enables Learning from Cross-Embodiment Videos
by: Lee, Seungjae, et al.
Published: (2025)
by: Lee, Seungjae, et al.
Published: (2025)
DynamicCity: Large-Scale 4D Occupancy Generation from Dynamic Scenes
by: Bian, Hengwei, et al.
Published: (2024)
by: Bian, Hengwei, et al.
Published: (2024)
MouseSIS: A Frames-and-Events Dataset for Space-Time Instance Segmentation of Mice
by: Hamann, Friedhelm, et al.
Published: (2024)
by: Hamann, Friedhelm, et al.
Published: (2024)
Mode-GS: Monocular Depth Guided Anchored 3D Gaussian Splatting for Robust Ground-View Scene Rendering
by: Lee, Yonghan, et al.
Published: (2024)
by: Lee, Yonghan, et al.
Published: (2024)
LatentPilot: Scene-Aware Vision-and-Language Navigation by Dreaming Ahead with Latent Visual Reasoning
by: Hao, Haihong, et al.
Published: (2026)
by: Hao, Haihong, et al.
Published: (2026)
Friends Across Time: Multi-Scale Action Segmentation Transformer for Surgical Phase Recognition
by: Zhang, Bokai, et al.
Published: (2024)
by: Zhang, Bokai, et al.
Published: (2024)
Post-Training and Test-Time Scaling of Generative Agent Behavior Models for Interactive Autonomous Driving
by: Seong, Hyunki, et al.
Published: (2025)
by: Seong, Hyunki, et al.
Published: (2025)
InSpaceType: Reconsider Space Type in Indoor Monocular Depth Estimation
by: Wu, Cho-Ying, et al.
Published: (2023)
by: Wu, Cho-Ying, et al.
Published: (2023)
From Prompts to Pavement Through Time: Temporal Grounding in Agentic Scene-to-Plan Reasoning
by: Gado, Ahmed Y., et al.
Published: (2026)
by: Gado, Ahmed Y., et al.
Published: (2026)
GenAssets: Generating in-the-wild 3D Assets in Latent Space
by: Yang, Ze, et al.
Published: (2026)
by: Yang, Ze, et al.
Published: (2026)
Solving Motion Planning Tasks with a Scalable Generative Model
by: Hu, Yihan, et al.
Published: (2024)
by: Hu, Yihan, et al.
Published: (2024)
Towards Real-Time Generation of Delay-Compensated Video Feeds for Outdoor Mobile Robot Teleoperation
by: Chakraborty, Neeloy, et al.
Published: (2024)
by: Chakraborty, Neeloy, et al.
Published: (2024)
OMEGA: Efficient Occlusion-Aware Navigation for Air-Ground Robot in Dynamic Environments via State Space Model
by: Wang, Junming, et al.
Published: (2024)
by: Wang, Junming, et al.
Published: (2024)
Real-Time Monocular Scene Analysis for UAV in Outdoor Environments
by: AlaaEldin, Yara
Published: (2026)
by: AlaaEldin, Yara
Published: (2026)
Similar Items
-
EM-Vid: Training-Free Entity-Centric Memory for Efficient and Consistent Multi-Shot Video Generation
by: Vandersanden, Jente, et al.
Published: (2026) -
TrajectoryMover: Generative Movement of Object Trajectories in Videos
by: Chhatre, Kiran, et al.
Published: (2026) -
SmallGS: Gaussian Splatting-based Camera Pose Estimation for Small-Baseline Videos
by: Yao, Yuxin, et al.
Published: (2025) -
Efficient Camera-Controlled Video Generation of Static Scenes via Sparse Diffusion and 3D Rendering
by: Chen, Jieying, et al.
Published: (2026) -
LiteReality: Graphics-Ready 3D Scene Reconstruction from RGB-D Scans
by: Huang, Zhening, et al.
Published: (2025)