GenieDrive: Towards Physics-Aware Driving World Model with 4D Occupancy Guided Video Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Zhenya, Liu, Zhe, Lu, Yuxiang, Hou, Liping, Miao, Chenxuan, Peng, Siyi, Feng, Bailan, Bai, Xiang, Zhao, Hengshuang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UniLION: Towards Unified Autonomous Driving Model with Linear Group RNNs
di: Liu, Zhe, et al.
Pubblicazione: (2025)
di: Liu, Zhe, et al.
Pubblicazione: (2025)
Driving in the Occupancy World: Vision-Centric 4D Occupancy Forecasting and Planning via World Models for Autonomous Driving
di: Yang, Yu, et al.
Pubblicazione: (2024)
di: Yang, Yu, et al.
Pubblicazione: (2024)
DrivePI: Spatial-aware 4D MLLM for Unified Autonomous Driving Understanding, Perception, Prediction and Planning
di: Liu, Zhe, et al.
Pubblicazione: (2025)
di: Liu, Zhe, et al.
Pubblicazione: (2025)
OccGen: Generative Multi-modal 3D Occupancy Prediction for Autonomous Driving
di: Wang, Guoqing, et al.
Pubblicazione: (2024)
di: Wang, Guoqing, et al.
Pubblicazione: (2024)
HERMES++: Toward a Unified Driving World Model for 3D Scene Understanding and Generation
di: Zhou, Xin, et al.
Pubblicazione: (2026)
di: Zhou, Xin, et al.
Pubblicazione: (2026)
Learning Vision-Language-Action World Models for Autonomous Driving
di: Wang, Guoqing, et al.
Pubblicazione: (2026)
di: Wang, Guoqing, et al.
Pubblicazione: (2026)
FASTER: Rethinking Real-Time Flow VLAs
di: Lu, Yuxiang, et al.
Pubblicazione: (2026)
di: Lu, Yuxiang, et al.
Pubblicazione: (2026)
ReliOcc: Towards Reliable Semantic Occupancy Prediction via Uncertainty Learning
di: Wang, Song, et al.
Pubblicazione: (2024)
di: Wang, Song, et al.
Pubblicazione: (2024)
Semi-Supervised Vision-Centric 3D Occupancy World Model for Autonomous Driving
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
InstaDrive: Instance-Aware Driving World Models for Realistic and Consistent Video Generation
di: Yang, Zhuoran, et al.
Pubblicazione: (2026)
di: Yang, Zhuoran, et al.
Pubblicazione: (2026)
HERMES: A Unified Self-Driving World Model for Simultaneous 3D Scene Understanding and Generation
di: Zhou, Xin, et al.
Pubblicazione: (2025)
di: Zhou, Xin, et al.
Pubblicazione: (2025)
OccSora: 4D Occupancy Generation Models as World Simulators for Autonomous Driving
di: Wang, Lening, et al.
Pubblicazione: (2024)
di: Wang, Lening, et al.
Pubblicazione: (2024)
Toward Physically Consistent Driving Video World Models under Challenging Trajectories
di: Zhou, Jiawei, et al.
Pubblicazione: (2026)
di: Zhou, Jiawei, et al.
Pubblicazione: (2026)
VEON: Vocabulary-Enhanced Occupancy Prediction
di: Zheng, Jilai, et al.
Pubblicazione: (2024)
di: Zheng, Jilai, et al.
Pubblicazione: (2024)
Towards Safe and Reliable Autonomous Driving: Dynamic Occupancy Set Prediction
di: Shao, Wenbo, et al.
Pubblicazione: (2024)
di: Shao, Wenbo, et al.
Pubblicazione: (2024)
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
di: Hu, Xiaotao, et al.
Pubblicazione: (2024)
di: Hu, Xiaotao, et al.
Pubblicazione: (2024)
Efficient 3D Perception on Multi-Sweep Point Cloud with Gumbel Spatial Pruning
di: Sun, Tianyu, et al.
Pubblicazione: (2024)
di: Sun, Tianyu, et al.
Pubblicazione: (2024)
An Instance-Centric Panoptic Occupancy Prediction Benchmark for Autonomous Driving
di: Feng, Yi, et al.
Pubblicazione: (2026)
di: Feng, Yi, et al.
Pubblicazione: (2026)
ROSE: Remove Objects with Side Effects in Videos
di: Miao, Chenxuan, et al.
Pubblicazione: (2025)
di: Miao, Chenxuan, et al.
Pubblicazione: (2025)
DriveFuture: Future-Aware Latent World Models for Autonomous Driving
di: Hong, Yufeng, et al.
Pubblicazione: (2026)
di: Hong, Yufeng, et al.
Pubblicazione: (2026)
OccLLaMA: An Occupancy-Language-Action Generative World Model for Autonomous Driving
di: Wei, Julong, et al.
Pubblicazione: (2024)
di: Wei, Julong, et al.
Pubblicazione: (2024)
StyleDrive: Towards Driving-Style Aware Benchmarking of End-To-End Autonomous Driving
di: Hao, Ruiyang, et al.
Pubblicazione: (2025)
di: Hao, Ruiyang, et al.
Pubblicazione: (2025)
Class-Distribution Guided Active Learning for 3D Occupancy Prediction in Autonomous Driving
di: Kim, Wonjune, et al.
Pubblicazione: (2026)
di: Kim, Wonjune, et al.
Pubblicazione: (2026)
Towards Context-Aware Modeling of Situation Awareness in Conditionally Automated Driving
di: Avetisyan, Lilit, et al.
Pubblicazione: (2024)
di: Avetisyan, Lilit, et al.
Pubblicazione: (2024)
Drive-JEPA: Video JEPA Meets Multimodal Trajectory Distillation for End-to-End Driving
di: Wang, Linhan, et al.
Pubblicazione: (2026)
di: Wang, Linhan, et al.
Pubblicazione: (2026)
EFFOcc: Learning Efficient Occupancy Networks from Minimal Labels for Autonomous Driving
di: Shi, Yining, et al.
Pubblicazione: (2024)
di: Shi, Yining, et al.
Pubblicazione: (2024)
Offboard Occupancy Refinement with Hybrid Propagation for Autonomous Driving
di: Shi, Hao, et al.
Pubblicazione: (2024)
di: Shi, Hao, et al.
Pubblicazione: (2024)
Vanishing-Point-Guided Video Semantic Segmentation of Driving Scenes
di: Guo, Diandian, et al.
Pubblicazione: (2024)
di: Guo, Diandian, et al.
Pubblicazione: (2024)
SparseOcc: Rethinking Sparse Latent Representation for Vision-Based Semantic Occupancy Prediction
di: Tang, Pin, et al.
Pubblicazione: (2024)
di: Tang, Pin, et al.
Pubblicazione: (2024)
World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model
di: Zheng, Yupeng, et al.
Pubblicazione: (2025)
di: Zheng, Yupeng, et al.
Pubblicazione: (2025)
DriveWorld: 4D Pre-trained Scene Understanding via World Models for Autonomous Driving
di: Min, Chen, et al.
Pubblicazione: (2024)
di: Min, Chen, et al.
Pubblicazione: (2024)
Occ-LLM: Enhancing Autonomous Driving with Occupancy-Based Large Language Models
di: Xu, Tianshuo, et al.
Pubblicazione: (2025)
di: Xu, Tianshuo, et al.
Pubblicazione: (2025)
DrivingGen: A Comprehensive Benchmark for Generative Video World Models in Autonomous Driving
di: Zhou, Yang, et al.
Pubblicazione: (2026)
di: Zhou, Yang, et al.
Pubblicazione: (2026)
DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation
di: Zhao, Guosheng, et al.
Pubblicazione: (2024)
di: Zhao, Guosheng, et al.
Pubblicazione: (2024)
ConsisDrive: Identity-Preserving Driving World Models for Video Generation by Instance Mask
di: Yang, Zhuoran, et al.
Pubblicazione: (2026)
di: Yang, Zhuoran, et al.
Pubblicazione: (2026)
DriveLaW:Unifying Planning and Video Generation in a Latent Driving World
di: Xia, Tianze, et al.
Pubblicazione: (2025)
di: Xia, Tianze, et al.
Pubblicazione: (2025)
Realistic and Controllable 3D Gaussian-Guided Object Editing for Driving Video Generation
di: Li, Jiusi, et al.
Pubblicazione: (2025)
di: Li, Jiusi, et al.
Pubblicazione: (2025)
Are AI-Generated Driving Videos Ready for Autonomous Driving? A Diagnostic Evaluation Framework
di: Xiang, Xinhao, et al.
Pubblicazione: (2025)
di: Xiang, Xinhao, et al.
Pubblicazione: (2025)
ProphetDWM: A Driving World Model for Rolling Out Future Actions and Videos
di: Wang, Xiaodong, et al.
Pubblicazione: (2025)
di: Wang, Xiaodong, et al.
Pubblicazione: (2025)
Towards Latency-Aware 3D Streaming Perception for Autonomous Driving
di: Peng, Jiaqi, et al.
Pubblicazione: (2025)
di: Peng, Jiaqi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
UniLION: Towards Unified Autonomous Driving Model with Linear Group RNNs
di: Liu, Zhe, et al.
Pubblicazione: (2025) -
Driving in the Occupancy World: Vision-Centric 4D Occupancy Forecasting and Planning via World Models for Autonomous Driving
di: Yang, Yu, et al.
Pubblicazione: (2024) -
DrivePI: Spatial-aware 4D MLLM for Unified Autonomous Driving Understanding, Perception, Prediction and Planning
di: Liu, Zhe, et al.
Pubblicazione: (2025) -
OccGen: Generative Multi-modal 3D Occupancy Prediction for Autonomous Driving
di: Wang, Guoqing, et al.
Pubblicazione: (2024) -
HERMES++: Toward a Unified Driving World Model for 3D Scene Understanding and Generation
di: Zhou, Xin, et al.
Pubblicazione: (2026)