Doe-1: Closed-Loop Autonomous Driving with Large World Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Zheng, Wenzhao, Xia, Zetian, Huang, Yuanhui, Zuo, Sicheng, Zhou, Jie, Lu, Jiwen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GaussianWorld: Gaussian World Model for Streaming 3D Occupancy Prediction
di: Zuo, Sicheng, et al.
Pubblicazione: (2024)
di: Zuo, Sicheng, et al.
Pubblicazione: (2024)
EmbodiedOcc: Embodied 3D Occupancy Prediction for Vision-based Online Scene Understanding
di: Wu, Yuqi, et al.
Pubblicazione: (2024)
di: Wu, Yuqi, et al.
Pubblicazione: (2024)
Vega: Learning to Drive with Natural Language Instructions
di: Zuo, Sicheng, et al.
Pubblicazione: (2026)
di: Zuo, Sicheng, et al.
Pubblicazione: (2026)
GaussianFormer: Scene as Gaussians for Vision-Based 3D Semantic Occupancy Prediction
di: Huang, Yuanhui, et al.
Pubblicazione: (2024)
di: Huang, Yuanhui, et al.
Pubblicazione: (2024)
Terra: Explorable Native 3D World Model with Point Latents
di: Huang, Yuanhui, et al.
Pubblicazione: (2025)
di: Huang, Yuanhui, et al.
Pubblicazione: (2025)
Owl-1: Omni World Model for Consistent Long Video Generation
di: Huang, Yuanhui, et al.
Pubblicazione: (2024)
di: Huang, Yuanhui, et al.
Pubblicazione: (2024)
GPD-1: Generative Pre-training for Driving
di: Xie, Zixun, et al.
Pubblicazione: (2024)
di: Xie, Zixun, et al.
Pubblicazione: (2024)
DVGT-2: Vision-Geometry-Action Model for Autonomous Driving at Scale
di: Zuo, Sicheng, et al.
Pubblicazione: (2026)
di: Zuo, Sicheng, et al.
Pubblicazione: (2026)
OccSora: 4D Occupancy Generation Models as World Simulators for Autonomous Driving
di: Wang, Lening, et al.
Pubblicazione: (2024)
di: Wang, Lening, et al.
Pubblicazione: (2024)
SpectralAR: Spectral Autoregressive Visual Generation
di: Huang, Yuanhui, et al.
Pubblicazione: (2025)
di: Huang, Yuanhui, et al.
Pubblicazione: (2025)
V2M: Visual 2-Dimensional Mamba for Image Representation Learning
di: Wang, Chengkun, et al.
Pubblicazione: (2024)
di: Wang, Chengkun, et al.
Pubblicazione: (2024)
DriveTok: 3D Driving Scene Tokenization for Unified Multi-View Reconstruction and Understanding
di: Zhuo, Dong, et al.
Pubblicazione: (2026)
di: Zhuo, Dong, et al.
Pubblicazione: (2026)
DVGT: Driving Visual Geometry Transformer
di: Zuo, Sicheng, et al.
Pubblicazione: (2025)
di: Zuo, Sicheng, et al.
Pubblicazione: (2025)
GaussianFormer-2: Probabilistic Gaussian Superposition for Efficient 3D Occupancy Prediction
di: Huang, Yuanhui, et al.
Pubblicazione: (2024)
di: Huang, Yuanhui, et al.
Pubblicazione: (2024)
Point3R: Streaming 3D Reconstruction with Explicit Spatial Pointer Memory
di: Wu, Yuqi, et al.
Pubblicazione: (2025)
di: Wu, Yuqi, et al.
Pubblicazione: (2025)
Moaw: Unleashing Motion Awareness for Video Diffusion Models
di: Zhang, Tianqi, et al.
Pubblicazione: (2026)
di: Zhang, Tianqi, et al.
Pubblicazione: (2026)
Driv3R: Learning Dense 4D Reconstruction for Autonomous Driving
di: Fei, Xin, et al.
Pubblicazione: (2024)
di: Fei, Xin, et al.
Pubblicazione: (2024)
QuadricFormer: Scene as Superquadrics for 3D Semantic Occupancy Prediction
di: Zuo, Sicheng, et al.
Pubblicazione: (2025)
di: Zuo, Sicheng, et al.
Pubblicazione: (2025)
Astra: General Interactive World Model with Autoregressive Denoising
di: Zhu, Yixuan, et al.
Pubblicazione: (2025)
di: Zhu, Yixuan, et al.
Pubblicazione: (2025)
BridgeDrive: Diffusion Bridge Policy for Closed-Loop Trajectory Planning in Autonomous Driving
di: Liu, Shu, et al.
Pubblicazione: (2025)
di: Liu, Shu, et al.
Pubblicazione: (2025)
GlobalMamba: Global Image Serialization for Vision Mamba
di: Wang, Chengkun, et al.
Pubblicazione: (2024)
di: Wang, Chengkun, et al.
Pubblicazione: (2024)
GaussianAD: Gaussian-Centric End-to-End Autonomous Driving
di: Zheng, Wenzhao, et al.
Pubblicazione: (2024)
di: Zheng, Wenzhao, et al.
Pubblicazione: (2024)
AD-R1: Closed-Loop Reinforcement Learning for End-to-End Autonomous Driving with Impartial World Models
di: Yan, Tianyi, et al.
Pubblicazione: (2025)
di: Yan, Tianyi, et al.
Pubblicazione: (2025)
Stag-1: Towards Realistic 4D Driving Simulation with Video Generation Model
di: Wang, Lening, et al.
Pubblicazione: (2024)
di: Wang, Lening, et al.
Pubblicazione: (2024)
Reason--Imagine--Act: Closed-Loop LLM Decision Making with World Models for Autonomous Driving
di: Sun, Zhengqi, et al.
Pubblicazione: (2026)
di: Sun, Zhengqi, et al.
Pubblicazione: (2026)
Streaming 4D Visual Geometry Transformer
di: Zhuo, Dong, et al.
Pubblicazione: (2025)
di: Zhuo, Dong, et al.
Pubblicazione: (2025)
Hardness-Aware Scene Synthesis for Semi-Supervised 3D Object Detection
di: Zeng, Shuai, et al.
Pubblicazione: (2024)
di: Zeng, Shuai, et al.
Pubblicazione: (2024)
$\textit{S}^3$Gaussian: Self-Supervised Street Gaussians for Autonomous Driving
di: Huang, Nan, et al.
Pubblicazione: (2024)
di: Huang, Nan, et al.
Pubblicazione: (2024)
Path Choice Matters for Clear Attribution in Path Methods
di: Zhang, Borui, et al.
Pubblicazione: (2024)
di: Zhang, Borui, et al.
Pubblicazione: (2024)
Preventing Local Pitfalls in Vector Quantization via Optimal Transport
di: Zhang, Borui, et al.
Pubblicazione: (2024)
di: Zhang, Borui, et al.
Pubblicazione: (2024)
$\bf{D^3}$QE: Learning Discrete Distribution Discrepancy-aware Quantization Error for Autoregressive-Generated Image Detection
di: Zhang, Yanran, et al.
Pubblicazione: (2025)
di: Zhang, Yanran, et al.
Pubblicazione: (2025)
GenWorld: Towards Detecting AI-generated Real-world Simulation Videos
di: Chen, Weiliang, et al.
Pubblicazione: (2025)
di: Chen, Weiliang, et al.
Pubblicazione: (2025)
Latent Diffusion Model without Variational Autoencoder
di: Shi, Minglei, et al.
Pubblicazione: (2025)
di: Shi, Minglei, et al.
Pubblicazione: (2025)
OGGSplat: Open Gaussian Growing for Generalizable Reconstruction with Expanded Field-of-View
di: Wang, Yanbo, et al.
Pubblicazione: (2025)
di: Wang, Yanbo, et al.
Pubblicazione: (2025)
DrivingRecon: Large 4D Gaussian Reconstruction Model For Autonomous Driving
di: Lu, Hao, et al.
Pubblicazione: (2024)
di: Lu, Hao, et al.
Pubblicazione: (2024)
CoWorld-VLA: Thinking in a Multi-Expert World Model for Autonomous Driving
di: Huang, Minqing, et al.
Pubblicazione: (2026)
di: Huang, Minqing, et al.
Pubblicazione: (2026)
GaussianToken: An Effective Image Tokenizer with 2D Gaussian Splatting
di: Dong, Jiajun, et al.
Pubblicazione: (2025)
di: Dong, Jiajun, et al.
Pubblicazione: (2025)
HiDrive: A Closed-Loop Benchmark for High-Level Autonomous Driving
di: Xia, Zhongyu, et al.
Pubblicazione: (2026)
di: Xia, Zhongyu, et al.
Pubblicazione: (2026)
CLOVER: Closed-Loop Value Estimation and Ranking for End-to-End Autonomous Driving Planning
di: Ang, Sining, et al.
Pubblicazione: (2026)
di: Ang, Sining, et al.
Pubblicazione: (2026)
Measuring 3D Spatial Geometric Consistency in Dynamic Generated Videos
di: Dou, Weijia, et al.
Pubblicazione: (2026)
di: Dou, Weijia, et al.
Pubblicazione: (2026)
Documenti analoghi
-
GaussianWorld: Gaussian World Model for Streaming 3D Occupancy Prediction
di: Zuo, Sicheng, et al.
Pubblicazione: (2024) -
EmbodiedOcc: Embodied 3D Occupancy Prediction for Vision-based Online Scene Understanding
di: Wu, Yuqi, et al.
Pubblicazione: (2024) -
Vega: Learning to Drive with Natural Language Instructions
di: Zuo, Sicheng, et al.
Pubblicazione: (2026) -
GaussianFormer: Scene as Gaussians for Vision-Based 3D Semantic Occupancy Prediction
di: Huang, Yuanhui, et al.
Pubblicazione: (2024) -
Terra: Explorable Native 3D World Model with Point Latents
di: Huang, Yuanhui, et al.
Pubblicazione: (2025)