GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving
Fuente:
arXiv
Salvato in:
| Autori principali: | Russell, Lloyd, Hu, Anthony, Bertoni, Lorenzo, Fedoseev, George, Shotton, Jamie, Arani, Elahe, Corrado, Gianluca |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LingoQA: Visual Question Answering for Autonomous Driving
di: Marcu, Ana-Maria, et al.
Pubblicazione: (2023)
di: Marcu, Ana-Maria, et al.
Pubblicazione: (2023)
SimLingo: Vision-Only Closed-Loop Autonomous Driving with Language-Action Alignment
di: Renz, Katrin, et al.
Pubblicazione: (2025)
di: Renz, Katrin, et al.
Pubblicazione: (2025)
WayveScenes101: A Dataset and Benchmark for Novel View Synthesis in Autonomous Driving
di: Zürn, Jannik, et al.
Pubblicazione: (2024)
di: Zürn, Jannik, et al.
Pubblicazione: (2024)
LangProp: A code optimization framework using Large Language Models applied to driving
di: Ishida, Shu, et al.
Pubblicazione: (2024)
di: Ishida, Shu, et al.
Pubblicazione: (2024)
CarLLaVA: Vision language models for camera-only closed-loop driving
di: Renz, Katrin, et al.
Pubblicazione: (2024)
di: Renz, Katrin, et al.
Pubblicazione: (2024)
CARIL: Confidence-Aware Regression in Imitation Learning for Autonomous Driving
di: Delavari, Elahe, et al.
Pubblicazione: (2025)
di: Delavari, Elahe, et al.
Pubblicazione: (2025)
Learning Direct Control Policies with Flow Matching for Autonomous Driving
di: Ceresini, Marcello, et al.
Pubblicazione: (2026)
di: Ceresini, Marcello, et al.
Pubblicazione: (2026)
SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control
di: Huang, Binyuan, et al.
Pubblicazione: (2024)
di: Huang, Binyuan, et al.
Pubblicazione: (2024)
OccLLaMA: An Occupancy-Language-Action Generative World Model for Autonomous Driving
di: Wei, Julong, et al.
Pubblicazione: (2024)
di: Wei, Julong, et al.
Pubblicazione: (2024)
DragTraffic: Interactive and Controllable Traffic Scene Generation for Autonomous Driving
di: Wang, Sheng, et al.
Pubblicazione: (2024)
di: Wang, Sheng, et al.
Pubblicazione: (2024)
HybridWorldSim: A Scalable and Controllable High-fidelity Simulator for Autonomous Driving
di: Li, Qiang, et al.
Pubblicazione: (2025)
di: Li, Qiang, et al.
Pubblicazione: (2025)
A Survey of World Models for Autonomous Driving
di: Feng, Tuo, et al.
Pubblicazione: (2025)
di: Feng, Tuo, et al.
Pubblicazione: (2025)
Map-World: Masked Action planning and Path-Integral World Model for Autonomous Driving
di: Hu, Bin, et al.
Pubblicazione: (2025)
di: Hu, Bin, et al.
Pubblicazione: (2025)
Uni-World VLA: Interleaved World Modeling and Planning for Autonomous Driving
di: Liu, Qiqi, et al.
Pubblicazione: (2026)
di: Liu, Qiqi, et al.
Pubblicazione: (2026)
GeoDrive: 3D Geometry-Informed Driving World Model with Precise Action Control
di: Chen, Anthony, et al.
Pubblicazione: (2025)
di: Chen, Anthony, et al.
Pubblicazione: (2025)
Risk-Aware World Model Predictive Control for Generalizable End-to-End Autonomous Driving
di: Sun, Jiangxin, et al.
Pubblicazione: (2026)
di: Sun, Jiangxin, et al.
Pubblicazione: (2026)
DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving
di: jia, Feiyang, et al.
Pubblicazione: (2026)
di: jia, Feiyang, et al.
Pubblicazione: (2026)
DynFlowDrive: Flow-Based Dynamic World Modeling for Autonomous Driving
di: Liu, Xiaolu, et al.
Pubblicazione: (2026)
di: Liu, Xiaolu, et al.
Pubblicazione: (2026)
ReSim: Reliable World Simulation for Autonomous Driving
di: Yang, Jiazhi, et al.
Pubblicazione: (2025)
di: Yang, Jiazhi, et al.
Pubblicazione: (2025)
Benchmarking and Improving Bird's Eye View Perception Robustness in Autonomous Driving
di: Xie, Shaoyuan, et al.
Pubblicazione: (2024)
di: Xie, Shaoyuan, et al.
Pubblicazione: (2024)
Depth3DLane: Fusing Monocular 3D Lane Detection with Self-Supervised Monocular Depth Estimation
di: Hoven, Max van den, et al.
Pubblicazione: (2025)
di: Hoven, Max van den, et al.
Pubblicazione: (2025)
ACT-Bench: Towards Action Controllable World Models for Autonomous Driving
di: Arai, Hidehisa, et al.
Pubblicazione: (2024)
di: Arai, Hidehisa, et al.
Pubblicazione: (2024)
DrivingGen: A Comprehensive Benchmark for Generative Video World Models in Autonomous Driving
di: Zhou, Yang, et al.
Pubblicazione: (2026)
di: Zhou, Yang, et al.
Pubblicazione: (2026)
Progressive Bird's Eye View Perception for Safety-Critical Autonomous Driving: A Comprehensive Survey
di: Gong, Yan, et al.
Pubblicazione: (2025)
di: Gong, Yan, et al.
Pubblicazione: (2025)
Controllable Pedestrian Video Editing for Multi-View Driving Scenarios via Motion Sequence
di: Fu, Danzhen, et al.
Pubblicazione: (2025)
di: Fu, Danzhen, et al.
Pubblicazione: (2025)
WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving
di: Yang, Pengxuan, et al.
Pubblicazione: (2025)
di: Yang, Pengxuan, et al.
Pubblicazione: (2025)
DynVLA: Learning World Dynamics for Action Reasoning in Autonomous Driving
di: Shang, Shuyao, et al.
Pubblicazione: (2026)
di: Shang, Shuyao, et al.
Pubblicazione: (2026)
LiDAR-BEVMTN: Real-Time LiDAR Bird's-Eye View Multi-Task Perception Network for Autonomous Driving
di: Mohapatra, Sambit, et al.
Pubblicazione: (2023)
di: Mohapatra, Sambit, et al.
Pubblicazione: (2023)
ComDrive: Comfort-Oriented End-to-End Autonomous Driving
di: Wang, Junming, et al.
Pubblicazione: (2024)
di: Wang, Junming, et al.
Pubblicazione: (2024)
Latent-WAM: Latent World Action Modeling for End-to-End Autonomous Driving
di: Wang, Linbo, et al.
Pubblicazione: (2026)
di: Wang, Linbo, et al.
Pubblicazione: (2026)
Unifying Language-Action Understanding and Generation for Autonomous Driving
di: Wang, Xinyang, et al.
Pubblicazione: (2026)
di: Wang, Xinyang, et al.
Pubblicazione: (2026)
Generalizing Motion Planners with Mixture of Experts for Autonomous Driving
di: Sun, Qiao, et al.
Pubblicazione: (2024)
di: Sun, Qiao, et al.
Pubblicazione: (2024)
Graph-Based Multi-Modal Sensor Fusion for Autonomous Driving
di: Sani, Depanshu, et al.
Pubblicazione: (2024)
di: Sani, Depanshu, et al.
Pubblicazione: (2024)
Self-supervised Multi-future Occupancy Forecasting for Autonomous Driving
di: Lange, Bernard, et al.
Pubblicazione: (2024)
di: Lange, Bernard, et al.
Pubblicazione: (2024)
Distilling Multi-modal Large Language Models for Autonomous Driving
di: Hegde, Deepti, et al.
Pubblicazione: (2025)
di: Hegde, Deepti, et al.
Pubblicazione: (2025)
Driving in Corner Case: A Real-World Adversarial Closed-Loop Evaluation Platform for End-to-End Autonomous Driving
di: Geng, Jiaheng, et al.
Pubblicazione: (2025)
di: Geng, Jiaheng, et al.
Pubblicazione: (2025)
Exploring the Interplay Between Video Generation and World Models in Autonomous Driving: A Survey
di: Fu, Ao, et al.
Pubblicazione: (2024)
di: Fu, Ao, et al.
Pubblicazione: (2024)
HEAT: Heterogeneous End-to-End Autonomous Driving via Trajectory-Guided World Models
di: Cho, Hoonhee, et al.
Pubblicazione: (2026)
di: Cho, Hoonhee, et al.
Pubblicazione: (2026)
GAD-Generative Learning for HD Map-Free Autonomous Driving
di: Sun, Weijian, et al.
Pubblicazione: (2024)
di: Sun, Weijian, et al.
Pubblicazione: (2024)
Foundation Models for Trajectory Planning in Autonomous Driving: A Review of Progress and Open Challenges
di: Oksuz, Kemal, et al.
Pubblicazione: (2025)
di: Oksuz, Kemal, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LingoQA: Visual Question Answering for Autonomous Driving
di: Marcu, Ana-Maria, et al.
Pubblicazione: (2023) -
SimLingo: Vision-Only Closed-Loop Autonomous Driving with Language-Action Alignment
di: Renz, Katrin, et al.
Pubblicazione: (2025) -
WayveScenes101: A Dataset and Benchmark for Novel View Synthesis in Autonomous Driving
di: Zürn, Jannik, et al.
Pubblicazione: (2024) -
LangProp: A code optimization framework using Large Language Models applied to driving
di: Ishida, Shu, et al.
Pubblicazione: (2024) -
CarLLaVA: Vision language models for camera-only closed-loop driving
di: Renz, Katrin, et al.
Pubblicazione: (2024)