DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving
Fuente:
arXiv
Guardado en:
| Autores principales: | jia, Feiyang, Liu, Lin, Song, Ziying, Jia, Caiyan, Ye, Hangjun, Hao, Xiaoshuai, Chen, Long |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
por: Li, Yongkang, et al.
Publicado: (2026)
por: Li, Yongkang, et al.
Publicado: (2026)
DynVLA: Learning World Dynamics for Action Reasoning in Autonomous Driving
por: Shang, Shuyao, et al.
Publicado: (2026)
por: Shang, Shuyao, et al.
Publicado: (2026)
Latent-WAM: Latent World Action Modeling for End-to-End Autonomous Driving
por: Wang, Linbo, et al.
Publicado: (2026)
por: Wang, Linbo, et al.
Publicado: (2026)
RotVLA: Rotational Latent Action for Vision-Language-Action Model
por: Li, Qiwei, et al.
Publicado: (2026)
por: Li, Qiwei, et al.
Publicado: (2026)
Uni-World VLA: Interleaved World Modeling and Planning for Autonomous Driving
por: Liu, Qiqi, et al.
Publicado: (2026)
por: Liu, Qiqi, et al.
Publicado: (2026)
LaST-VLA: Thinking in Latent Spatio-Temporal Space for Vision-Language-Action in Autonomous Driving
por: Luo, Yuechen, et al.
Publicado: (2026)
por: Luo, Yuechen, et al.
Publicado: (2026)
VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model
por: Sun, Jingwen, et al.
Publicado: (2026)
por: Sun, Jingwen, et al.
Publicado: (2026)
DIVER: Reinforced Diffusion Breaks Imitation Bottlenecks in End-to-End Autonomous Driving
por: Song, Ziying, et al.
Publicado: (2025)
por: Song, Ziying, et al.
Publicado: (2025)
GuideFlow: Constraint-Guided Flow Matching for Planning in End-to-End Autonomous Driving
por: Liu, Lin, et al.
Publicado: (2025)
por: Liu, Lin, et al.
Publicado: (2025)
Reasoning-VLA: A Fast and General Vision-Language-Action Reasoning Model for Autonomous Driving
por: Zhang, Dapeng, et al.
Publicado: (2025)
por: Zhang, Dapeng, et al.
Publicado: (2025)
DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving
por: Jiang, Anqing, et al.
Publicado: (2025)
por: Jiang, Anqing, et al.
Publicado: (2025)
StyleVLA: Driving Style-Aware Vision Language Action Model for Autonomous Driving
por: Gao, Yuan, et al.
Publicado: (2026)
por: Gao, Yuan, et al.
Publicado: (2026)
DriveWorld: 4D Pre-trained Scene Understanding via World Models for Autonomous Driving
por: Min, Chen, et al.
Publicado: (2024)
por: Min, Chen, et al.
Publicado: (2024)
Unifying Language-Action Understanding and Generation for Autonomous Driving
por: Wang, Xinyang, et al.
Publicado: (2026)
por: Wang, Xinyang, et al.
Publicado: (2026)
WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving
por: Yang, Pengxuan, et al.
Publicado: (2025)
por: Yang, Pengxuan, et al.
Publicado: (2025)
ReSim: Reliable World Simulation for Autonomous Driving
por: Yang, Jiazhi, et al.
Publicado: (2025)
por: Yang, Jiazhi, et al.
Publicado: (2025)
Map-World: Masked Action planning and Path-Integral World Model for Autonomous Driving
por: Hu, Bin, et al.
Publicado: (2025)
por: Hu, Bin, et al.
Publicado: (2025)
HiST-VLA: A Hierarchical Spatio-Temporal Vision-Language-Action Model for End-to-End Autonomous Driving
por: Wang, Yiru, et al.
Publicado: (2026)
por: Wang, Yiru, et al.
Publicado: (2026)
OccLLaMA: An Occupancy-Language-Action Generative World Model for Autonomous Driving
por: Wei, Julong, et al.
Publicado: (2024)
por: Wei, Julong, et al.
Publicado: (2024)
ComDrive: Comfort-Oriented End-to-End Autonomous Driving
por: Wang, Junming, et al.
Publicado: (2024)
por: Wang, Junming, et al.
Publicado: (2024)
A Survey on Vision-Language-Action Models for Autonomous Driving
por: Jiang, Sicong, et al.
Publicado: (2025)
por: Jiang, Sicong, et al.
Publicado: (2025)
MindVLA-U1: VLA Beats VA with Unified Streaming Architecture for Autonomous Driving
por: Huang, Yuzhou, et al.
Publicado: (2026)
por: Huang, Yuzhou, et al.
Publicado: (2026)
DynFlowDrive: Flow-Based Dynamic World Modeling for Autonomous Driving
por: Liu, Xiaolu, et al.
Publicado: (2026)
por: Liu, Xiaolu, et al.
Publicado: (2026)
SimLingo: Vision-Only Closed-Loop Autonomous Driving with Language-Action Alignment
por: Renz, Katrin, et al.
Publicado: (2025)
por: Renz, Katrin, et al.
Publicado: (2025)
A Unified Perception-Language-Action Framework for Adaptive Autonomous Driving
por: Zhang, Yi, et al.
Publicado: (2025)
por: Zhang, Yi, et al.
Publicado: (2025)
AutoMoT: A Unified Vision-Language-Action Model with Asynchronous Mixture-of-Transformers for End-to-End Autonomous Driving
por: Huang, Wenhui, et al.
Publicado: (2026)
por: Huang, Wenhui, et al.
Publicado: (2026)
DriveFuture: Future-Aware Latent World Models for Autonomous Driving
por: Hong, Yufeng, et al.
Publicado: (2026)
por: Hong, Yufeng, et al.
Publicado: (2026)
RynnVLA-002: A Unified Vision-Language-Action and World Model
por: Cen, Jun, et al.
Publicado: (2025)
por: Cen, Jun, et al.
Publicado: (2025)
DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving
por: Yang, Zhenjie, et al.
Publicado: (2025)
por: Yang, Zhenjie, et al.
Publicado: (2025)
ACT-Bench: Towards Action Controllable World Models for Autonomous Driving
por: Arai, Hidehisa, et al.
Publicado: (2024)
por: Arai, Hidehisa, et al.
Publicado: (2024)
Robustness-Aware 3D Object Detection in Autonomous Driving: A Review and Outlook
por: Song, Ziying, et al.
Publicado: (2024)
por: Song, Ziying, et al.
Publicado: (2024)
SimScale: Learning to Drive via Real-World Simulation at Scale
por: Tian, Haochen, et al.
Publicado: (2025)
por: Tian, Haochen, et al.
Publicado: (2025)
IRL-VLA: Training an Vision-Language-Action Policy via Reward World Model
por: Jiang, Anqing, et al.
Publicado: (2025)
por: Jiang, Anqing, et al.
Publicado: (2025)
Percept-WAM: Perception-Enhanced World-Awareness-Action Model for Robust End-to-End Autonomous Driving
por: Han, Jianhua, et al.
Publicado: (2025)
por: Han, Jianhua, et al.
Publicado: (2025)
MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning
por: Fu, Haoyu, et al.
Publicado: (2025)
por: Fu, Haoyu, et al.
Publicado: (2025)
GeoDrive: 3D Geometry-Informed Driving World Model with Precise Action Control
por: Chen, Anthony, et al.
Publicado: (2025)
por: Chen, Anthony, et al.
Publicado: (2025)
A Survey of World Models for Autonomous Driving
por: Feng, Tuo, et al.
Publicado: (2025)
por: Feng, Tuo, et al.
Publicado: (2025)
LVDrive: Latent Visual Representation Enhanced Vision-Language-Action Autonomous Driving Model
por: Mei, Xiaodong, et al.
Publicado: (2026)
por: Mei, Xiaodong, et al.
Publicado: (2026)
Beyond Imitation: Constraint-Aware Trajectory Generation with Flow Matching For End-to-End Autonomous Driving
por: Liu, Lin, et al.
Publicado: (2025)
por: Liu, Lin, et al.
Publicado: (2025)
Vision-Language-Action Models for Autonomous Driving: Past, Present, and Future
por: Hu, Tianshuai, et al.
Publicado: (2025)
por: Hu, Tianshuai, et al.
Publicado: (2025)
Ejemplares similares
-
UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
por: Li, Yongkang, et al.
Publicado: (2026) -
DynVLA: Learning World Dynamics for Action Reasoning in Autonomous Driving
por: Shang, Shuyao, et al.
Publicado: (2026) -
Latent-WAM: Latent World Action Modeling for End-to-End Autonomous Driving
por: Wang, Linbo, et al.
Publicado: (2026) -
RotVLA: Rotational Latent Action for Vision-Language-Action Model
por: Li, Qiwei, et al.
Publicado: (2026) -
Uni-World VLA: Interleaved World Modeling and Planning for Autonomous Driving
por: Liu, Qiqi, et al.
Publicado: (2026)