Unifying Language-Action Understanding and Generation for Autonomous Driving
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Xinyang, Liu, Qian, Ding, Wenjie, Yang, Zhao, Li, Wei, Liu, Chang, Li, Bailin, Zhan, Kun, Lang, Xianpeng, Chen, Wei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Generalizing Motion Planners with Mixture of Experts for Autonomous Driving
por: Sun, Qiao, et al.
Publicado: (2024)
por: Sun, Qiao, et al.
Publicado: (2024)
DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models
por: Tian, Xiaoyu, et al.
Publicado: (2024)
por: Tian, Xiaoyu, et al.
Publicado: (2024)
UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
por: Li, Yongkang, et al.
Publicado: (2026)
por: Li, Yongkang, et al.
Publicado: (2026)
OccLLaMA: An Occupancy-Language-Action Generative World Model for Autonomous Driving
por: Wei, Julong, et al.
Publicado: (2024)
por: Wei, Julong, et al.
Publicado: (2024)
TransDiffuser: Diverse Trajectory Generation with Decorrelated Multi-modal Representation for End-to-end Autonomous Driving
por: Jiang, Xuefeng, et al.
Publicado: (2025)
por: Jiang, Xuefeng, et al.
Publicado: (2025)
DiffAD: A Unified Diffusion Modeling Approach for Autonomous Driving
por: Wang, Tao, et al.
Publicado: (2025)
por: Wang, Tao, et al.
Publicado: (2025)
OLiDM: Object-aware LiDAR Diffusion Models for Autonomous Driving
por: Yan, Tianyi, et al.
Publicado: (2024)
por: Yan, Tianyi, et al.
Publicado: (2024)
DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving
por: jia, Feiyang, et al.
Publicado: (2026)
por: jia, Feiyang, et al.
Publicado: (2026)
Discrete Diffusion for Reflective Vision-Language-Action Models in Autonomous Driving
por: Li, Pengxiang, et al.
Publicado: (2025)
por: Li, Pengxiang, et al.
Publicado: (2025)
The Better You Learn, The Smarter You Prune: Towards Efficient Vision-language-action Models via Differentiable Token Pruning
por: Jiang, Titong, et al.
Publicado: (2025)
por: Jiang, Titong, et al.
Publicado: (2025)
AutoMoT: A Unified Vision-Language-Action Model with Asynchronous Mixture-of-Transformers for End-to-End Autonomous Driving
por: Huang, Wenhui, et al.
Publicado: (2026)
por: Huang, Wenhui, et al.
Publicado: (2026)
Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving
por: Jiang, Bo, et al.
Publicado: (2024)
por: Jiang, Bo, et al.
Publicado: (2024)
A Survey on Vision-Language-Action Models for Autonomous Driving
por: Jiang, Sicong, et al.
Publicado: (2025)
por: Jiang, Sicong, et al.
Publicado: (2025)
DynVLA: Learning World Dynamics for Action Reasoning in Autonomous Driving
por: Shang, Shuyao, et al.
Publicado: (2026)
por: Shang, Shuyao, et al.
Publicado: (2026)
A Unified Perception-Language-Action Framework for Adaptive Autonomous Driving
por: Zhang, Yi, et al.
Publicado: (2025)
por: Zhang, Yi, et al.
Publicado: (2025)
Learning Personalized Driving Styles via Reinforcement Learning from Human Feedback
por: Li, Derun, et al.
Publicado: (2025)
por: Li, Derun, et al.
Publicado: (2025)
Data-Centric Evolution in Autonomous Driving: A Comprehensive Survey of Big Data System, Data Mining, and Closed-Loop Technologies
por: Li, Lincan, et al.
Publicado: (2024)
por: Li, Lincan, et al.
Publicado: (2024)
Autoregressive Meta-Actions for Unified Controllable Trajectory Generation
por: Zhao, Jianbo, et al.
Publicado: (2025)
por: Zhao, Jianbo, et al.
Publicado: (2025)
DriveArena: A Closed-loop Generative Simulation Platform for Autonomous Driving
por: Yang, Xuemeng, et al.
Publicado: (2024)
por: Yang, Xuemeng, et al.
Publicado: (2024)
Latent-WAM: Latent World Action Modeling for End-to-End Autonomous Driving
por: Wang, Linbo, et al.
Publicado: (2026)
por: Wang, Linbo, et al.
Publicado: (2026)
DriveAgent-R1: Advancing VLM-based Autonomous Driving with Active Perception and Hybrid Thinking
por: Zheng, Weicheng, et al.
Publicado: (2025)
por: Zheng, Weicheng, et al.
Publicado: (2025)
LMGenDrive: Bridging Multimodal Understanding and Generative World Modeling for End-to-End Driving
por: Shao, Hao, et al.
Publicado: (2026)
por: Shao, Hao, et al.
Publicado: (2026)
WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving
por: Yang, Pengxuan, et al.
Publicado: (2025)
por: Yang, Pengxuan, et al.
Publicado: (2025)
PerlAD: Towards Enhanced Closed-loop End-to-end Autonomous Driving with Pseudo-simulation-based Reinforcement Learning
por: Gao, Yinfeng, et al.
Publicado: (2026)
por: Gao, Yinfeng, et al.
Publicado: (2026)
AgentThink: A Unified Framework for Tool-Augmented Chain-of-Thought Reasoning in Vision-Language Models for Autonomous Driving
por: Qian, Kangan, et al.
Publicado: (2025)
por: Qian, Kangan, et al.
Publicado: (2025)
MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning
por: Fu, Haoyu, et al.
Publicado: (2025)
por: Fu, Haoyu, et al.
Publicado: (2025)
Grid-Centric Traffic Scenario Perception for Autonomous Driving: A Comprehensive Review
por: Shi, Yining, et al.
Publicado: (2023)
por: Shi, Yining, et al.
Publicado: (2023)
Asynchronous Large Language Model Enhanced Planner for Autonomous Driving
por: Chen, Yuan, et al.
Publicado: (2024)
por: Chen, Yuan, et al.
Publicado: (2024)
SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control
por: Huang, Binyuan, et al.
Publicado: (2024)
por: Huang, Binyuan, et al.
Publicado: (2024)
Reasoning-VLA: A Fast and General Vision-Language-Action Reasoning Model for Autonomous Driving
por: Zhang, Dapeng, et al.
Publicado: (2025)
por: Zhang, Dapeng, et al.
Publicado: (2025)
GAD-Generative Learning for HD Map-Free Autonomous Driving
por: Sun, Weijian, et al.
Publicado: (2024)
por: Sun, Weijian, et al.
Publicado: (2024)
Application of Vision-Language Model to Pedestrians Behavior and Scene Understanding in Autonomous Driving
por: Gao, Haoxiang, et al.
Publicado: (2025)
por: Gao, Haoxiang, et al.
Publicado: (2025)
DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving
por: Yang, Zhenjie, et al.
Publicado: (2025)
por: Yang, Zhenjie, et al.
Publicado: (2025)
ComDrive: Comfort-Oriented End-to-End Autonomous Driving
por: Wang, Junming, et al.
Publicado: (2024)
por: Wang, Junming, et al.
Publicado: (2024)
DriveLiDAR4D: Sequential and Controllable LiDAR Scene Generation for Autonomous Driving
por: Cai, Kaiwen, et al.
Publicado: (2025)
por: Cai, Kaiwen, et al.
Publicado: (2025)
LanguageMPC: Large Language Models as Decision Makers for Autonomous Driving
por: Sha, Hao, et al.
Publicado: (2023)
por: Sha, Hao, et al.
Publicado: (2023)
MindVLA-U1: VLA Beats VA with Unified Streaming Architecture for Autonomous Driving
por: Huang, Yuzhou, et al.
Publicado: (2026)
por: Huang, Yuzhou, et al.
Publicado: (2026)
Unified Vision-Language-Action Model
por: Wang, Yuqi, et al.
Publicado: (2025)
por: Wang, Yuqi, et al.
Publicado: (2025)
GaussianAD: Gaussian-Centric End-to-End Autonomous Driving
por: Zheng, Wenzhao, et al.
Publicado: (2024)
por: Zheng, Wenzhao, et al.
Publicado: (2024)
HetroD: A High-Fidelity Drone Dataset and Benchmark for Autonomous Driving in Heterogeneous Traffic
por: Chen, Yu-Hsiang, et al.
Publicado: (2026)
por: Chen, Yu-Hsiang, et al.
Publicado: (2026)
Ejemplares similares
-
Generalizing Motion Planners with Mixture of Experts for Autonomous Driving
por: Sun, Qiao, et al.
Publicado: (2024) -
DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models
por: Tian, Xiaoyu, et al.
Publicado: (2024) -
UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
por: Li, Yongkang, et al.
Publicado: (2026) -
OccLLaMA: An Occupancy-Language-Action Generative World Model for Autonomous Driving
por: Wei, Julong, et al.
Publicado: (2024) -
TransDiffuser: Diverse Trajectory Generation with Decorrelated Multi-modal Representation for End-to-end Autonomous Driving
por: Jiang, Xuefeng, et al.
Publicado: (2025)