OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Shihao, Yu, Zhiding, Jiang, Xiaohui, Lan, Shiyi, Shi, Min, Chang, Nadine, Kautz, Jan, Li, Ying, Alvarez, Jose M. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning
por: Wang, Shihao, et al.
Publicado: (2025)
por: Wang, Shihao, et al.
Publicado: (2025)
Enhancing Autonomous Driving Safety with Collision Scenario Integration
por: Wang, Zi, et al.
Publicado: (2025)
por: Wang, Zi, et al.
Publicado: (2025)
OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving
por: Zhang, Zhenguo, et al.
Publicado: (2025)
por: Zhang, Zhenguo, et al.
Publicado: (2025)
Is Ego Status All You Need for Open-Loop End-to-End Autonomous Driving?
por: Li, Zhiqi, et al.
Publicado: (2023)
por: Li, Zhiqi, et al.
Publicado: (2023)
Exploring Camera Encoder Designs for Autonomous Driving Perception
por: Lakshmanan, Barath, et al.
Publicado: (2024)
por: Lakshmanan, Barath, et al.
Publicado: (2024)
Hydra-NeXt: Robust Closed-Loop Driving with Open-Loop Training
por: Li, Zhenxin, et al.
Publicado: (2025)
por: Li, Zhenxin, et al.
Publicado: (2025)
DriveCritic: Towards Context-Aware, Human-Aligned Evaluation for Autonomous Driving with Vision-Language Models
por: Song, Jingyu, et al.
Publicado: (2025)
por: Song, Jingyu, et al.
Publicado: (2025)
Centaur: Robust End-to-End Autonomous Driving with Test-Time Training
por: Sima, Chonghao, et al.
Publicado: (2025)
por: Sima, Chonghao, et al.
Publicado: (2025)
DriveX: Omni Scene Modeling for Learning Generalizable World Knowledge in Autonomous Driving
por: Shi, Chen, et al.
Publicado: (2025)
por: Shi, Chen, et al.
Publicado: (2025)
StreamChat: Chatting with Streaming Video
por: Liu, Jihao, et al.
Publicado: (2024)
por: Liu, Jihao, et al.
Publicado: (2024)
ZTRS: Zero-Imitation End-to-end Autonomous Driving with Trajectory Scoring
por: Li, Zhenxin, et al.
Publicado: (2025)
por: Li, Zhenxin, et al.
Publicado: (2025)
CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving
por: Arai, Hidehisa, et al.
Publicado: (2024)
por: Arai, Hidehisa, et al.
Publicado: (2024)
DriveRX: A Vision-Language Reasoning Model for Cross-Task Autonomous Driving
por: Diao, Muxi, et al.
Publicado: (2025)
por: Diao, Muxi, et al.
Publicado: (2025)
Hydra-MDP++: Advancing End-to-End Driving via Expert-Guided Hydra-Distillation
por: Li, Kailin, et al.
Publicado: (2025)
por: Li, Kailin, et al.
Publicado: (2025)
C-CoT: Counterfactual Chain-of-Thought with Vision-Language Models for Safe Autonomous Driving
por: Tian, Kefei, et al.
Publicado: (2026)
por: Tian, Kefei, et al.
Publicado: (2026)
ICR-Drive: Instruction Counterfactual Robustness for End-to-End Language-Driven Autonomous Driving
por: Hamid, Kaiser, et al.
Publicado: (2026)
por: Hamid, Kaiser, et al.
Publicado: (2026)
Hint-AD: Holistically Aligned Interpretability in End-to-End Autonomous Driving
por: Ding, Kairui, et al.
Publicado: (2024)
por: Ding, Kairui, et al.
Publicado: (2024)
OmniHD-Scenes: A Next-Generation Multimodal Dataset for Autonomous Driving
por: Zheng, Lianqing, et al.
Publicado: (2024)
por: Zheng, Lianqing, et al.
Publicado: (2024)
Fast-ThinkAct: Efficient Vision-Language-Action Reasoning via Verbalizable Latent Planning
por: Huang, Chi-Pin, et al.
Publicado: (2026)
por: Huang, Chi-Pin, et al.
Publicado: (2026)
Scaling-Aware Data Selection for End-to-End Autonomous Driving Systems
por: Dimlioglu, Tolga, et al.
Publicado: (2026)
por: Dimlioglu, Tolga, et al.
Publicado: (2026)
ORION: A Holistic End-to-End Autonomous Driving Framework by Vision-Language Instructed Action Generation
por: Fu, Haoyu, et al.
Publicado: (2025)
por: Fu, Haoyu, et al.
Publicado: (2025)
Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation
por: Li, Zhenxin, et al.
Publicado: (2024)
por: Li, Zhenxin, et al.
Publicado: (2024)
ViR: Towards Efficient Vision Retention Backbones
por: Hatamizadeh, Ali, et al.
Publicado: (2023)
por: Hatamizadeh, Ali, et al.
Publicado: (2023)
OmniGen: Unified Multimodal Sensor Generation for Autonomous Driving
por: Tang, Tao, et al.
Publicado: (2025)
por: Tang, Tao, et al.
Publicado: (2025)
DriVLM: Domain Adaptation of Vision-Language Models in Autonomous Driving
por: Zheng, Xuran, et al.
Publicado: (2025)
por: Zheng, Xuran, et al.
Publicado: (2025)
DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models
por: Tian, Xiaoyu, et al.
Publicado: (2024)
por: Tian, Xiaoyu, et al.
Publicado: (2024)
VLP: Vision Language Planning for Autonomous Driving
por: Pan, Chenbin, et al.
Publicado: (2024)
por: Pan, Chenbin, et al.
Publicado: (2024)
CARScenes: Semantic VLM Dataset for Safe Autonomous Driving
por: He, Yuankai, et al.
Publicado: (2025)
por: He, Yuankai, et al.
Publicado: (2025)
DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving
por: Jiang, Anqing, et al.
Publicado: (2025)
por: Jiang, Anqing, et al.
Publicado: (2025)
Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving
por: Jiang, Bo, et al.
Publicado: (2024)
por: Jiang, Bo, et al.
Publicado: (2024)
LocateAnything3D: Vision-Language 3D Detection with Chain-of-Sight
por: Man, Yunze, et al.
Publicado: (2025)
por: Man, Yunze, et al.
Publicado: (2025)
Stereo-based 3D Anomaly Object Detection for Autonomous Driving: A New Dataset and Baseline
por: Mu, Shiyi, et al.
Publicado: (2025)
por: Mu, Shiyi, et al.
Publicado: (2025)
Evaluation of Safety Cognition Capability in Vision-Language Models for Autonomous Driving
por: Zhang, Enming, et al.
Publicado: (2025)
por: Zhang, Enming, et al.
Publicado: (2025)
Reasoning-VLA: A Fast and General Vision-Language-Action Reasoning Model for Autonomous Driving
por: Zhang, Dapeng, et al.
Publicado: (2025)
por: Zhang, Dapeng, et al.
Publicado: (2025)
A Survey on Vision-Language-Action Models for Autonomous Driving
por: Jiang, Sicong, et al.
Publicado: (2025)
por: Jiang, Sicong, et al.
Publicado: (2025)
Structured Labeling Enables Faster Vision-Language Models for End-to-End Autonomous Driving
por: Jiang, Hao, et al.
Publicado: (2025)
por: Jiang, Hao, et al.
Publicado: (2025)
Universal Camouflage Attack on Vision-Language Models for Autonomous Driving
por: Kong, Dehong, et al.
Publicado: (2025)
por: Kong, Dehong, et al.
Publicado: (2025)
SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving
por: Chen, Xuesong, et al.
Publicado: (2025)
por: Chen, Xuesong, et al.
Publicado: (2025)
VECTOR-Drive: Tightly Coupled Vision-Language and Trajectory Expert Routing for End-to-End Autonomous Driving
por: Zhao, Rui, et al.
Publicado: (2026)
por: Zhao, Rui, et al.
Publicado: (2026)
AgentThink: A Unified Framework for Tool-Augmented Chain-of-Thought Reasoning in Vision-Language Models for Autonomous Driving
por: Qian, Kangan, et al.
Publicado: (2025)
por: Qian, Kangan, et al.
Publicado: (2025)
Ejemplares similares
-
OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning
por: Wang, Shihao, et al.
Publicado: (2025) -
Enhancing Autonomous Driving Safety with Collision Scenario Integration
por: Wang, Zi, et al.
Publicado: (2025) -
OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving
por: Zhang, Zhenguo, et al.
Publicado: (2025) -
Is Ego Status All You Need for Open-Loop End-to-End Autonomous Driving?
por: Li, Zhiqi, et al.
Publicado: (2023) -
Exploring Camera Encoder Designs for Autonomous Driving Perception
por: Lakshmanan, Barath, et al.
Publicado: (2024)