Collision-Aware Vision-Language Learning for End-to-End Driving with Multimodal Infraction Datasets
Fuente:
arXiv
Guardado en:
| Autores principales: | Koran, Alex, Sinodinos, Dimitrios, Hojjati, Hadi, Nanri, Takuya, Chen, Fangge, Armanfard, Narges |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Cross-Task Affinity Learning for Multitask Dense Scene Predictions
por: Sinodinos, Dimitrios, et al.
Publicado: (2024)
por: Sinodinos, Dimitrios, et al.
Publicado: (2024)
Unveiling the Flaws: A Critical Analysis of Initialization Effect on Time Series Anomaly Detection
por: Koran, Alex, et al.
Publicado: (2024)
por: Koran, Alex, et al.
Publicado: (2024)
SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving
por: Chen, Xuesong, et al.
Publicado: (2025)
por: Chen, Xuesong, et al.
Publicado: (2025)
WiseAD: Knowledge Augmented End-to-End Autonomous Driving with Vision-Language Model
por: Zhang, Songyan, et al.
Publicado: (2024)
por: Zhang, Songyan, et al.
Publicado: (2024)
DASVDD: Deep Autoencoding Support Vector Data Descriptor for Anomaly Detection
por: Hojjati, Hadi, et al.
Publicado: (2021)
por: Hojjati, Hadi, et al.
Publicado: (2021)
ARTA: Adversarial-Robust Multivariate Time--Series Anomaly Detection via Sparsity-Constrained Perturbations
por: Hojjati, Hadi, et al.
Publicado: (2026)
por: Hojjati, Hadi, et al.
Publicado: (2026)
LMAD: Integrated End-to-End Vision-Language Model for Explainable Autonomous Driving
por: Song, Nan, et al.
Publicado: (2025)
por: Song, Nan, et al.
Publicado: (2025)
Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving
por: Jiang, Bo, et al.
Publicado: (2024)
por: Jiang, Bo, et al.
Publicado: (2024)
Collision Risk Estimation via Loss Prediction in End-to-End Autonomous Driving
por: Xiong, Ziliang, et al.
Publicado: (2025)
por: Xiong, Ziliang, et al.
Publicado: (2025)
Drive-JEPA: Video JEPA Meets Multimodal Trajectory Distillation for End-to-End Driving
por: Wang, Linhan, et al.
Publicado: (2026)
por: Wang, Linhan, et al.
Publicado: (2026)
Multimodal Action Diffusion for Robust End-to-End Autonomous Driving
por: Rodríguez-Vidal, Jorge Daniel, et al.
Publicado: (2026)
por: Rodríguez-Vidal, Jorge Daniel, et al.
Publicado: (2026)
VisionLLM v2: An End-to-End Generalist Multimodal Large Language Model for Hundreds of Vision-Language Tasks
por: Wu, Jiannan, et al.
Publicado: (2024)
por: Wu, Jiannan, et al.
Publicado: (2024)
E3AD: An Emotion-Aware Vision-Language-Action Model for Human-Centric End-to-End Autonomous Driving
por: Tang, Yihong, et al.
Publicado: (2025)
por: Tang, Yihong, et al.
Publicado: (2025)
Efficient and Explainable End-to-End Autonomous Driving via Masked Vision-Language-Action Diffusion
por: Zhang, Jiaru, et al.
Publicado: (2026)
por: Zhang, Jiaru, et al.
Publicado: (2026)
MindDrive: An All-in-One Framework Bridging World Models and Vision-Language Model for End-to-End Autonomous Driving
por: Sun, Bin, et al.
Publicado: (2025)
por: Sun, Bin, et al.
Publicado: (2025)
Zero-Shot Anomaly Detection with Dual-Branch Prompt Selection
por: Wang, Zihan, et al.
Publicado: (2025)
por: Wang, Zihan, et al.
Publicado: (2025)
VLA-R: Vision-Language Action Retrieval toward Open-World End-to-End Autonomous Driving
por: Seong, Hyunki, et al.
Publicado: (2025)
por: Seong, Hyunki, et al.
Publicado: (2025)
ORION: A Holistic End-to-End Autonomous Driving Framework by Vision-Language Instructed Action Generation
por: Fu, Haoyu, et al.
Publicado: (2025)
por: Fu, Haoyu, et al.
Publicado: (2025)
ViLaD: A Large Vision Language Diffusion Framework for End-to-End Autonomous Driving
por: Cui, Can, et al.
Publicado: (2025)
por: Cui, Can, et al.
Publicado: (2025)
Forward-Backward Knowledge Distillation for Continual Clustering
por: Sadeghi, Mohammadreza, et al.
Publicado: (2024)
por: Sadeghi, Mohammadreza, et al.
Publicado: (2024)
NudgeVAD: Language-Nudged End-to-End Driving via FiLM Residuals
por: Yang, Chieh-Chi, et al.
Publicado: (2026)
por: Yang, Chieh-Chi, et al.
Publicado: (2026)
Structured Labeling Enables Faster Vision-Language Models for End-to-End Autonomous Driving
por: Jiang, Hao, et al.
Publicado: (2025)
por: Jiang, Hao, et al.
Publicado: (2025)
VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision
por: Xu, Yi, et al.
Publicado: (2024)
por: Xu, Yi, et al.
Publicado: (2024)
AutoMoT: A Unified Vision-Language-Action Model with Asynchronous Mixture-of-Transformers for End-to-End Autonomous Driving
por: Huang, Wenhui, et al.
Publicado: (2026)
por: Huang, Wenhui, et al.
Publicado: (2026)
InsightDrive: Insight Scene Representation for End-to-End Autonomous Driving
por: Song, Ruiqi, et al.
Publicado: (2025)
por: Song, Ruiqi, et al.
Publicado: (2025)
DriveDPO: Policy Learning via Safety DPO For End-to-End Autonomous Driving
por: Shang, Shuyao, et al.
Publicado: (2025)
por: Shang, Shuyao, et al.
Publicado: (2025)
MultiTab: A Scalable Foundation for Multitask Learning on Tabular Data
por: Sinodinos, Dimitrios, et al.
Publicado: (2025)
por: Sinodinos, Dimitrios, et al.
Publicado: (2025)
Hidden Biases of End-to-End Driving Datasets
por: Zimmerlin, Julian, et al.
Publicado: (2024)
por: Zimmerlin, Julian, et al.
Publicado: (2024)
VECTOR-Drive: Tightly Coupled Vision-Language and Trajectory Expert Routing for End-to-End Autonomous Driving
por: Zhao, Rui, et al.
Publicado: (2026)
por: Zhao, Rui, et al.
Publicado: (2026)
DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving
por: Yang, Zhenjie, et al.
Publicado: (2025)
por: Yang, Zhenjie, et al.
Publicado: (2025)
GenAD: Generative End-to-End Autonomous Driving
por: Zheng, Wenzhao, et al.
Publicado: (2024)
por: Zheng, Wenzhao, et al.
Publicado: (2024)
FROST-Drive: Scalable and Efficient End-to-End Driving with a Frozen Vision Encoder
por: Dong, Zeyu, et al.
Publicado: (2026)
por: Dong, Zeyu, et al.
Publicado: (2026)
Future-Aware End-to-End Driving: Bidirectional Modeling of Trajectory Planning and Scene Evolution
por: Zhang, Bozhou, et al.
Publicado: (2025)
por: Zhang, Bozhou, et al.
Publicado: (2025)
Poutine: Vision-Language-Trajectory Pre-Training and Reinforcement Learning Post-Training Enable Robust End-to-End Autonomous Driving
por: Rowe, Luke, et al.
Publicado: (2025)
por: Rowe, Luke, et al.
Publicado: (2025)
OCRVerse: Towards Holistic OCR in End-to-End Vision-Language Models
por: Zhong, Yufeng, et al.
Publicado: (2026)
por: Zhong, Yufeng, et al.
Publicado: (2026)
Divide and Merge: Motion and Semantic Learning in End-to-End Autonomous Driving
por: Shen, Yinzhe, et al.
Publicado: (2025)
por: Shen, Yinzhe, et al.
Publicado: (2025)
Active Learning from Scene Embeddings for End-to-End Autonomous Driving
por: Jiang, Wenhao, et al.
Publicado: (2025)
por: Jiang, Wenhao, et al.
Publicado: (2025)
GMF-Drive: Gated Mamba Fusion with Spatial-Aware BEV Representation for End-to-End Autonomous Driving
por: Wang, Jian, et al.
Publicado: (2025)
por: Wang, Jian, et al.
Publicado: (2025)
Towards End-to-End Explainable Facial Action Unit Recognition via Vision-Language Joint Learning
por: Ge, Xuri, et al.
Publicado: (2024)
por: Ge, Xuri, et al.
Publicado: (2024)
Beyond Imitation: Constraint-Aware Trajectory Generation with Flow Matching For End-to-End Autonomous Driving
por: Liu, Lin, et al.
Publicado: (2025)
por: Liu, Lin, et al.
Publicado: (2025)
Ejemplares similares
-
Cross-Task Affinity Learning for Multitask Dense Scene Predictions
por: Sinodinos, Dimitrios, et al.
Publicado: (2024) -
Unveiling the Flaws: A Critical Analysis of Initialization Effect on Time Series Anomaly Detection
por: Koran, Alex, et al.
Publicado: (2024) -
SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving
por: Chen, Xuesong, et al.
Publicado: (2025) -
WiseAD: Knowledge Augmented End-to-End Autonomous Driving with Vision-Language Model
por: Zhang, Songyan, et al.
Publicado: (2024) -
DASVDD: Deep Autoencoding Support Vector Data Descriptor for Anomaly Detection
por: Hojjati, Hadi, et al.
Publicado: (2021)