INSIGHT: Enhancing Autonomous Driving Safety through Vision-Language Models on Context-Aware Hazard Detection and Edge Case Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Dianwei, Zhang, Zifan, Cheng, Lei, Liu, Yuchen, Yang, Xianfeng Terry |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Advanced Longitudinal Control and Collision Avoidance for High-Risk Edge Cases in Autonomous Driving
por: Chen, Dianwei, et al.
Publicado: (2025)
por: Chen, Dianwei, et al.
Publicado: (2025)
Towards a Multi-Agent Vision-Language System for Zero-Shot Novel Hazardous Object Detection for Autonomous Driving Safety
por: Shriram, Shashank, et al.
Publicado: (2025)
por: Shriram, Shashank, et al.
Publicado: (2025)
DriveCritic: Towards Context-Aware, Human-Aligned Evaluation for Autonomous Driving with Vision-Language Models
por: Song, Jingyu, et al.
Publicado: (2025)
por: Song, Jingyu, et al.
Publicado: (2025)
Evaluation of Safety Cognition Capability in Vision-Language Models for Autonomous Driving
por: Zhang, Enming, et al.
Publicado: (2025)
por: Zhang, Enming, et al.
Publicado: (2025)
INSIGHT: An Interpretable Neural Vision-Language Framework for Reasoning of Generative Artifacts
por: Bagaria, Anshul
Publicado: (2025)
por: Bagaria, Anshul
Publicado: (2025)
HazardNet: A Small-Scale Vision Language Model for Real-Time Traffic Safety Detection at Edge Devices
por: Tami, Mohammad Abu, et al.
Publicado: (2025)
por: Tami, Mohammad Abu, et al.
Publicado: (2025)
Enhanced Drift-Aware Computer Vision Architecture for Autonomous Driving
por: Hossain, Md Shahi Amran, et al.
Publicado: (2025)
por: Hossain, Md Shahi Amran, et al.
Publicado: (2025)
Using Vision Language Models for Safety Hazard Identification in Construction
por: Adil, Muhammad, et al.
Publicado: (2025)
por: Adil, Muhammad, et al.
Publicado: (2025)
Zero-shot Hazard Identification in Autonomous Driving: A Case Study on the COOOL Benchmark
por: Picek, Lukas, et al.
Publicado: (2024)
por: Picek, Lukas, et al.
Publicado: (2024)
VLM-AutoDrive: Post-Training Vision-Language Models for Safety-Critical Autonomous Driving Events
por: Bhat, Mohammad Qazim, et al.
Publicado: (2026)
por: Bhat, Mohammad Qazim, et al.
Publicado: (2026)
Toward Autonomous Laboratory Safety Monitoring with Vision Language Models: Learning to See Hazards Through Scene Structure
por: Chakraborty, Trishna, et al.
Publicado: (2026)
por: Chakraborty, Trishna, et al.
Publicado: (2026)
DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models
por: Tian, Xiaoyu, et al.
Publicado: (2024)
por: Tian, Xiaoyu, et al.
Publicado: (2024)
Judge, Then Drive: A Critic-Centric Vision Language Action Framework for Autonomous Driving
por: Yang, Lijin, et al.
Publicado: (2026)
por: Yang, Lijin, et al.
Publicado: (2026)
Enhancing Vision-Language Models for Autonomous Driving through Task-Specific Prompting and Spatial Reasoning
por: Wu, Aodi, et al.
Publicado: (2025)
por: Wu, Aodi, et al.
Publicado: (2025)
ContextVLM: Zero-Shot and Few-Shot Context Understanding for Autonomous Driving using Vision Language Models
por: Sural, Shounak, et al.
Publicado: (2024)
por: Sural, Shounak, et al.
Publicado: (2024)
Strategic Fusion of Vision Language Models: Shapley-Credited Context-Aware Dawid-Skene for Multi-Label Tasks in Autonomous Driving
por: Feng, Yuxiang, et al.
Publicado: (2025)
por: Feng, Yuxiang, et al.
Publicado: (2025)
VLP: Vision Language Planning for Autonomous Driving
por: Pan, Chenbin, et al.
Publicado: (2024)
por: Pan, Chenbin, et al.
Publicado: (2024)
Robustness-Aware 3D Object Detection in Autonomous Driving: A Review and Outlook
por: Song, Ziying, et al.
Publicado: (2024)
por: Song, Ziying, et al.
Publicado: (2024)
Enhancing Autonomous Driving Safety with Collision Scenario Integration
por: Wang, Zi, et al.
Publicado: (2025)
por: Wang, Zi, et al.
Publicado: (2025)
DriveFuture: Future-Aware Latent World Models for Autonomous Driving
por: Hong, Yufeng, et al.
Publicado: (2026)
por: Hong, Yufeng, et al.
Publicado: (2026)
Open 3D World in Autonomous Driving
por: Cheng, Xinlong, et al.
Publicado: (2024)
por: Cheng, Xinlong, et al.
Publicado: (2024)
Fine-Grained Evaluation of Large Vision-Language Models in Autonomous Driving
por: Li, Yue, et al.
Publicado: (2025)
por: Li, Yue, et al.
Publicado: (2025)
FLARE: Learning Future-Aware Latent Representations from Vision-Language Models for Autonomous Driving
por: Xie, Chengen, et al.
Publicado: (2026)
por: Xie, Chengen, et al.
Publicado: (2026)
DriveRX: A Vision-Language Reasoning Model for Cross-Task Autonomous Driving
por: Diao, Muxi, et al.
Publicado: (2025)
por: Diao, Muxi, et al.
Publicado: (2025)
Progressive Bird's Eye View Perception for Safety-Critical Autonomous Driving: A Comprehensive Survey
por: Gong, Yan, et al.
Publicado: (2025)
por: Gong, Yan, et al.
Publicado: (2025)
Multimodal-Enhanced Objectness Learner for Corner Case Detection in Autonomous Driving
por: Xiao, Lixing, et al.
Publicado: (2024)
por: Xiao, Lixing, et al.
Publicado: (2024)
AutoDrive-QA: A Multiple-Choice Benchmark for Vision-Language Evaluation in Urban Autonomous Driving
por: Khalili, Boshra, et al.
Publicado: (2025)
por: Khalili, Boshra, et al.
Publicado: (2025)
Spatial-aware Vision Language Model for Autonomous Driving
por: Wei, Weijie, et al.
Publicado: (2025)
por: Wei, Weijie, et al.
Publicado: (2025)
Large Vision-Language Models as Emotion Recognizers in Context Awareness
por: Lei, Yuxuan, et al.
Publicado: (2024)
por: Lei, Yuxuan, et al.
Publicado: (2024)
Pre-Trained Vision Models as Perception Backbones for Safety Filters in Autonomous Driving
por: Yang, Yuxuan, et al.
Publicado: (2024)
por: Yang, Yuxuan, et al.
Publicado: (2024)
Language Prompt for Autonomous Driving
por: Wu, Dongming, et al.
Publicado: (2023)
por: Wu, Dongming, et al.
Publicado: (2023)
DynRsl-VLM: Enhancing Autonomous Driving Perception with Dynamic Resolution Vision-Language Models
por: Zhou, Xirui, et al.
Publicado: (2025)
por: Zhou, Xirui, et al.
Publicado: (2025)
OpenDriveVLA: Towards End-to-end Autonomous Driving with Large Vision Language Action Model
por: Zhou, Xingcheng, et al.
Publicado: (2025)
por: Zhou, Xingcheng, et al.
Publicado: (2025)
Visual Adversarial Attack on Vision-Language Models for Autonomous Driving
por: Zhang, Tianyuan, et al.
Publicado: (2024)
por: Zhang, Tianyuan, et al.
Publicado: (2024)
VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision
por: Xu, Yi, et al.
Publicado: (2024)
por: Xu, Yi, et al.
Publicado: (2024)
VLDrive: Vision-Augmented Lightweight MLLMs for Efficient Language-grounded Autonomous Driving
por: Zhang, Ruifei, et al.
Publicado: (2025)
por: Zhang, Ruifei, et al.
Publicado: (2025)
COTTA: Context-Aware Transfer Adaptation for Trajectory Prediction in Autonomous Driving
por: Park, Seohyoung, et al.
Publicado: (2026)
por: Park, Seohyoung, et al.
Publicado: (2026)
INSIGHT: Indoor Scene Intelligence from Geometric-Semantic Hierarchy Transfer for Public~Safety
por: Dimopoulos, Alexander Nikitas, et al.
Publicado: (2026)
por: Dimopoulos, Alexander Nikitas, et al.
Publicado: (2026)
OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning
por: Wang, Shihao, et al.
Publicado: (2025)
por: Wang, Shihao, et al.
Publicado: (2025)
OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning
por: Wang, Shihao, et al.
Publicado: (2024)
por: Wang, Shihao, et al.
Publicado: (2024)
Ejemplares similares
-
Advanced Longitudinal Control and Collision Avoidance for High-Risk Edge Cases in Autonomous Driving
por: Chen, Dianwei, et al.
Publicado: (2025) -
Towards a Multi-Agent Vision-Language System for Zero-Shot Novel Hazardous Object Detection for Autonomous Driving Safety
por: Shriram, Shashank, et al.
Publicado: (2025) -
DriveCritic: Towards Context-Aware, Human-Aligned Evaluation for Autonomous Driving with Vision-Language Models
por: Song, Jingyu, et al.
Publicado: (2025) -
Evaluation of Safety Cognition Capability in Vision-Language Models for Autonomous Driving
por: Zhang, Enming, et al.
Publicado: (2025) -
INSIGHT: An Interpretable Neural Vision-Language Framework for Reasoning of Generative Artifacts
por: Bagaria, Anshul
Publicado: (2025)