Multimodal-Enhanced Objectness Learner for Corner Case Detection in Autonomous Driving
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiao, Lixing, Shi, Ruixiao, Tang, Xiaoyang, Zhou, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CornerPoint3D: Look at the Nearest Corner Instead of the Center
par: Zhang, Ruixiao, et autres
Publié: (2025)
par: Zhang, Ruixiao, et autres
Publié: (2025)
RAC3: Retrieval-Augmented Corner Case Comprehension for Autonomous Driving with Vision-Language Models
par: Wang, Yujin, et autres
Publié: (2024)
par: Wang, Yujin, et autres
Publié: (2024)
Addressing Corner Cases in Autonomous Driving: A World Model-based Approach with Mixture of Experts and LLMs
par: Liao, Haicheng, et autres
Publié: (2025)
par: Liao, Haicheng, et autres
Publié: (2025)
ECCV 2024 W-CODA: 1st Workshop on Multimodal Perception and Comprehension of Corner Cases in Autonomous Driving
par: Chen, Kai, et autres
Publié: (2025)
par: Chen, Kai, et autres
Publié: (2025)
Towards Camera Open-set 3D Object Detection for Autonomous Driving Scenarios
par: He, Zhuolin, et autres
Publié: (2024)
par: He, Zhuolin, et autres
Publié: (2024)
Data Shift of Object Detection in Autonomous Driving
par: Xu, Lida
Publié: (2025)
par: Xu, Lida
Publié: (2025)
Towards Robust Unsupervised Attention Prediction in Autonomous Driving
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Integrating Object Detection Modality into Visual Language Model for Enhanced Autonomous Driving Agent
par: He, Linfeng, et autres
Publié: (2024)
par: He, Linfeng, et autres
Publié: (2024)
Mask-RadarNet: Enhancing Transformer With Spatial-Temporal Semantic Context for Radar Object Detection in Autonomous Driving
par: Wu, Yuzhi, et autres
Publié: (2024)
par: Wu, Yuzhi, et autres
Publié: (2024)
SUSTechGAN: Image Generation for Object Detection in Adverse Conditions of Autonomous Driving
par: Lan, Gongjin, et autres
Publié: (2024)
par: Lan, Gongjin, et autres
Publié: (2024)
Uncertainty-Encoded Multi-Modal Fusion for Robust Object Detection in Autonomous Driving
par: Lou, Yang, et autres
Publié: (2023)
par: Lou, Yang, et autres
Publié: (2023)
Timely Fusion of Surround Radar/Lidar for Object Detection in Autonomous Driving Systems
par: Xie, Wenjing, et autres
Publié: (2023)
par: Xie, Wenjing, et autres
Publié: (2023)
Transient Adversarial 3D Projection Attacks on Object Detection in Autonomous Driving
par: Zhou, Ce, et autres
Publié: (2024)
par: Zhou, Ce, et autres
Publié: (2024)
BEVWorld: A Multimodal World Simulator for Autonomous Driving via Scene-Level BEV Latents
par: Zhang, Yumeng, et autres
Publié: (2024)
par: Zhang, Yumeng, et autres
Publié: (2024)
AIDE: An Automatic Data Engine for Object Detection in Autonomous Driving
par: Liang, Mingfu, et autres
Publié: (2024)
par: Liang, Mingfu, et autres
Publié: (2024)
INSIGHT: Enhancing Autonomous Driving Safety through Vision-Language Models on Context-Aware Hazard Detection and Edge Case Evaluation
par: Chen, Dianwei, et autres
Publié: (2025)
par: Chen, Dianwei, et autres
Publié: (2025)
Real-Time Incremental Explanations for Object Detectors in Autonomous Driving
par: Calderón-Peña, Santiago, et autres
Publié: (2024)
par: Calderón-Peña, Santiago, et autres
Publié: (2024)
Searching Realistic-Looking Adversarial Objects For Autonomous Driving Systems
par: Sun, Shengxiang, et autres
Publié: (2024)
par: Sun, Shengxiang, et autres
Publié: (2024)
VLM-E2E: Enhancing End-to-End Autonomous Driving with Multimodal Driver Attention Fusion
par: Liu, Pei, et autres
Publié: (2025)
par: Liu, Pei, et autres
Publié: (2025)
Think Before You Drive: World Model-Inspired Multimodal Grounding for Autonomous Vehicles
par: Liao, Haicheng, et autres
Publié: (2025)
par: Liao, Haicheng, et autres
Publié: (2025)
GPT-4 Enhanced Multimodal Grounding for Autonomous Driving: Leveraging Cross-Modal Attention with Large Language Models
par: Liao, Haicheng, et autres
Publié: (2023)
par: Liao, Haicheng, et autres
Publié: (2023)
Contextual Object Detection with Multimodal Large Language Models
par: Zang, Yuhang, et autres
Publié: (2023)
par: Zang, Yuhang, et autres
Publié: (2023)
Towards Accurate and Efficient 3D Object Detection for Autonomous Driving: A Mixture of Experts Computing System on Edge
par: Liu, Linshen, et autres
Publié: (2025)
par: Liu, Linshen, et autres
Publié: (2025)
Towards a Multi-Agent Vision-Language System for Zero-Shot Novel Hazardous Object Detection for Autonomous Driving Safety
par: Shriram, Shashank, et autres
Publié: (2025)
par: Shriram, Shashank, et autres
Publié: (2025)
Towards Efficient 3D Object Detection in Bird's-Eye-View Space for Autonomous Driving: A Convolutional-Only Approach
par: Li, Yuxin, et autres
Publié: (2023)
par: Li, Yuxin, et autres
Publié: (2023)
Adaptive Guidance Semantically Enhanced via Multimodal LLM for Edge-Cloud Object Detection
par: Hu, Yunqing, et autres
Publié: (2025)
par: Hu, Yunqing, et autres
Publié: (2025)
Drive-KD: Multi-Teacher Distillation for VLMs in Autonomous Driving
par: Lian, Weitong, et autres
Publié: (2026)
par: Lian, Weitong, et autres
Publié: (2026)
Large Language Model Guided Progressive Feature Alignment for Multimodal UAV Object Detection
par: Wu, Wentao, et autres
Publié: (2025)
par: Wu, Wentao, et autres
Publié: (2025)
HiddenObject: Modality-Agnostic Fusion for Multimodal Hidden Object Detection
par: Song, Harris, et autres
Publié: (2025)
par: Song, Harris, et autres
Publié: (2025)
PEFT-DML: Parameter-Efficient Fine-Tuning Deep Metric Learning for Robust Multi-Modal 3D Object Detection in Autonomous Driving
par: Rezaei, Abdolazim, et autres
Publié: (2025)
par: Rezaei, Abdolazim, et autres
Publié: (2025)
Exploring the Interplay Between Video Generation and World Models in Autonomous Driving: A Survey
par: Fu, Ao, et autres
Publié: (2024)
par: Fu, Ao, et autres
Publié: (2024)
Learning Vision-Language-Action World Models for Autonomous Driving
par: Wang, Guoqing, et autres
Publié: (2026)
par: Wang, Guoqing, et autres
Publié: (2026)
DS MYOLO: A Reliable Object Detector Based on SSMs for Driving Scenarios
par: Li, Yang, et autres
Publié: (2024)
par: Li, Yang, et autres
Publié: (2024)
Collaboration of Teachers for Semi-supervised Object Detection
par: Chen, Liyu, et autres
Publié: (2024)
par: Chen, Liyu, et autres
Publié: (2024)
SFC: Shared Feature Calibration in Weakly Supervised Semantic Segmentation
par: Zhao, Xinqiao, et autres
Publié: (2024)
par: Zhao, Xinqiao, et autres
Publié: (2024)
DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving
par: Li, Yingyan, et autres
Publié: (2025)
par: Li, Yingyan, et autres
Publié: (2025)
PhysDrive: A Multimodal Remote Physiological Measurement Dataset for In-vehicle Driver Monitoring
par: Wang, Jiyao, et autres
Publié: (2025)
par: Wang, Jiyao, et autres
Publié: (2025)
FAD: Frequency Adaptation and Diversion for Cross-domain Few-shot Learning
par: Shi, Ruixiao, et autres
Publié: (2025)
par: Shi, Ruixiao, et autres
Publié: (2025)
LVDrive: Latent Visual Representation Enhanced Vision-Language-Action Autonomous Driving Model
par: Mei, Xiaodong, et autres
Publié: (2026)
par: Mei, Xiaodong, et autres
Publié: (2026)
SQS: Enhancing Sparse Perception Models via Query-based Splatting in Autonomous Driving
par: Zhang, Haiming, et autres
Publié: (2025)
par: Zhang, Haiming, et autres
Publié: (2025)
Documents similaires
-
CornerPoint3D: Look at the Nearest Corner Instead of the Center
par: Zhang, Ruixiao, et autres
Publié: (2025) -
RAC3: Retrieval-Augmented Corner Case Comprehension for Autonomous Driving with Vision-Language Models
par: Wang, Yujin, et autres
Publié: (2024) -
Addressing Corner Cases in Autonomous Driving: A World Model-based Approach with Mixture of Experts and LLMs
par: Liao, Haicheng, et autres
Publié: (2025) -
ECCV 2024 W-CODA: 1st Workshop on Multimodal Perception and Comprehension of Corner Cases in Autonomous Driving
par: Chen, Kai, et autres
Publié: (2025) -
Towards Camera Open-set 3D Object Detection for Autonomous Driving Scenarios
par: He, Zhuolin, et autres
Publié: (2024)