M2DA: Multi-Modal Fusion Transformer Incorporating Driver Attention for Autonomous Driving
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Dongyang, Li, Haokun, Wang, Qingfan, Song, Ziying, Chen, Lei, Deng, Hanming |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AHMF: Adaptive Hybrid-Memory-Fusion Model for Driver Attention Prediction
par: Xu, Dongyang, et autres
Publié: (2024)
par: Xu, Dongyang, et autres
Publié: (2024)
Graph-Based Multi-Modal Sensor Fusion for Autonomous Driving
par: Sani, Depanshu, et autres
Publié: (2024)
par: Sani, Depanshu, et autres
Publié: (2024)
STDA: Spatio-Temporal Dual-Encoder Network Incorporating Driver Attention to Predict Driver Behaviors Under Safety-Critical Scenarios
par: Xu, Dongyang, et autres
Publié: (2024)
par: Xu, Dongyang, et autres
Publié: (2024)
DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving
par: jia, Feiyang, et autres
Publié: (2026)
par: jia, Feiyang, et autres
Publié: (2026)
DIVER: Reinforced Diffusion Breaks Imitation Bottlenecks in End-to-End Autonomous Driving
par: Song, Ziying, et autres
Publié: (2025)
par: Song, Ziying, et autres
Publié: (2025)
ComDrive: Comfort-Oriented End-to-End Autonomous Driving
par: Wang, Junming, et autres
Publié: (2024)
par: Wang, Junming, et autres
Publié: (2024)
GaussianFusion: Gaussian-Based Multi-Sensor Fusion for End-to-End Autonomous Driving
par: Liu, Shuai, et autres
Publié: (2025)
par: Liu, Shuai, et autres
Publié: (2025)
CLFT: Camera-LiDAR Fusion Transformer for Semantic Segmentation in Autonomous Driving
par: Gu, Junyi, et autres
Publié: (2024)
par: Gu, Junyi, et autres
Publié: (2024)
123D: Unifying Multi-Modal Autonomous Driving Data at Scale
par: Dauner, Daniel, et autres
Publié: (2026)
par: Dauner, Daniel, et autres
Publié: (2026)
Multi-Object Tracking with Camera-LiDAR Fusion for Autonomous Driving
par: Pieroni, Riccardo, et autres
Publié: (2024)
par: Pieroni, Riccardo, et autres
Publié: (2024)
UniMM-V2X: MoE-Enhanced Multi-Level Fusion for End-to-End Cooperative Autonomous Driving
par: Song, Ziyi, et autres
Publié: (2025)
par: Song, Ziyi, et autres
Publié: (2025)
DME-Driver: Integrating Human Decision Logic and 3D Scene Perception in Autonomous Driving
par: Han, Wencheng, et autres
Publié: (2024)
par: Han, Wencheng, et autres
Publié: (2024)
GMF-Drive: Gated Mamba Fusion with Spatial-Aware BEV Representation for End-to-End Autonomous Driving
par: Wang, Jian, et autres
Publié: (2025)
par: Wang, Jian, et autres
Publié: (2025)
Multi-Modal Data-Efficient 3D Scene Understanding for Autonomous Driving
par: Kong, Lingdong, et autres
Publié: (2024)
par: Kong, Lingdong, et autres
Publié: (2024)
HiP-AD: Hierarchical and Multi-Granularity Planning with Deformable Attention for Autonomous Driving in a Single Decoder
par: Tang, Yingqi, et autres
Publié: (2025)
par: Tang, Yingqi, et autres
Publié: (2025)
BEVDilation: LiDAR-Centric Multi-Modal Fusion for 3D Object Detection
par: Zhang, Guowen, et autres
Publié: (2025)
par: Zhang, Guowen, et autres
Publié: (2025)
An End-to-End Decision-Aware Multi-Scale Attention-Based Model for Explainable Autonomous Driving
par: Azad, Maryam Sadat Hosseini, et autres
Publié: (2026)
par: Azad, Maryam Sadat Hosseini, et autres
Publié: (2026)
Progressive Bird's Eye View Perception for Safety-Critical Autonomous Driving: A Comprehensive Survey
par: Gong, Yan, et autres
Publié: (2025)
par: Gong, Yan, et autres
Publié: (2025)
A Survey on Occupancy Perception for Autonomous Driving: The Information Fusion Perspective
par: Xu, Huaiyuan, et autres
Publié: (2024)
par: Xu, Huaiyuan, et autres
Publié: (2024)
DynFlowDrive: Flow-Based Dynamic World Modeling for Autonomous Driving
par: Liu, Xiaolu, et autres
Publié: (2026)
par: Liu, Xiaolu, et autres
Publié: (2026)
AutoDrive-R$^2$: Incentivizing Reasoning and Self-Reflection Capacity for VLA Model in Autonomous Driving
par: Yuan, Zhenlong, et autres
Publié: (2025)
par: Yuan, Zhenlong, et autres
Publié: (2025)
FRED: A Multi-Modal Autonomous Driving Dataset for Flooded Road Environments
par: Malone, Connor, et autres
Publié: (2026)
par: Malone, Connor, et autres
Publié: (2026)
MeanFuser: Fast One-Step Multi-Modal Trajectory Generation and Adaptive Reconstruction via MeanFlow for End-to-End Autonomous Driving
par: Wang, Junli, et autres
Publié: (2026)
par: Wang, Junli, et autres
Publié: (2026)
Advancing Autonomous Driving Perception: Analysis of Sensor Fusion and Computer Vision Techniques
par: Bharti, Urvishkumar, et autres
Publié: (2024)
par: Bharti, Urvishkumar, et autres
Publié: (2024)
InVDriver: Intra-Instance Aware Vectorized Query-Based Autonomous Driving Transformer
par: Zhang, Bo, et autres
Publié: (2025)
par: Zhang, Bo, et autres
Publié: (2025)
DiffSemanticFusion: Semantic Raster BEV Fusion for Autonomous Driving via Online HD Map Diffusion
par: Sun, Zhigang, et autres
Publié: (2025)
par: Sun, Zhigang, et autres
Publié: (2025)
Cognitive-Hierarchy Guided End-to-End Planning for Autonomous Driving
par: Wang, Zhennan, et autres
Publié: (2025)
par: Wang, Zhennan, et autres
Publié: (2025)
HawkDrive: A Transformer-driven Visual Perception System for Autonomous Driving in Night Scene
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
DriveTransformer: Unified Transformer for Scalable End-to-End Autonomous Driving
par: Jia, Xiaosong, et autres
Publié: (2025)
par: Jia, Xiaosong, et autres
Publié: (2025)
DragTraffic: Interactive and Controllable Traffic Scene Generation for Autonomous Driving
par: Wang, Sheng, et autres
Publié: (2024)
par: Wang, Sheng, et autres
Publié: (2024)
Strategic Fusion of Vision Language Models: Shapley-Credited Context-Aware Dawid-Skene for Multi-Label Tasks in Autonomous Driving
par: Feng, Yuxiang, et autres
Publié: (2025)
par: Feng, Yuxiang, et autres
Publié: (2025)
WaterScenes: A Multi-Task 4D Radar-Camera Fusion Dataset and Benchmarks for Autonomous Driving on Water Surfaces
par: Yao, Shanliang, et autres
Publié: (2023)
par: Yao, Shanliang, et autres
Publié: (2023)
PPAD: Iterative Interactions of Prediction and Planning for End-to-end Autonomous Driving
par: Chen, Zhili, et autres
Publié: (2023)
par: Chen, Zhili, et autres
Publié: (2023)
MSSF: A 4D Radar and Camera Fusion Framework With Multi-Stage Sampling for 3D Object Detection in Autonomous Driving
par: Liu, Hongsi, et autres
Publié: (2024)
par: Liu, Hongsi, et autres
Publié: (2024)
RS2AD: End-to-End Autonomous Driving Data Generation from Roadside Sensor Observations
par: Xing, Ruidan, et autres
Publié: (2025)
par: Xing, Ruidan, et autres
Publié: (2025)
SpaRC-AD: A Baseline for Radar-Camera Fusion in End-to-End Autonomous Driving
par: Wolters, Philipp, et autres
Publié: (2025)
par: Wolters, Philipp, et autres
Publié: (2025)
DriveVA: Video Action Models are Zero-Shot Drivers
par: Liu, Mengmeng, et autres
Publié: (2026)
par: Liu, Mengmeng, et autres
Publié: (2026)
Forging Spatial Intelligence: A Roadmap of Multi-Modal Data Pre-Training for Autonomous Systems
par: Wang, Song, et autres
Publié: (2025)
par: Wang, Song, et autres
Publié: (2025)
RealEngine: Simulating Autonomous Driving in Realistic Context
par: Jiang, Junzhe, et autres
Publié: (2025)
par: Jiang, Junzhe, et autres
Publié: (2025)
Self-supervised Multi-future Occupancy Forecasting for Autonomous Driving
par: Lange, Bernard, et autres
Publié: (2024)
par: Lange, Bernard, et autres
Publié: (2024)
Documents similaires
-
AHMF: Adaptive Hybrid-Memory-Fusion Model for Driver Attention Prediction
par: Xu, Dongyang, et autres
Publié: (2024) -
Graph-Based Multi-Modal Sensor Fusion for Autonomous Driving
par: Sani, Depanshu, et autres
Publié: (2024) -
STDA: Spatio-Temporal Dual-Encoder Network Incorporating Driver Attention to Predict Driver Behaviors Under Safety-Critical Scenarios
par: Xu, Dongyang, et autres
Publié: (2024) -
DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving
par: jia, Feiyang, et autres
Publié: (2026) -
DIVER: Reinforced Diffusion Breaks Imitation Bottlenecks in End-to-End Autonomous Driving
par: Song, Ziying, et autres
Publié: (2025)