Integrating Multi-Modal Sensors: A Review of Fusion Techniques for Intelligent Vehicles
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wei, Chuheng, Qin, Ziye, Zhang, Ziyan, Wu, Guoyuan, Barth, Matthew J. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HeCoFuse: Cross-Modal Complementary V2X Cooperative Perception with Heterogeneous Sensors
par: Wei, Chuheng, et autres
Publié: (2025)
par: Wei, Chuheng, et autres
Publié: (2025)
2D or 3D: Who Governs Salience in VLA Models? -- Tri-Stage Token Pruning Framework with Modality Salience Awareness
par: Zheng, Zihao, et autres
Publié: (2026)
par: Zheng, Zihao, et autres
Publié: (2026)
Elevating Skeleton-Based Action Recognition with Efficient Multi-Modality Self-Supervision
par: Wei, Yiping, et autres
Publié: (2023)
par: Wei, Yiping, et autres
Publié: (2023)
Feature Corrective Transfer Learning: End-to-End Solutions to Object Detection in Non-Ideal Visual Conditions
par: Wei, Chuheng, et autres
Publié: (2024)
par: Wei, Chuheng, et autres
Publié: (2024)
Interactive Spatial-Frequency Fusion Mamba for Multi-Modal Image Fusion
par: Zhu, Yixin, et autres
Publié: (2026)
par: Zhu, Yixin, et autres
Publié: (2026)
Embodied Web Agents: Bridging Physical-Digital Realms for Integrated Agent Intelligence
par: Hong, Yining, et autres
Publié: (2025)
par: Hong, Yining, et autres
Publié: (2025)
EVA: An Embodied World Model for Future Video Anticipation
par: Chi, Xiaowei, et autres
Publié: (2024)
par: Chi, Xiaowei, et autres
Publié: (2024)
UniScene: Multi-Camera Unified Pre-training via 3D Scene Reconstruction for Autonomous Driving
par: Min, Chen, et autres
Publié: (2023)
par: Min, Chen, et autres
Publié: (2023)
Anchoring Emotions in Text: Robust Multimodal Fusion for Mimicry Intensity Estimation
par: Zhu, Lingsi, et autres
Publié: (2026)
par: Zhu, Lingsi, et autres
Publié: (2026)
WoW: Towards a World omniscient World model Through Embodied Interaction
par: Chi, Xiaowei, et autres
Publié: (2025)
par: Chi, Xiaowei, et autres
Publié: (2025)
Turing Patterns for Multimedia: Reaction-Diffusion Multi-Modal Fusion for Language-Guided Video Moment Retrieval
par: Fang, Xiang, et autres
Publié: (2026)
par: Fang, Xiang, et autres
Publié: (2026)
Multi-Modal Image Fusion via Intervention-Stable Feature Learning
par: Wang, Xue, et autres
Publié: (2026)
par: Wang, Xue, et autres
Publié: (2026)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
par: Zhang, Zhenxing, et autres
Publié: (2024)
par: Zhang, Zhenxing, et autres
Publié: (2024)
PhysNav-DG: A Novel Adaptive Framework for Robust VLM-Sensor Fusion in Navigation Applications
par: Srinivasan, Trisanth, et autres
Publié: (2025)
par: Srinivasan, Trisanth, et autres
Publié: (2025)
XEmbodied: A Foundation Model with Enhanced Geometric and Physical Cues for Large-Scale Embodied Environments
par: Qian, Kangan, et autres
Publié: (2026)
par: Qian, Kangan, et autres
Publié: (2026)
WaterVG: Waterway Visual Grounding based on Text-Guided Vision and mmWave Radar
par: Guan, Runwei, et autres
Publié: (2024)
par: Guan, Runwei, et autres
Publié: (2024)
RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving
par: Huang, Zhijian, et autres
Publié: (2024)
par: Huang, Zhijian, et autres
Publié: (2024)
HR-INR: Continuous Space-Time Video Super-Resolution via Event Camera
par: Lu, Yunfan, et autres
Publié: (2024)
par: Lu, Yunfan, et autres
Publié: (2024)
PanoGen++: Domain-Adapted Text-Guided Panoramic Environment Generation for Vision-and-Language Navigation
par: Wang, Sen, et autres
Publié: (2025)
par: Wang, Sen, et autres
Publié: (2025)
Customizable Perturbation Synthesis for Robust SLAM Benchmarking
par: Xu, Xiaohao, et autres
Publié: (2024)
par: Xu, Xiaohao, et autres
Publié: (2024)
CFMW: Cross-modality Fusion Mamba for Robust Object Detection under Adverse Weather
par: Li, Haoyuan, et autres
Publié: (2024)
par: Li, Haoyuan, et autres
Publié: (2024)
Quantifying and Enhancing Multi-modal Robustness with Modality Preference
par: Yang, Zequn, et autres
Publié: (2024)
par: Yang, Zequn, et autres
Publié: (2024)
Scaling Spatial Intelligence with Multimodal Foundation Models
par: Cai, Zhongang, et autres
Publié: (2025)
par: Cai, Zhongang, et autres
Publié: (2025)
Parameter-Efficient Subspace Decoupling ViT for Mitigating Multi-Task Negative Transfer in Histological Scoring
par: Huang, Youhan, et autres
Publié: (2026)
par: Huang, Youhan, et autres
Publié: (2026)
HeGraphAdapter: Tuning Multi-Modal Vision-Language Models with Heterogeneous Graph Adapter
par: Zhao, Yumiao, et autres
Publié: (2024)
par: Zhao, Yumiao, et autres
Publié: (2024)
Holistic Evaluation of Multimodal LLMs on Spatial Intelligence
par: Cai, Zhongang, et autres
Publié: (2025)
par: Cai, Zhongang, et autres
Publié: (2025)
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
par: Zheng, Junjie, et autres
Publié: (2025)
par: Zheng, Junjie, et autres
Publié: (2025)
PDB: Not All Drivers Are the Same -- A Personalized Dataset for Understanding Driving Behavior
par: Wei, Chuheng, et autres
Publié: (2025)
par: Wei, Chuheng, et autres
Publié: (2025)
Anisotropic Modality Align
par: Yu, Xiaomin, et autres
Publié: (2026)
par: Yu, Xiaomin, et autres
Publié: (2026)
SFFNet: Synergistic Feature Fusion Network With Dual-Domain Edge Enhancement for UAV Image Object Detection
par: Zhang, Wenfeng, et autres
Publié: (2026)
par: Zhang, Wenfeng, et autres
Publié: (2026)
Learning Contrastive Self-Distillation for Ultra-Fine-Grained Visual Categorization Targeting Limited Samples
par: Fang, Ziye, et autres
Publié: (2023)
par: Fang, Ziye, et autres
Publié: (2023)
RefAtomNet++: Advancing Referring Atomic Video Action Recognition using Semantic Retrieval based Multi-Trajectory Mamba
par: Peng, Kunyu, et autres
Publié: (2025)
par: Peng, Kunyu, et autres
Publié: (2025)
Tile Classification Based Viewport Prediction with Multi-modal Fusion Transformer
par: Zhang, Zhihao, et autres
Publié: (2023)
par: Zhang, Zhihao, et autres
Publié: (2023)
MAGE: Multimodal Alignment and Generation Enhancement via Bridging Visual and Semantic Spaces
par: E, Shaojun, et autres
Publié: (2025)
par: E, Shaojun, et autres
Publié: (2025)
Robust Modality-incomplete Anomaly Detection: A Modality-instructive Framework with Benchmark
par: Miao, Bingchen, et autres
Publié: (2024)
par: Miao, Bingchen, et autres
Publié: (2024)
GTPBD-MM: A Global Terraced Parcel and Boundary Dataset with Multi-Modality
par: Zhang, Zhiwei, et autres
Publié: (2026)
par: Zhang, Zhiwei, et autres
Publié: (2026)
Signal: Selective Interaction and Global-local Alignment for Multi-Modal Object Re-Identification
par: Liu, Yangyang, et autres
Publié: (2025)
par: Liu, Yangyang, et autres
Publié: (2025)
Towards Robust and Realible Multimodal Misinformation Recognition with Incomplete Modality
par: Zhou, Hengyang, et autres
Publié: (2025)
par: Zhou, Hengyang, et autres
Publié: (2025)
Gradient-Guided Modality Decoupling for Missing-Modality Robustness
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
Find the Cliffhanger: Multi-Modal Trailerness in Soap Operas
par: Bretti, Carlo, et autres
Publié: (2024)
par: Bretti, Carlo, et autres
Publié: (2024)
Documents similaires
-
HeCoFuse: Cross-Modal Complementary V2X Cooperative Perception with Heterogeneous Sensors
par: Wei, Chuheng, et autres
Publié: (2025) -
2D or 3D: Who Governs Salience in VLA Models? -- Tri-Stage Token Pruning Framework with Modality Salience Awareness
par: Zheng, Zihao, et autres
Publié: (2026) -
Elevating Skeleton-Based Action Recognition with Efficient Multi-Modality Self-Supervision
par: Wei, Yiping, et autres
Publié: (2023) -
Feature Corrective Transfer Learning: End-to-End Solutions to Object Detection in Non-Ideal Visual Conditions
par: Wei, Chuheng, et autres
Publié: (2024) -
Interactive Spatial-Frequency Fusion Mamba for Multi-Modal Image Fusion
par: Zhu, Yixin, et autres
Publié: (2026)