Multimodal and Multiview Deep Fusion for Autonomous Marine Navigation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Dagdilelis, Dimitrios, Grigoriadis, Panagiotis, Galeazzi, Roberto |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
The More, the Merrier: Contrastive Fusion for Higher-Order Multimodal Alignment
von: Koutoupis, Stefanos, et al.
Veröffentlicht: (2025)
von: Koutoupis, Stefanos, et al.
Veröffentlicht: (2025)
Self-Supervised Multiview Xray Matching
von: Dabboussi, Mohamad, et al.
Veröffentlicht: (2025)
von: Dabboussi, Mohamad, et al.
Veröffentlicht: (2025)
FLEX: A Largescale Multimodal, Multiview Dataset for Learning Structured Representations for Fitness Action Quality Assessment
von: Yin, Hao, et al.
Veröffentlicht: (2025)
von: Yin, Hao, et al.
Veröffentlicht: (2025)
Application of Multimodal Fusion Deep Learning Model in Disease Recognition
von: Liu, Xiaoyi, et al.
Veröffentlicht: (2024)
von: Liu, Xiaoyi, et al.
Veröffentlicht: (2024)
MV-RAG: Retrieval Augmented Multiview Diffusion
von: Dayani, Yosef, et al.
Veröffentlicht: (2025)
von: Dayani, Yosef, et al.
Veröffentlicht: (2025)
VLM-E2E: Enhancing End-to-End Autonomous Driving with Multimodal Driver Attention Fusion
von: Liu, Pei, et al.
Veröffentlicht: (2025)
von: Liu, Pei, et al.
Veröffentlicht: (2025)
Controllable Video Object Insertion via Multiview Priors
von: Qi, Xia, et al.
Veröffentlicht: (2026)
von: Qi, Xia, et al.
Veröffentlicht: (2026)
Autonomous Embodied Agents: When Robotics Meets Deep Learning Reasoning
von: Bigazzi, Roberto
Veröffentlicht: (2025)
von: Bigazzi, Roberto
Veröffentlicht: (2025)
DINO-CVA: A Multimodal Goal-Conditioned Vision-to-Action Model for Autonomous Catheter Navigation
von: Fekri, Pedram, et al.
Veröffentlicht: (2025)
von: Fekri, Pedram, et al.
Veröffentlicht: (2025)
BioFusionNet: Deep Learning-Based Survival Risk Stratification in ER+ Breast Cancer Through Multifeature and Multimodal Data Fusion
von: Mondol, Raktim Kumar, et al.
Veröffentlicht: (2024)
von: Mondol, Raktim Kumar, et al.
Veröffentlicht: (2024)
Fossil Image Identification using Deep Learning Ensembles of Data Augmented Multiviews
von: Hou, Chengbin, et al.
Veröffentlicht: (2023)
von: Hou, Chengbin, et al.
Veröffentlicht: (2023)
MEAT: Multiview Diffusion Model for Human Generation on Megapixels with Mesh Attention
von: Wang, Yuhan, et al.
Veröffentlicht: (2025)
von: Wang, Yuhan, et al.
Veröffentlicht: (2025)
Mitigating Hallucinations on Object Attributes using Multiview Images and Negative Instructions
von: Tan, Zhijie, et al.
Veröffentlicht: (2025)
von: Tan, Zhijie, et al.
Veröffentlicht: (2025)
Solving Scene Understanding for Autonomous Navigation in Unstructured Environments
von: Renji, Naveen Mathews, et al.
Veröffentlicht: (2025)
von: Renji, Naveen Mathews, et al.
Veröffentlicht: (2025)
Multimodal Fusion SLAM with Fourier Attention
von: Zhou, Youjie, et al.
Veröffentlicht: (2025)
von: Zhou, Youjie, et al.
Veröffentlicht: (2025)
Fusion to Enhance: Fusion Visual Encoder to Enhance Multimodal Language Model
von: She, Yifei, et al.
Veröffentlicht: (2025)
von: She, Yifei, et al.
Veröffentlicht: (2025)
Dynamic Multi-Target Fusion for Efficient Audio-Visual Navigation
von: Yu, Yinfeng, et al.
Veröffentlicht: (2025)
von: Yu, Yinfeng, et al.
Veröffentlicht: (2025)
DeepIPCv2: LiDAR-powered Robust Environmental Perception and Navigational Control for Autonomous Vehicle
von: Natan, Oskar, et al.
Veröffentlicht: (2023)
von: Natan, Oskar, et al.
Veröffentlicht: (2023)
1st Place Solution of Multiview Egocentric Hand Tracking Challenge ECCV2024
von: Zou, Minqiang, et al.
Veröffentlicht: (2024)
von: Zou, Minqiang, et al.
Veröffentlicht: (2024)
MM-SurvNet: Deep Learning-Based Survival Risk Stratification in Breast Cancer Through Multimodal Data Fusion
von: Mondol, Raktim Kumar, et al.
Veröffentlicht: (2024)
von: Mondol, Raktim Kumar, et al.
Veröffentlicht: (2024)
Argus: Leveraging Multiview Images for Improved 3-D Scene Understanding With Large Language Models
von: Xu, Yifan, et al.
Veröffentlicht: (2025)
von: Xu, Yifan, et al.
Veröffentlicht: (2025)
Reasoning-Aware Multimodal Fusion for Hateful Video Detection
von: Yang, Shuonan, et al.
Veröffentlicht: (2025)
von: Yang, Shuonan, et al.
Veröffentlicht: (2025)
Understanding vs. Generation: Navigating Optimization Dilemma in Multimodal Models
von: Ye, Sen, et al.
Veröffentlicht: (2026)
von: Ye, Sen, et al.
Veröffentlicht: (2026)
DeepAgent: A Dual Stream Multi Agent Fusion for Robust Multimodal Deepfake Detection
von: Zaman, Sayeem Been, et al.
Veröffentlicht: (2025)
von: Zaman, Sayeem Been, et al.
Veröffentlicht: (2025)
Autonomous AI Surveillance: Multimodal Deep Learning for Cognitive and Behavioral Monitoring
von: Hamza, Ameer, et al.
Veröffentlicht: (2025)
von: Hamza, Ameer, et al.
Veröffentlicht: (2025)
Dragen3D: Multiview Geometry Consistent 3D Gaussian Generation with Drag-Based Control
von: Yan, Jinbo, et al.
Veröffentlicht: (2025)
von: Yan, Jinbo, et al.
Veröffentlicht: (2025)
Uncertainty-Encoded Multi-Modal Fusion for Robust Object Detection in Autonomous Driving
von: Lou, Yang, et al.
Veröffentlicht: (2023)
von: Lou, Yang, et al.
Veröffentlicht: (2023)
Timely Fusion of Surround Radar/Lidar for Object Detection in Autonomous Driving Systems
von: Xie, Wenjing, et al.
Veröffentlicht: (2023)
von: Xie, Wenjing, et al.
Veröffentlicht: (2023)
Pedestrian Crossing Intention Prediction Using Multimodal Fusion Network
von: Li, Yuanzhe, et al.
Veröffentlicht: (2025)
von: Li, Yuanzhe, et al.
Veröffentlicht: (2025)
Rethinking Normalization Strategies and Convolutional Kernels for Multimodal Image Fusion
von: He, Dan, et al.
Veröffentlicht: (2024)
von: He, Dan, et al.
Veröffentlicht: (2024)
Enhancing Perception Capabilities of Multimodal LLMs with Training-Free Fusion
von: Chen, Zhuokun, et al.
Veröffentlicht: (2024)
von: Chen, Zhuokun, et al.
Veröffentlicht: (2024)
Text-Guided Layer Fusion Mitigates Hallucination in Multimodal LLMs
von: Lin, Chenchen, et al.
Veröffentlicht: (2026)
von: Lin, Chenchen, et al.
Veröffentlicht: (2026)
Residual Cross-Modal Fusion Networks for Audio-Visual Navigation
von: Wang, Yi, et al.
Veröffentlicht: (2026)
von: Wang, Yi, et al.
Veröffentlicht: (2026)
Think Hierarchically, Act Dynamically: Hierarchical Multi-modal Fusion and Reasoning for Vision-and-Language Navigation
von: Yue, Junrong, et al.
Veröffentlicht: (2025)
von: Yue, Junrong, et al.
Veröffentlicht: (2025)
Agentic Pipeline for Self-Synchronized Multiview Joint Angle Monitoring in Uncalibrated Environments
von: Yu, Juncheng, et al.
Veröffentlicht: (2026)
von: Yu, Juncheng, et al.
Veröffentlicht: (2026)
Adaptive Diffusion Terrain Generator for Autonomous Uneven Terrain Navigation
von: Yu, Youwei, et al.
Veröffentlicht: (2024)
von: Yu, Youwei, et al.
Veröffentlicht: (2024)
Advances in Diffusion Models for Image Data Augmentation: A Review of Methods, Models, Evaluation Metrics and Future Research Directions
von: Alimisis, Panagiotis, et al.
Veröffentlicht: (2024)
von: Alimisis, Panagiotis, et al.
Veröffentlicht: (2024)
HiddenObject: Modality-Agnostic Fusion for Multimodal Hidden Object Detection
von: Song, Harris, et al.
Veröffentlicht: (2025)
von: Song, Harris, et al.
Veröffentlicht: (2025)
Timing Is Everything: Finding the Optimal Fusion Points in Multimodal Medical Imaging
von: Guarrasi, Valerio, et al.
Veröffentlicht: (2025)
von: Guarrasi, Valerio, et al.
Veröffentlicht: (2025)
Sparse Shortcuts: Facilitating Efficient Fusion in Multimodal Large Language Models
von: Zhang, Jingrui, et al.
Veröffentlicht: (2026)
von: Zhang, Jingrui, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
The More, the Merrier: Contrastive Fusion for Higher-Order Multimodal Alignment
von: Koutoupis, Stefanos, et al.
Veröffentlicht: (2025) -
Self-Supervised Multiview Xray Matching
von: Dabboussi, Mohamad, et al.
Veröffentlicht: (2025) -
FLEX: A Largescale Multimodal, Multiview Dataset for Learning Structured Representations for Fitness Action Quality Assessment
von: Yin, Hao, et al.
Veröffentlicht: (2025) -
Application of Multimodal Fusion Deep Learning Model in Disease Recognition
von: Liu, Xiaoyi, et al.
Veröffentlicht: (2024) -
MV-RAG: Retrieval Augmented Multiview Diffusion
von: Dayani, Yosef, et al.
Veröffentlicht: (2025)