Deep Learning-Based Multi-Modal Fusion for Robust Robot Perception and Navigation
Fuente:
arXiv
Salvato in:
| Autori principali: | Lai, Delun, Zhang, Yeyubei, Liu, Yunchong, Li, Chaojie, Mo, Huadong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Distributed NeRF Learning for Collaborative Multi-Robot Perception
di: Zhao, Hongrui, et al.
Pubblicazione: (2024)
di: Zhao, Hongrui, et al.
Pubblicazione: (2024)
DGFusion: Depth-Guided Sensor Fusion for Robust Semantic Perception
di: Broedermannn, Tim, et al.
Pubblicazione: (2025)
di: Broedermannn, Tim, et al.
Pubblicazione: (2025)
Vision-Based Deep Reinforcement Learning of UAV Autonomous Navigation Using Privileged Information
di: Wang, Junqiao, et al.
Pubblicazione: (2024)
di: Wang, Junqiao, et al.
Pubblicazione: (2024)
Adver-City: Open-Source Multi-Modal Dataset for Collaborative Perception Under Adverse Weather Conditions
di: Karvat, Mateus, et al.
Pubblicazione: (2024)
di: Karvat, Mateus, et al.
Pubblicazione: (2024)
Tactile Modality Fusion for Vision-Language-Action Models
di: Morissette, Charlotte, et al.
Pubblicazione: (2026)
di: Morissette, Charlotte, et al.
Pubblicazione: (2026)
Learning to Navigate Socially Through Proactive Risk Perception
di: Xiao, Erjia, et al.
Pubblicazione: (2025)
di: Xiao, Erjia, et al.
Pubblicazione: (2025)
From Detection to Action Recognition: An Edge-Based Pipeline for Robot Human Perception
di: Toupas, Petros, et al.
Pubblicazione: (2023)
di: Toupas, Petros, et al.
Pubblicazione: (2023)
Cocoon: Robust Multi-Modal Perception with Uncertainty-Aware Sensor Fusion
di: Cho, Minkyoung, et al.
Pubblicazione: (2024)
di: Cho, Minkyoung, et al.
Pubblicazione: (2024)
Is Intermediate Fusion All You Need for UAV-based Collaborative Perception?
di: Hao, Jiuwu, et al.
Pubblicazione: (2025)
di: Hao, Jiuwu, et al.
Pubblicazione: (2025)
M2H: Multi-Task Learning with Efficient Window-Based Cross-Task Attention for Monocular Spatial Perception
di: Udugama, U. V. B. L, et al.
Pubblicazione: (2025)
di: Udugama, U. V. B. L, et al.
Pubblicazione: (2025)
LiDAR-BIND-T: Improved and Temporally Consistent Sensor Modality Translation and Fusion for Robotic Applications
di: Balemans, Niels, et al.
Pubblicazione: (2025)
di: Balemans, Niels, et al.
Pubblicazione: (2025)
Multi-Modal Data-Efficient 3D Scene Understanding for Autonomous Driving
di: Kong, Lingdong, et al.
Pubblicazione: (2024)
di: Kong, Lingdong, et al.
Pubblicazione: (2024)
Object Navigation with Structure-Semantic Reasoning-Based Multi-level Map and Multimodal Decision-Making LLM
di: Yan, Chongshang, et al.
Pubblicazione: (2025)
di: Yan, Chongshang, et al.
Pubblicazione: (2025)
CANVAS: Commonsense-Aware Navigation System for Intuitive Human-Robot Interaction
di: Choi, Suhwan, et al.
Pubblicazione: (2024)
di: Choi, Suhwan, et al.
Pubblicazione: (2024)
A Survey on Deep Multi-Task Learning in Connected Autonomous Vehicles
di: Wang, Jiayuan, et al.
Pubblicazione: (2025)
di: Wang, Jiayuan, et al.
Pubblicazione: (2025)
Learned Visual Navigation for Under-Canopy Agricultural Robots
di: Sivakumar, Arun Narenthiran, et al.
Pubblicazione: (2021)
di: Sivakumar, Arun Narenthiran, et al.
Pubblicazione: (2021)
SemIRNet: A Semantic Irony Recognition Network for Multimodal Sarcasm Detection
di: Zhou, Jingxuan, et al.
Pubblicazione: (2025)
di: Zhou, Jingxuan, et al.
Pubblicazione: (2025)
Robustness Evaluation of Machine Learning Models for Robot Arm Action Recognition in Noisy Environments
di: Motamedi, Elaheh, et al.
Pubblicazione: (2024)
di: Motamedi, Elaheh, et al.
Pubblicazione: (2024)
Light-SLAM: A Robust Deep-Learning Visual SLAM System Based on LightGlue under Challenging Lighting Conditions
di: Zhao, Zhiqi, et al.
Pubblicazione: (2024)
di: Zhao, Zhiqi, et al.
Pubblicazione: (2024)
Multi-Camera View Scaling for Data-Efficient Robot Imitation Learning
di: Xie, Yichen, et al.
Pubblicazione: (2026)
di: Xie, Yichen, et al.
Pubblicazione: (2026)
RAPID: Robust and Agile Planner Using Inverse Reinforcement Learning for Vision-Based Drone Navigation
di: Kim, Minwoo, et al.
Pubblicazione: (2025)
di: Kim, Minwoo, et al.
Pubblicazione: (2025)
AI-Driven Marine Robotics: Emerging Trends in Underwater Perception and Ecosystem Monitoring
di: Raine, Scarlett, et al.
Pubblicazione: (2025)
di: Raine, Scarlett, et al.
Pubblicazione: (2025)
NavMapFusion: Diffusion-based Fusion of Navigation Maps for Online Vectorized HD Map Construction
di: Monninger, Thomas, et al.
Pubblicazione: (2025)
di: Monninger, Thomas, et al.
Pubblicazione: (2025)
Depth Matters: Multimodal RGB-D Perception for Robust Autonomous Agents
di: Clement, Mihaela-Larisa, et al.
Pubblicazione: (2025)
di: Clement, Mihaela-Larisa, et al.
Pubblicazione: (2025)
GNFactor: Multi-Task Real Robot Learning with Generalizable Neural Feature Fields
di: Ze, Yanjie, et al.
Pubblicazione: (2023)
di: Ze, Yanjie, et al.
Pubblicazione: (2023)
DogSurf: Quadruped Robot Capable of GRU-based Surface Recognition for Blind Person Navigation
di: Bazhenov, Artem, et al.
Pubblicazione: (2024)
di: Bazhenov, Artem, et al.
Pubblicazione: (2024)
Reinforcement Learning of Dolly-In Filming Using a Ground-Based Robot
di: Lorimer, Philip, et al.
Pubblicazione: (2025)
di: Lorimer, Philip, et al.
Pubblicazione: (2025)
Learning Vision-Based Omnidirectional Navigation: A Teacher-Student Approach Using Monocular Depth Estimation
di: Finke, Jan, et al.
Pubblicazione: (2026)
di: Finke, Jan, et al.
Pubblicazione: (2026)
NavigScene: Bridging Local Perception and Global Navigation for Beyond-Visual-Range Autonomous Driving
di: Peng, Qucheng, et al.
Pubblicazione: (2025)
di: Peng, Qucheng, et al.
Pubblicazione: (2025)
Point Cloud Models Improve Visual Robustness in Robotic Learners
di: Peri, Skand, et al.
Pubblicazione: (2024)
di: Peri, Skand, et al.
Pubblicazione: (2024)
Deep Bayesian Future Fusion for Self-Supervised, High-Resolution, Off-Road Mapping
di: Aich, Shubhra, et al.
Pubblicazione: (2024)
di: Aich, Shubhra, et al.
Pubblicazione: (2024)
Beyond Domain Randomization: Event-Inspired Perception for Visually Robust Adversarial Imitation from Videos
di: Ramazzina, Andrea, et al.
Pubblicazione: (2025)
di: Ramazzina, Andrea, et al.
Pubblicazione: (2025)
Visual Perception Engine: Fast and Flexible Multi-Head Inference for Robotic Vision Tasks
di: Łucki, Jakub, et al.
Pubblicazione: (2025)
di: Łucki, Jakub, et al.
Pubblicazione: (2025)
View Invariant Learning for Vision-Language Navigation in Continuous Environments
di: Sun, Josh Qixuan, et al.
Pubblicazione: (2025)
di: Sun, Josh Qixuan, et al.
Pubblicazione: (2025)
SELFI: Autonomous Self-Improvement with Reinforcement Learning for Social Navigation
di: Hirose, Noriaki, et al.
Pubblicazione: (2024)
di: Hirose, Noriaki, et al.
Pubblicazione: (2024)
Resolving Spatio-Temporal Entanglement in Video Prediction via Multi-Modal Attention
di: Gupta, Shreyam, et al.
Pubblicazione: (2025)
di: Gupta, Shreyam, et al.
Pubblicazione: (2025)
LiDAR Based Semantic Perception for Forklifts in Outdoor Environments
di: Serfling, Benjamin, et al.
Pubblicazione: (2025)
di: Serfling, Benjamin, et al.
Pubblicazione: (2025)
PhysNav-DG: A Novel Adaptive Framework for Robust VLM-Sensor Fusion in Navigation Applications
di: Srinivasan, Trisanth, et al.
Pubblicazione: (2025)
di: Srinivasan, Trisanth, et al.
Pubblicazione: (2025)
Variational Dynamic for Self-Supervised Exploration in Deep Reinforcement Learning
di: Bai, Chenjia, et al.
Pubblicazione: (2020)
di: Bai, Chenjia, et al.
Pubblicazione: (2020)
MARVL: Multi-Stage Guidance for Robotic Manipulation via Vision-Language Models
di: Zhou, Xunlan, et al.
Pubblicazione: (2026)
di: Zhou, Xunlan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Distributed NeRF Learning for Collaborative Multi-Robot Perception
di: Zhao, Hongrui, et al.
Pubblicazione: (2024) -
DGFusion: Depth-Guided Sensor Fusion for Robust Semantic Perception
di: Broedermannn, Tim, et al.
Pubblicazione: (2025) -
Vision-Based Deep Reinforcement Learning of UAV Autonomous Navigation Using Privileged Information
di: Wang, Junqiao, et al.
Pubblicazione: (2024) -
Adver-City: Open-Source Multi-Modal Dataset for Collaborative Perception Under Adverse Weather Conditions
di: Karvat, Mateus, et al.
Pubblicazione: (2024) -
Tactile Modality Fusion for Vision-Language-Action Models
di: Morissette, Charlotte, et al.
Pubblicazione: (2026)