Multi-modal Loop Closure Detection with Foundation Models in Severely Unstructured Environments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gonzalez, Laura Alejandra Encinar, Folkesson, John, Triebel, Rudolph, Giubilato, Riccardo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UAV-assisted Visual SLAM Generating Reconstructed 3D Scene Graphs in GPS-denied Environments
par: Radwan, Ahmed, et autres
Publié: (2024)
par: Radwan, Ahmed, et autres
Publié: (2024)
Single-Shot Metric Depth from Focused Plenoptic Cameras
par: Lasheras-Hernandez, Blanca, et autres
Publié: (2024)
par: Lasheras-Hernandez, Blanca, et autres
Publié: (2024)
Motion Perceiver: Real-Time Occupancy Forecasting for Embedded Systems
par: Ferenczi, Bryce, et autres
Publié: (2023)
par: Ferenczi, Bryce, et autres
Publié: (2023)
Closed-Loop Neural Activation Control in Vision-Language-Action Models
par: Babu, Abhijith, et autres
Publié: (2026)
par: Babu, Abhijith, et autres
Publié: (2026)
Learning from Watching: Scalable Extraction of Manipulation Trajectories from Human Videos
par: Hu, X., et autres
Publié: (2025)
par: Hu, X., et autres
Publié: (2025)
OWMM-Agent: Open World Mobile Manipulation With Multi-modal Agentic Data Synthesis
par: Chen, Junting, et autres
Publié: (2025)
par: Chen, Junting, et autres
Publié: (2025)
Vision-based Situational Graphs Exploiting Fiducial Markers for the Integration of Semantic Entities
par: Tourani, Ali, et autres
Publié: (2023)
par: Tourani, Ali, et autres
Publié: (2023)
CoMoCAVs: Cohesive Decision-Guided Motion Planning for Connected and Autonomous Vehicles with Multi-Policy Reinforcement Learning
par: Hu, Pan
Publié: (2025)
par: Hu, Pan
Publié: (2025)
OpenMap: Instruction Grounding via Open-Vocabulary Visual-Language Mapping
par: Li, Danyang, et autres
Publié: (2025)
par: Li, Danyang, et autres
Publié: (2025)
Dream to Fly: Model-Based Reinforcement Learning for Vision-Based Drone Flight
par: Romero, Angel, et autres
Publié: (2025)
par: Romero, Angel, et autres
Publié: (2025)
WayFASTER: a Self-Supervised Traversability Prediction for Increased Navigation Awareness
par: Gasparino, Mateus Valverde, et autres
Publié: (2024)
par: Gasparino, Mateus Valverde, et autres
Publié: (2024)
EmbodiedLGR: Integrating Lightweight Graph Representation and Retrieval for Semantic-Spatial Memory in Robotic Agents
par: Riva, Paolo, et autres
Publié: (2026)
par: Riva, Paolo, et autres
Publié: (2026)
Taking Flight with Dialogue: Enabling Natural Language Control for PX4-based Drone Agent
par: Lim, Shoon Kit, et autres
Publié: (2025)
par: Lim, Shoon Kit, et autres
Publié: (2025)
StratXplore: Strategic Novelty-seeking and Instruction-aligned Exploration for Vision and Language Navigation
par: Gopinathan, Muraleekrishna, et autres
Publié: (2024)
par: Gopinathan, Muraleekrishna, et autres
Publié: (2024)
Deep Probabilistic Traversability with Test-time Adaptation for Uncertainty-aware Planetary Rover Navigation
par: Endo, Masafumi, et autres
Publié: (2024)
par: Endo, Masafumi, et autres
Publié: (2024)
NeuGrasp: Generalizable Neural Surface Reconstruction with Background Priors for Material-Agnostic Object Grasp Detection
par: Fan, Qingyu, et autres
Publié: (2025)
par: Fan, Qingyu, et autres
Publié: (2025)
SuperPoint-SLAM3: Augmenting ORB-SLAM3 with Deep Features, Adaptive NMS, and Learning-Based Loop Closure
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
CoEnv: Driving Embodied Multi-Agent Collaboration via Compositional Environment
par: Kang, Li, et autres
Publié: (2026)
par: Kang, Li, et autres
Publié: (2026)
Ego-Motion Aware Target Prediction Module for Robust Multi-Object Tracking
par: Mahdian, Navid, et autres
Publié: (2024)
par: Mahdian, Navid, et autres
Publié: (2024)
Towards Cognitive Collaborative Robots: Semantic-Level Integration and Explainable Control for Human-Centric Cooperation
par: Oh, Jaehong
Publié: (2025)
par: Oh, Jaehong
Publié: (2025)
Industrial Robot Motion Planning with GPUs: Integration of cuRobo for Extended DOF Systems
par: Abuelsamen, Luai, et autres
Publié: (2025)
par: Abuelsamen, Luai, et autres
Publié: (2025)
Spatially-Aware Speaker for Vision-and-Language Navigation Instruction Generation
par: Gopinathan, Muraleekrishna, et autres
Publié: (2024)
par: Gopinathan, Muraleekrishna, et autres
Publié: (2024)
A Segmented Robot Grasping Perception Neural Network for Edge AI
par: Bröcheler, Casper, et autres
Publié: (2025)
par: Bröcheler, Casper, et autres
Publié: (2025)
Enhancing Reinforcement Learning in 3D Environments through Semantic Segmentation: A Case Study in ViZDoom
par: Huang, Jin
Publié: (2025)
par: Huang, Jin
Publié: (2025)
Towards Localizing Structural Elements: Merging Geometrical Detection with Semantic Verification in RGB-D Data
par: Tourani, Ali, et autres
Publié: (2024)
par: Tourani, Ali, et autres
Publié: (2024)
CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion
par: Römer, Ralf, et autres
Publié: (2026)
par: Römer, Ralf, et autres
Publié: (2026)
Cortex 2.0: Grounding World Models in Real-World Industrial Deployment
par: Aida, Adriana, et autres
Publié: (2026)
par: Aida, Adriana, et autres
Publié: (2026)
ExpReS-VLA: Specializing Vision-Language-Action Models Through Experience Replay and Retrieval
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
Evaluating the Impact of Synthetic Data on Object Detection Tasks in Autonomous Driving
par: Özeren, Enes, et autres
Publié: (2025)
par: Özeren, Enes, et autres
Publié: (2025)
Curb Your Attention: Causal Attention Gating for Robust Trajectory Prediction in Autonomous Driving
par: Ahmadi, Ehsan, et autres
Publié: (2024)
par: Ahmadi, Ehsan, et autres
Publié: (2024)
From Demonstrations to Safe Deployment: Path-Consistent Safety Filtering for Diffusion Policies
par: Römer, Ralf, et autres
Publié: (2025)
par: Römer, Ralf, et autres
Publié: (2025)
Long-Horizon Visual Imitation Learning via Plan and Code Reflection
par: Chen, Quan, et autres
Publié: (2025)
par: Chen, Quan, et autres
Publié: (2025)
Spot-Compose: A Framework for Open-Vocabulary Object Retrieval and Drawer Manipulation in Point Clouds
par: Lemke, Oliver, et autres
Publié: (2024)
par: Lemke, Oliver, et autres
Publié: (2024)
VIN-NBV: A View Introspection Network for Next-Best-View Selection
par: Frahm, Noah, et autres
Publié: (2025)
par: Frahm, Noah, et autres
Publié: (2025)
iTrash: Incentivized Token Rewards for Automated Sorting and Handling
par: Ortega, Pablo, et autres
Publié: (2025)
par: Ortega, Pablo, et autres
Publié: (2025)
A Survey of Spatial Memory Representations for Efficient Robot Navigation
par: Pangaliman, Ma. Madecheen S., et autres
Publié: (2026)
par: Pangaliman, Ma. Madecheen S., et autres
Publié: (2026)
RAE-NWM: Navigation World Model in Dense Visual Representation Space
par: Zhang, Mingkun, et autres
Publié: (2026)
par: Zhang, Mingkun, et autres
Publié: (2026)
PoseRefer: Pathway-Local Parameters for Semantically Grounded Reference Resolution
par: Deichler, Anna
Publié: (2026)
par: Deichler, Anna
Publié: (2026)
PRISM-TopoMap: Online Topological Mapping with Place Recognition and Scan Matching
par: Muravyev, Kirill, et autres
Publié: (2024)
par: Muravyev, Kirill, et autres
Publié: (2024)
Zero-Shot Object Goal Visual Navigation With Class-Independent Relationship Network
par: Li, Xinting, et autres
Publié: (2023)
par: Li, Xinting, et autres
Publié: (2023)
Documents similaires
-
UAV-assisted Visual SLAM Generating Reconstructed 3D Scene Graphs in GPS-denied Environments
par: Radwan, Ahmed, et autres
Publié: (2024) -
Single-Shot Metric Depth from Focused Plenoptic Cameras
par: Lasheras-Hernandez, Blanca, et autres
Publié: (2024) -
Motion Perceiver: Real-Time Occupancy Forecasting for Embedded Systems
par: Ferenczi, Bryce, et autres
Publié: (2023) -
Closed-Loop Neural Activation Control in Vision-Language-Action Models
par: Babu, Abhijith, et autres
Publié: (2026) -
Learning from Watching: Scalable Extraction of Manipulation Trajectories from Human Videos
par: Hu, X., et autres
Publié: (2025)