KM-ViPE: Online Tightly Coupled Vision-Language-Geometry Fusion for Open-Vocabulary Semantic SLAM
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nasser, Zaid, Iumanov, Mikhail, Li, Tianhao, Popov, Maxim, Mahmoud, Jaafar, Mohrat, Malik, Obrubov, Ilya, Derevyanka, Ekaterina, Sosin, Ivan, Kolyubin, Sergey |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RADIO-ViPE: Online Tightly Coupled Multi-Modal Fusion for Open-Vocabulary Semantic SLAM in Dynamic Environments
par: Nasser, Zaid, et autres
Publié: (2026)
par: Nasser, Zaid, et autres
Publié: (2026)
OSMa-Bench: Evaluating Open Semantic Mapping Under Varying Lighting Conditions
par: Popov, Maxim, et autres
Publié: (2025)
par: Popov, Maxim, et autres
Publié: (2025)
LEG-SLAM: Real-Time Language-Enhanced Gaussian Splatting for SLAM
par: Titkov, Roman, et autres
Publié: (2025)
par: Titkov, Roman, et autres
Publié: (2025)
FocusGraph: Graph-Structured Frame Selection for Embodied Long Video Question Answering
par: Zemskova, Tatiana, et autres
Publié: (2026)
par: Zemskova, Tatiana, et autres
Publié: (2026)
ViPE: Video Pose Engine for 3D Geometric Perception
par: Huang, Jiahui, et autres
Publié: (2025)
par: Huang, Jiahui, et autres
Publié: (2025)
GSplatLoc: Grounding Keypoint Descriptors into 3D Gaussian Splatting for Improved Visual Localization
par: Sidorov, Gennady, et autres
Publié: (2024)
par: Sidorov, Gennady, et autres
Publié: (2024)
R5DGS: Semantic-Aware 4D Gaussian Splatting with Rigid Body Constraints for Efficient Dynamic Scene Reconstruction
par: Gridusov, Denis, et autres
Publié: (2026)
par: Gridusov, Denis, et autres
Publié: (2026)
OSMa-Bench++: Toward Open-Ended Benchmarking of Semantic Mapping for Manipulation with Prompt-Generated Synthetic Scenes
par: Kurkova, Regina, et autres
Publié: (2026)
par: Kurkova, Regina, et autres
Publié: (2026)
AgentGrounder: Zero-Shot 3D Visual Pointcloud Grounding using Multimodal Language Models
par: Huynh, Cuong, et autres
Publié: (2026)
par: Huynh, Cuong, et autres
Publié: (2026)
Tight and Efficient Upper Bound on Spectral Norm of Convolutional Layers
par: Grishina, Ekaterina, et autres
Publié: (2024)
par: Grishina, Ekaterina, et autres
Publié: (2024)
ProcrustesGPT: Compressing LLMs with Structured Matrices and Orthogonal Transformations
par: Grishina, Ekaterina, et autres
Publié: (2025)
par: Grishina, Ekaterina, et autres
Publié: (2025)
ViSTA-SLAM: Visual SLAM with Symmetric Two-view Association
par: Zhang, Ganlin, et autres
Publié: (2025)
par: Zhang, Ganlin, et autres
Publié: (2025)
Tightly Coupled SLAM with Imprecise Architectural Plans
par: Shaheer, Muhammad, et autres
Publié: (2024)
par: Shaheer, Muhammad, et autres
Publié: (2024)
AQUA-SLAM: Tightly-Coupled Underwater Acoustic-Visual-Inertial SLAM with Sensor Calibration
par: Xu, Shida, et autres
Publié: (2025)
par: Xu, Shida, et autres
Publié: (2025)
Open-Vocabulary Online Semantic Mapping for SLAM
par: Martins, Tomas Berriel, et autres
Publié: (2024)
par: Martins, Tomas Berriel, et autres
Publié: (2024)
Contenido de Cu, Co, Cr y Pb en sedimentos de tres estuarios de la costa sur de Cuba
par: Arencibia Carballo, G., et autres
Publié: (1988)
par: Arencibia Carballo, G., et autres
Publié: (1988)
EgoWalk: A Multimodal Dataset for Robot Navigation in the Wild
par: Akhtyamov, Timur, et autres
Publié: (2025)
par: Akhtyamov, Timur, et autres
Publié: (2025)
Synergizing Morphological Computation and Generative Design: Automatic Synthesis of Tendon-Driven Grippers
par: Zharkov, Kirill, et autres
Publié: (2024)
par: Zharkov, Kirill, et autres
Publié: (2024)
Three-dimensional Moiré crystallography
par: Popov, Ilya, et autres
Publié: (2026)
par: Popov, Ilya, et autres
Publié: (2026)
ViMGuard: A Novel Multi-Modal System for Video Misinformation Guarding
par: Kan, Andrew, et autres
Publié: (2024)
par: Kan, Andrew, et autres
Publié: (2024)
Tight closure of products and F-rational singularities
par: De Stefani, Alessandro, et autres
Publié: (2024)
par: De Stefani, Alessandro, et autres
Publié: (2024)
Comparison of Various SLAM Systems for Mobile Robot in an Indoor Environment
par: Filipenko, Maksim, et autres
Publié: (2025)
par: Filipenko, Maksim, et autres
Publié: (2025)
Tight Privacy Audit in One Run
par: Xiang, Zihang, et autres
Publié: (2025)
par: Xiang, Zihang, et autres
Publié: (2025)
The Geometry Underlying the Quantum Harmonic Oscillator
par: Popov, Alexander D.
Publié: (2026)
par: Popov, Alexander D.
Publié: (2026)
G2S-ICP SLAM: Geometry-aware Gaussian Splatting ICP SLAM
par: Pak, Gyuhyeon, et autres
Publié: (2025)
par: Pak, Gyuhyeon, et autres
Publié: (2025)
The Geometry of Severi Varieties
par: Tyomkin, Ilya
Publié: (2024)
par: Tyomkin, Ilya
Publié: (2024)
GeoFlow-SLAM: A Robust Tightly-Coupled RGBD-Inertial and Legged Odometry Fusion SLAM for Dynamic Legged Robotics
par: Xiao, Tingyang, et autres
Publié: (2025)
par: Xiao, Tingyang, et autres
Publié: (2025)
Capabilities of object-oriented programming for the construction of quantum-kinetic BBGKY equations of high orders
par: Tarasevich, Ekaterina, et autres
Publié: (2024)
par: Tarasevich, Ekaterina, et autres
Publié: (2024)
PG-SLAM: Photo-realistic and Geometry-aware RGB-D SLAM in Dynamic Environments
par: Li, Haoang, et autres
Publié: (2024)
par: Li, Haoang, et autres
Publié: (2024)
HI-SLAM2: Geometry-Aware Gaussian SLAM for Fast Monocular Scene Reconstruction
par: Zhang, Wei, et autres
Publié: (2024)
par: Zhang, Wei, et autres
Publié: (2024)
Tight Success Probabilities for Quantum Period Finding and Phase Estimation
par: Magdon-Ismail, Malik, et autres
Publié: (2025)
par: Magdon-Ismail, Malik, et autres
Publié: (2025)
Translating Cocktails to Russian using LLMs
par: Lubenets, Ilya, et autres
Publié: (2025)
par: Lubenets, Ilya, et autres
Publié: (2025)
Epistemology of Generative AI: The Geometry of Knowing
par: Levin, Ilya
Publié: (2026)
par: Levin, Ilya
Publié: (2026)
Squeezing a lubricant with exponential pressure dependence of viscosity: Resolution of a hydrodynamic paradox
par: Rustam I. Khalmuradov, et autres
Publié: (2025)
par: Rustam I. Khalmuradov, et autres
Publié: (2025)
Scene-Graph ViT: End-to-End Open-Vocabulary Visual Relationship Detection
par: Salzmann, Tim, et autres
Publié: (2024)
par: Salzmann, Tim, et autres
Publié: (2024)
Natal kicks of compact objects
par: Popov, Sergei, et autres
Publié: (2025)
par: Popov, Sergei, et autres
Publié: (2025)
Computer Modelling of Bioheat Transfer for the Analysis of Brightness Temperature Distributions
par: Polyakov, Maxim V., et autres
Publié: (2025)
par: Polyakov, Maxim V., et autres
Publié: (2025)
Quantum-Deformed Phase-Space Geometry and Emergent Inflation in Effective Four-Dimensional Spacetime
par: Singh, Swapnil Kumar, et autres
Publié: (2026)
par: Singh, Swapnil Kumar, et autres
Publié: (2026)
Tightly-Coupled LiDAR-Visual-Inertial SLAM and Large-Scale Volumetric Occupancy Mapping
par: Boche, Simon, et autres
Publié: (2024)
par: Boche, Simon, et autres
Publié: (2024)
The Continuous Logarithm in the Complex Circle for Post-Quantum Cryptographic Algorithms
par: Gaber, Jaafar
Publié: (2024)
par: Gaber, Jaafar
Publié: (2024)
Documents similaires
-
RADIO-ViPE: Online Tightly Coupled Multi-Modal Fusion for Open-Vocabulary Semantic SLAM in Dynamic Environments
par: Nasser, Zaid, et autres
Publié: (2026) -
OSMa-Bench: Evaluating Open Semantic Mapping Under Varying Lighting Conditions
par: Popov, Maxim, et autres
Publié: (2025) -
LEG-SLAM: Real-Time Language-Enhanced Gaussian Splatting for SLAM
par: Titkov, Roman, et autres
Publié: (2025) -
FocusGraph: Graph-Structured Frame Selection for Embodied Long Video Question Answering
par: Zemskova, Tatiana, et autres
Publié: (2026) -
ViPE: Video Pose Engine for 3D Geometric Perception
par: Huang, Jiahui, et autres
Publié: (2025)