Kinaema: a recurrent sequence model for memory and pose in motion
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sariyildiz, Mert Bulent, Weinzaepfel, Philippe, Bono, Guillaume, Monaci, Gianluca, Wolf, Christian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
What does really matter in image goal navigation?
par: Monaci, Gianluca, et autres
Publié: (2025)
par: Monaci, Gianluca, et autres
Publié: (2025)
Joint Learning of Depth, Pose, and Local Radiance Field for Large Scale Monocular 3D Reconstruction
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
Spot-Compose: A Framework for Open-Vocabulary Object Retrieval and Drawer Manipulation in Point Clouds
par: Lemke, Oliver, et autres
Publié: (2024)
par: Lemke, Oliver, et autres
Publié: (2024)
VIN-NBV: A View Introspection Network for Next-Best-View Selection
par: Frahm, Noah, et autres
Publié: (2025)
par: Frahm, Noah, et autres
Publié: (2025)
A Survey of Spatial Memory Representations for Efficient Robot Navigation
par: Pangaliman, Ma. Madecheen S., et autres
Publié: (2026)
par: Pangaliman, Ma. Madecheen S., et autres
Publié: (2026)
CoEnv: Driving Embodied Multi-Agent Collaboration via Compositional Environment
par: Kang, Li, et autres
Publié: (2026)
par: Kang, Li, et autres
Publié: (2026)
Infrastructure-Centric World Models: Bridging Temporal Depth and Spatial Breadth for Roadside Perception
par: Meng, Siyuan, et autres
Publié: (2026)
par: Meng, Siyuan, et autres
Publié: (2026)
CNN-based local features for navigation near an asteroid
par: Knuuttila, Olli, et autres
Publié: (2023)
par: Knuuttila, Olli, et autres
Publié: (2023)
RAE-NWM: Navigation World Model in Dense Visual Representation Space
par: Zhang, Mingkun, et autres
Publié: (2026)
par: Zhang, Mingkun, et autres
Publié: (2026)
PoseRefer: Pathway-Local Parameters for Semantically Grounded Reference Resolution
par: Deichler, Anna
Publié: (2026)
par: Deichler, Anna
Publié: (2026)
PRISM-TopoMap: Online Topological Mapping with Place Recognition and Scan Matching
par: Muravyev, Kirill, et autres
Publié: (2024)
par: Muravyev, Kirill, et autres
Publié: (2024)
Zero-Shot Object Goal Visual Navigation With Class-Independent Relationship Network
par: Li, Xinting, et autres
Publié: (2023)
par: Li, Xinting, et autres
Publié: (2023)
M3CAD: Towards Generic Cooperative Autonomous Driving Benchmark
par: Zhu, Morui, et autres
Publié: (2025)
par: Zhu, Morui, et autres
Publié: (2025)
Self-Supervised Learning for Robotic Leaf Manipulation: A Hybrid Geometric-Neural Approach
par: Selvam, Srecharan
Publié: (2025)
par: Selvam, Srecharan
Publié: (2025)
IN-Sight: Interactive Navigation through Sight
par: Schoch, Philipp, et autres
Publié: (2024)
par: Schoch, Philipp, et autres
Publié: (2024)
Light Future: Multimodal Action Frame Prediction via InstructPix2Pix
par: Zhong, Zesen, et autres
Publié: (2025)
par: Zhong, Zesen, et autres
Publié: (2025)
U-Net-Like Spiking Neural Networks for Single Image Dehazing
par: Li, Huibin, et autres
Publié: (2025)
par: Li, Huibin, et autres
Publié: (2025)
Leveraging GNSS and Onboard Visual Data from Consumer Vehicles for Robust Road Network Estimation
par: Opra, Balázs, et autres
Publié: (2024)
par: Opra, Balázs, et autres
Publié: (2024)
Unveiling the Potential of iMarkers: Invisible Fiducial Markers for Advanced Robotics
par: Tourani, Ali, et autres
Publié: (2025)
par: Tourani, Ali, et autres
Publié: (2025)
SuperPoint-SLAM3: Augmenting ORB-SLAM3 with Deep Features, Adaptive NMS, and Learning-Based Loop Closure
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
Large Language Models and 3D Vision for Intelligent Robotic Perception and Autonomy
par: Mehta, Vinit, et autres
Publié: (2025)
par: Mehta, Vinit, et autres
Publié: (2025)
Towards Localizing Structural Elements: Merging Geometrical Detection with Semantic Verification in RGB-D Data
par: Tourani, Ali, et autres
Publié: (2024)
par: Tourani, Ali, et autres
Publié: (2024)
vS-Graphs: Tightly Coupling Visual SLAM and 3D Scene Graphs Exploiting Hierarchical Scene Understanding
par: Tourani, Ali, et autres
Publié: (2025)
par: Tourani, Ali, et autres
Publié: (2025)
The Impact of 2D Segmentation Backbones on Point Cloud Predictions Using 4D Radar
par: Muckelroy III, William, et autres
Publié: (2025)
par: Muckelroy III, William, et autres
Publié: (2025)
Temporally Consistent Object 6D Pose Estimation for Robot Control
par: Zorina, Kateryna, et autres
Publié: (2026)
par: Zorina, Kateryna, et autres
Publié: (2026)
Towards Global Localization using Multi-Modal Object-Instance Re-Identification
par: Chavan, Aneesh, et autres
Publié: (2024)
par: Chavan, Aneesh, et autres
Publié: (2024)
NavTopo: Leveraging Topological Maps For Autonomous Navigation Of a Mobile Robot
par: Muravyev, Kirill, et autres
Publié: (2024)
par: Muravyev, Kirill, et autres
Publié: (2024)
Real-Time Localization Framework for Autonomous Basketball Robots
par: Medarametla, Naren, et autres
Publié: (2026)
par: Medarametla, Naren, et autres
Publié: (2026)
AsgardBench -- Evaluating Visually Grounded Interactive Planning Under Minimal Feedback
par: Tupini, Andrea, et autres
Publié: (2026)
par: Tupini, Andrea, et autres
Publié: (2026)
MAP: End-to-End Autonomous Driving with Map-Assisted Planning
par: Yin, Huilin, et autres
Publié: (2025)
par: Yin, Huilin, et autres
Publié: (2025)
PALMS: Plane-based Accessible Indoor Localization Using Mobile Smartphones
par: Cheng, Yunqian, et autres
Publié: (2024)
par: Cheng, Yunqian, et autres
Publié: (2024)
EgoTraj: Real-World Egocentric Human Trajectory Dataset for Multimodal Prediction
par: Yehia, Ahmad, et autres
Publié: (2026)
par: Yehia, Ahmad, et autres
Publié: (2026)
Edged USLAM: Edge-Aware Event-Based SLAM with Learning-Based Depth Priors
par: Sarıözkan, Şebnem, et autres
Publié: (2026)
par: Sarıözkan, Şebnem, et autres
Publié: (2026)
An Evaluation of a Visual Question Answering Strategy for Zero-shot Facial Expression Recognition in Still Images
par: Castrillón-Santana, Modesto, et autres
Publié: (2025)
par: Castrillón-Santana, Modesto, et autres
Publié: (2025)
A Challenging Benchmark of Anime Style Recognition
par: Li, Haotang, et autres
Publié: (2022)
par: Li, Haotang, et autres
Publié: (2022)
Textual and Visual Guided Task Adaptation for Source-Free Cross-Domain Few-Shot Segmentation
par: Liu, Jianming, et autres
Publié: (2025)
par: Liu, Jianming, et autres
Publié: (2025)
FUSE-Flow: Scalable Real-Time Multi-View Point Cloud Reconstruction Using Confidence
par: Sun, Chentian
Publié: (2026)
par: Sun, Chentian
Publié: (2026)
YotoR-You Only Transform One Representation
par: Villa, José Ignacio Díaz, et autres
Publié: (2024)
par: Villa, José Ignacio Díaz, et autres
Publié: (2024)
MSTA3D: Multi-scale Twin-attention for 3D Instance Segmentation
par: Tran, Duc Dang Trung, et autres
Publié: (2024)
par: Tran, Duc Dang Trung, et autres
Publié: (2024)
ERNet: Efficient Non-Rigid Registration Network for Point Sequences
par: He, Guangzhao, et autres
Publié: (2025)
par: He, Guangzhao, et autres
Publié: (2025)
Documents similaires
-
What does really matter in image goal navigation?
par: Monaci, Gianluca, et autres
Publié: (2025) -
Joint Learning of Depth, Pose, and Local Radiance Field for Large Scale Monocular 3D Reconstruction
par: Syed, Shahram Najam, et autres
Publié: (2025) -
Spot-Compose: A Framework for Open-Vocabulary Object Retrieval and Drawer Manipulation in Point Clouds
par: Lemke, Oliver, et autres
Publié: (2024) -
VIN-NBV: A View Introspection Network for Next-Best-View Selection
par: Frahm, Noah, et autres
Publié: (2025) -
A Survey of Spatial Memory Representations for Efficient Robot Navigation
par: Pangaliman, Ma. Madecheen S., et autres
Publié: (2026)