DINO-VO: Learning Where to Focus for Enhanced State Estimation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Qi, Li, Guanghao, Hu, Sijia, Gao, Xin, Ma, Junpeng, Xue, Xiangyang, Pu, Jian |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PAPL-SLAM: Principal Axis-Anchored Monocular Point-Line SLAM
par: Li, Guanghao, et autres
Publié: (2024)
par: Li, Guanghao, et autres
Publié: (2024)
DINO-VO: A Feature-based Visual Odometry Leveraging a Visual Foundation Model
par: Azhari, Maulana Bisyir, et autres
Publié: (2025)
par: Azhari, Maulana Bisyir, et autres
Publié: (2025)
DINO-SD: Champion Solution for ICRA 2024 RoboDepth Challenge
par: Mao, Yifan, et autres
Publié: (2024)
par: Mao, Yifan, et autres
Publié: (2024)
FastOcc: Accelerating 3D Occupancy Prediction by Fusing the 2D Bird's-Eye View and Perspective View
par: Hou, Jiawei, et autres
Publié: (2024)
par: Hou, Jiawei, et autres
Publié: (2024)
SMF-VO: Direct Ego-Motion Estimation via Sparse Motion Fields
par: Yang, Sangheon, et autres
Publié: (2025)
par: Yang, Sangheon, et autres
Publié: (2025)
You Only Estimate Once: Unified, One-stage, Real-Time Category-level Articulated Object 6D Pose Estimation for Robotic Grasping
par: Huang, Jingshun, et autres
Publié: (2025)
par: Huang, Jingshun, et autres
Publié: (2025)
MAC-VO: Metrics-aware Covariance for Learning-based Stereo Visual Odometry
par: Qiu, Yuheng, et autres
Publié: (2024)
par: Qiu, Yuheng, et autres
Publié: (2024)
Enhanced Scale-aware Depth Estimation for Monocular Endoscopic Scenes with Geometric Modeling
par: Wei, Ruofeng, et autres
Publié: (2024)
par: Wei, Ruofeng, et autres
Publié: (2024)
ForestVO: Enhancing Visual Odometry in Forest Environments through ForestGlue
par: Pritchard, Thomas, et autres
Publié: (2025)
par: Pritchard, Thomas, et autres
Publié: (2025)
CAP-Net: A Unified Network for 6D Pose and Size Estimation of Categorical Articulated Parts from a Single RGB-D Image
par: Huang, Jingshun, et autres
Publié: (2025)
par: Huang, Jingshun, et autres
Publié: (2025)
ProFocus: Proactive Perception and Focused Reasoning in Vision-and-Language Navigation
par: Xue, Wei, et autres
Publié: (2026)
par: Xue, Wei, et autres
Publié: (2026)
CodedVO: Coded Visual Odometry
par: Shah, Sachin, et autres
Publié: (2024)
par: Shah, Sachin, et autres
Publié: (2024)
GDRNPP: A Geometry-guided and Fully Learning-based Object Pose Estimator
par: Liu, Xingyu, et autres
Publié: (2021)
par: Liu, Xingyu, et autres
Publié: (2021)
DINO-Explorer: Active Underwater Discovery via Ego-Motion Compensated Semantic Predictive Coding
par: Jin, Yuhan, et autres
Publié: (2026)
par: Jin, Yuhan, et autres
Publié: (2026)
D$^3$FlowSLAM: Self-Supervised Dynamic SLAM with Flow Motion Decomposition and DINO Guidance
par: Yu, Xingyuan, et autres
Publié: (2022)
par: Yu, Xingyuan, et autres
Publié: (2022)
OCRA: Object-Centric Learning with 3D and Tactile Priors for Human-to-Robot Action Transfer
par: Wang, Kuanning, et autres
Publié: (2026)
par: Wang, Kuanning, et autres
Publié: (2026)
Automated Label Unification for Multi-Dataset Semantic Segmentation with GNNs
par: Ma, Rong, et autres
Publié: (2024)
par: Ma, Rong, et autres
Publié: (2024)
LAC-Net: Linear-Fusion Attention-Guided Convolutional Network for Accurate Robotic Grasping Under the Occlusion
par: Zhang, Jinyu, et autres
Publié: (2024)
par: Zhang, Jinyu, et autres
Publié: (2024)
SCOOP'D: Learning Mixed-Liquid-Solid Scooping via Sim2Real Generative Policy
par: Wang, Kuanning, et autres
Publié: (2025)
par: Wang, Kuanning, et autres
Publié: (2025)
A Neural Representation Framework with LLM-Driven Spatial Reasoning for Open-Vocabulary 3D Visual Grounding
par: Liu, Zhenyang, et autres
Publié: (2025)
par: Liu, Zhenyang, et autres
Publié: (2025)
DINO Pre-training for Vision-based End-to-end Autonomous Driving
par: Juneja, Shubham, et autres
Publié: (2024)
par: Juneja, Shubham, et autres
Publié: (2024)
Traj-LIO: A Resilient Multi-LiDAR Multi-IMU State Estimator Through Sparse Gaussian Process
par: Zheng, Xin, et autres
Publié: (2024)
par: Zheng, Xin, et autres
Publié: (2024)
Real-time Holistic Robot Pose Estimation with Unknown States
par: Ban, Shikun, et autres
Publié: (2024)
par: Ban, Shikun, et autres
Publié: (2024)
Dark-ISP: Enhancing RAW Image Processing for Low-Light Object Detection
par: Guo, Jiasheng, et autres
Publié: (2025)
par: Guo, Jiasheng, et autres
Publié: (2025)
Swiss DINO: Efficient and Versatile Vision Framework for On-device Personal Object Search
par: Paramonov, Kirill, et autres
Publié: (2024)
par: Paramonov, Kirill, et autres
Publié: (2024)
FisheyeDepth: A Real Scale Self-Supervised Depth Estimation Model for Fisheye Camera
par: Zhao, Guoyang, et autres
Publié: (2024)
par: Zhao, Guoyang, et autres
Publié: (2024)
VANP: Learning Where to See for Navigation with Self-Supervised Vision-Action Pre-Training
par: Nazeri, Mohammad, et autres
Publié: (2024)
par: Nazeri, Mohammad, et autres
Publié: (2024)
Tell Me Where You Are: Multimodal LLMs Meet Place Recognition
par: Lyu, Zonglin, et autres
Publié: (2024)
par: Lyu, Zonglin, et autres
Publié: (2024)
Adaptive Covariance and Quaternion-Focused Hybrid Error-State EKF/UKF for Visual-Inertial Odometry
par: Asil, Ufuk, et autres
Publié: (2025)
par: Asil, Ufuk, et autres
Publié: (2025)
A Data-Centric Revisit of Pre-Trained Vision Models for Robot Learning
par: Wen, Xin, et autres
Publié: (2025)
par: Wen, Xin, et autres
Publié: (2025)
Do You Know Where Your Camera Is? View-Invariant Policy Learning with Camera Conditioning
par: Jiang, Tianchong, et autres
Publié: (2025)
par: Jiang, Tianchong, et autres
Publié: (2025)
Learning Where to Look: Self-supervised Viewpoint Selection for Active Localization using Geometrical Information
par: Di Giammarino, Luca, et autres
Publié: (2024)
par: Di Giammarino, Luca, et autres
Publié: (2024)
Stem-OB: Generalizable Visual Imitation Learning with Stem-Like Convergent Observation through Diffusion Inversion
par: Hu, Kaizhe, et autres
Publié: (2024)
par: Hu, Kaizhe, et autres
Publié: (2024)
PerlAD: Towards Enhanced Closed-loop End-to-end Autonomous Driving with Pseudo-simulation-based Reinforcement Learning
par: Gao, Yinfeng, et autres
Publié: (2026)
par: Gao, Yinfeng, et autres
Publié: (2026)
PAS-SLAM: A Visual SLAM System for Planar Ambiguous Scenes
par: Hu, Xinggang, et autres
Publié: (2024)
par: Hu, Xinggang, et autres
Publié: (2024)
StaMo: Unsupervised Learning of Generalizable Robot Motion from Compact State Representation
par: Liu, Mingyu, et autres
Publié: (2025)
par: Liu, Mingyu, et autres
Publié: (2025)
MacTok: Robust Continuous Tokenization for Image Generation
par: Zeng, Hengyu, et autres
Publié: (2026)
par: Zeng, Hengyu, et autres
Publié: (2026)
DINO-CVA: A Multimodal Goal-Conditioned Vision-to-Action Model for Autonomous Catheter Navigation
par: Fekri, Pedram, et autres
Publié: (2025)
par: Fekri, Pedram, et autres
Publié: (2025)
LocPoseNet: Robust Location Prior for Unseen Object Pose Estimation
par: Zhao, Chen, et autres
Publié: (2022)
par: Zhao, Chen, et autres
Publié: (2022)
Semi-distributed Cross-modal Air-Ground Relative Localization
par: Lu, Weining, et autres
Publié: (2025)
par: Lu, Weining, et autres
Publié: (2025)
Documents similaires
-
PAPL-SLAM: Principal Axis-Anchored Monocular Point-Line SLAM
par: Li, Guanghao, et autres
Publié: (2024) -
DINO-VO: A Feature-based Visual Odometry Leveraging a Visual Foundation Model
par: Azhari, Maulana Bisyir, et autres
Publié: (2025) -
DINO-SD: Champion Solution for ICRA 2024 RoboDepth Challenge
par: Mao, Yifan, et autres
Publié: (2024) -
FastOcc: Accelerating 3D Occupancy Prediction by Fusing the 2D Bird's-Eye View and Perspective View
par: Hou, Jiawei, et autres
Publié: (2024) -
SMF-VO: Direct Ego-Motion Estimation via Sparse Motion Fields
par: Yang, Sangheon, et autres
Publié: (2025)