Advances in Global Solvers for 3D Vision
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Zhenjun, Yang, Heng, Liao, Bangyan, Zeng, Yingping, Yan, Shaocheng, Gu, Yingdong, Liu, Peidong, Zhou, Yi, Li, Haoang, Civera, Javier |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Neural Predictor-Corrector: Solving Homotopy Problems with Reinforcement Learning
par: Mai, Jiayao, et autres
Publié: (2026)
par: Mai, Jiayao, et autres
Publié: (2026)
Convex Relaxation for Robust Vanishing Point Estimation in Manhattan World
par: Liao, Bangyan, et autres
Publié: (2025)
par: Liao, Bangyan, et autres
Publié: (2025)
GlobalPointer: Large-Scale Plane Adjustment with Bi-Convex Relaxation
par: Liao, Bangyan, et autres
Publié: (2024)
par: Liao, Bangyan, et autres
Publié: (2024)
Dream-SLAM: Dreaming the Unseen for Active SLAM in Dynamic Environments
par: Meng, Xiangqi, et autres
Publié: (2026)
par: Meng, Xiangqi, et autres
Publié: (2026)
ES-Gaussian: Gaussian Splatting Mapping via Error Space-Based Gaussian Completion
par: Chen, Lu, et autres
Publié: (2024)
par: Chen, Lu, et autres
Publié: (2024)
ULF-Loc: Unbiased Landmark Feature for Robust Visual Localization with 3D Gaussian Splatting
par: Gu, Yingdong, et autres
Publié: (2026)
par: Gu, Yingdong, et autres
Publié: (2026)
P$^{3}$Nav: End-to-End Perception, Prediction and Planning for Vision-and-Language Navigation
par: Li, Tianfu, et autres
Publié: (2026)
par: Li, Tianfu, et autres
Publié: (2026)
SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation
par: Huang, Jingzhi, et autres
Publié: (2026)
par: Huang, Jingzhi, et autres
Publié: (2026)
Spatial Forcing: Implicit Spatial Representation Alignment for Vision-language-action Model
par: Li, Fuhao, et autres
Publié: (2025)
par: Li, Fuhao, et autres
Publié: (2025)
EvTTC: An Event Camera Dataset for Time-to-Collision Estimation
par: Sun, Kaizhen, et autres
Publié: (2024)
par: Sun, Kaizhen, et autres
Publié: (2024)
OneTwoVLA: A Unified Vision-Language-Action Model with Adaptive Reasoning
par: Lin, Fanqi, et autres
Publié: (2025)
par: Lin, Fanqi, et autres
Publié: (2025)
VLA-OPD: Bridging Offline SFT and Online RL for Vision-Language-Action Models via On-Policy Distillation
par: Zhong, Zhide, et autres
Publié: (2026)
par: Zhong, Zhide, et autres
Publié: (2026)
DefVINS: Visual-Inertial Odometry for Deformable Scenes
par: Cerezo, Samuel, et autres
Publié: (2026)
par: Cerezo, Samuel, et autres
Publié: (2026)
VMTS: Vision-Assisted Teacher-Student Reinforcement Learning for Multi-Terrain Locomotion in Bipedal Robots
par: Chen, Fu, et autres
Publié: (2025)
par: Chen, Fu, et autres
Publié: (2025)
An Efficient Closed-Form Solution to Full Visual-Inertial State Initialization
par: Cerezo, Samuel, et autres
Publié: (2025)
par: Cerezo, Samuel, et autres
Publié: (2025)
CEED-VLA: Consistency Vision-Language-Action Model with Early-Exit Decoding
par: Song, Wenxuan, et autres
Publié: (2025)
par: Song, Wenxuan, et autres
Publié: (2025)
SEIDM: A Safe and Efficient Intelligent Driver Model for Autonomous Driving Behavior
par: Yao, Yuyang, et autres
Publié: (2026)
par: Yao, Yuyang, et autres
Publié: (2026)
Robust Single Rotation Averaging Revisited
par: Lee, Seong Hun, et autres
Publié: (2023)
par: Lee, Seong Hun, et autres
Publié: (2023)
What's Wrong with the Absolute Trajectory Error?
par: Lee, Seong Hun, et autres
Publié: (2022)
par: Lee, Seong Hun, et autres
Publié: (2022)
Alignment Scores: Robust Metrics for Multiview Pose Accuracy Evaluation
par: Lee, Seong Hun, et autres
Publié: (2024)
par: Lee, Seong Hun, et autres
Publié: (2024)
OmniDP: Beyond-FOV Large-Workspace Humanoid Manipulation with Omnidirectional 3D Perception
par: Qu, Pei, et autres
Publié: (2026)
par: Qu, Pei, et autres
Publié: (2026)
RANSAC Back to SOTA: A Two-stage Consensus Filtering for Real-time 3D Registration
par: Shi, Pengcheng, et autres
Publié: (2024)
par: Shi, Pengcheng, et autres
Publié: (2024)
DyGeoVLN: Infusing Dynamic Geometry Foundation Model into Vision-Language Navigation
par: Liu, Xiangchen, et autres
Publié: (2026)
par: Liu, Xiangchen, et autres
Publié: (2026)
Rheos: Modelling Continuous Motion Dynamics in Hierarchical 3D Scene Graphs
par: Catalano, Iacopo, et autres
Publié: (2026)
par: Catalano, Iacopo, et autres
Publié: (2026)
Addressing the challenges of loop detection in agricultural environments
par: Soncini, Nicolás, et autres
Publié: (2024)
par: Soncini, Nicolás, et autres
Publié: (2024)
HCSG: Human-Centric Semantic-Geometric Reasoning for Vision-Language Navigation
par: Xu, Haoxuan, et autres
Publié: (2026)
par: Xu, Haoxuan, et autres
Publié: (2026)
ReconVLA: Reconstructive Vision-Language-Action Model as Effective Robot Perceiver
par: Song, Wenxuan, et autres
Publié: (2025)
par: Song, Wenxuan, et autres
Publié: (2025)
Unifying Local and Global Multimodal Features for Place Recognition in Aliased and Low-Texture Environments
par: García-Hernández, Alberto, et autres
Publié: (2024)
par: García-Hernández, Alberto, et autres
Publié: (2024)
FRAPPE: Infusing World Modeling into Generalist Policies via Multiple Future Representation Alignment
par: Zhao, Han, et autres
Publié: (2026)
par: Zhao, Han, et autres
Publié: (2026)
CapVector: Learning Transferable Capability Vectors in Parametric Space for Vision-Language-Action Models
par: Song, Wenxuan, et autres
Publié: (2026)
par: Song, Wenxuan, et autres
Publié: (2026)
Unified Diffusion VLA: Vision-Language-Action Model via Joint Discrete Denoising Diffusion Process
par: Chen, Jiayi, et autres
Publié: (2025)
par: Chen, Jiayi, et autres
Publié: (2025)
AERR-Nav: Adaptive Exploration-Recovery-Reminiscing Strategy for Zero-Shot Object Navigation
par: Huang, Jingzhi, et autres
Publié: (2026)
par: Huang, Jingzhi, et autres
Publié: (2026)
PCR-99: A Practical Method for Point Cloud Registration with 99 Percent Outliers
par: Lee, Seong Hun, et autres
Publié: (2024)
par: Lee, Seong Hun, et autres
Publié: (2024)
Enhancing Vision-Language Navigation with Multimodal Event Knowledge from Real-World Indoor Tour Videos
par: Xu, Haoxuan, et autres
Publié: (2026)
par: Xu, Haoxuan, et autres
Publié: (2026)
Efficient Feature-Free Initialization for Monocular Visual-Inertial Systems Using a Feed-Forward 3D Model
par: Zhang, Yuantai, et autres
Publié: (2026)
par: Zhang, Yuantai, et autres
Publié: (2026)
Rethinking the Practicality of Vision-language-action Model: A Comprehensive Benchmark and An Improved Baseline
par: Song, Wenxuan, et autres
Publié: (2026)
par: Song, Wenxuan, et autres
Publié: (2026)
FlowVLA: Visual Chain of Thought-based Motion Reasoning for Vision-Language-Action Models
par: Zhong, Zhide, et autres
Publié: (2025)
par: Zhong, Zhide, et autres
Publié: (2025)
Aion: Towards Hierarchical 4D Scene Graphs with Temporal Flow Dynamics
par: Catalano, Iacopo, et autres
Publié: (2025)
par: Catalano, Iacopo, et autres
Publié: (2025)
Open-Vocabulary Online Semantic Mapping for SLAM
par: Martins, Tomas Berriel, et autres
Publié: (2024)
par: Martins, Tomas Berriel, et autres
Publié: (2024)
Look Ma, No Ground Truth! Ground-Truth-Free Tuning of Structure from Motion and Visual SLAM
par: Fontan, Alejandro, et autres
Publié: (2024)
par: Fontan, Alejandro, et autres
Publié: (2024)
Documents similaires
-
Neural Predictor-Corrector: Solving Homotopy Problems with Reinforcement Learning
par: Mai, Jiayao, et autres
Publié: (2026) -
Convex Relaxation for Robust Vanishing Point Estimation in Manhattan World
par: Liao, Bangyan, et autres
Publié: (2025) -
GlobalPointer: Large-Scale Plane Adjustment with Bi-Convex Relaxation
par: Liao, Bangyan, et autres
Publié: (2024) -
Dream-SLAM: Dreaming the Unseen for Active SLAM in Dynamic Environments
par: Meng, Xiangqi, et autres
Publié: (2026) -
ES-Gaussian: Gaussian Splatting Mapping via Error Space-Based Gaussian Completion
par: Chen, Lu, et autres
Publié: (2024)