Salvato in:
| Autori principali: | Lin, Chun-Jung, Chin, Tat-Jun, Garg, Sourav, Dayoub, Feras |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2511.15153 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Robust Scene Change Detection Using Visual Foundation Models and Cross-Attention Mechanisms
di: Lin, Chun-Jung, et al.
Pubblicazione: (2024)
di: Lin, Chun-Jung, et al.
Pubblicazione: (2024)
To Ask or Not to Ask? Detecting Absence of Information in Vision and Language Navigation
di: Abraham, Savitha Sam, et al.
Pubblicazione: (2024)
di: Abraham, Savitha Sam, et al.
Pubblicazione: (2024)
Vision Foundation Models for Domain Generalisable Cross-View Localisation in Planetary Ground-Aerial Robotic Teams
di: Holden, Lachlan, et al.
Pubblicazione: (2026)
di: Holden, Lachlan, et al.
Pubblicazione: (2026)
RoboHop: Segment-based Topological Map Representation for Open-World Visual Navigation
di: Garg, Sourav, et al.
Pubblicazione: (2024)
di: Garg, Sourav, et al.
Pubblicazione: (2024)
TANGO: Traversability-Aware Navigation with Local Metric Control for Topological Goals
di: Podgorski, Stefan, et al.
Pubblicazione: (2025)
di: Podgorski, Stefan, et al.
Pubblicazione: (2025)
A Physical Agentic Loop for Language-Guided Grasping with Execution-State Monitoring
di: Wang, Wenze, et al.
Pubblicazione: (2026)
di: Wang, Wenze, et al.
Pubblicazione: (2026)
Temporal Attention for Cross-View Sequential Image Localization
di: Yuan, Dong, et al.
Pubblicazione: (2024)
di: Yuan, Dong, et al.
Pubblicazione: (2024)
Wasserstein Distance-based Expansion of Low-Density Latent Regions for Unknown Class Detection
di: Mallick, Prakash, et al.
Pubblicazione: (2024)
di: Mallick, Prakash, et al.
Pubblicazione: (2024)
Enhancing Embodied Object Detection through Language-Image Pre-training and Implicit Object Memory
di: Chapman, Nicolas Harvey, et al.
Pubblicazione: (2024)
di: Chapman, Nicolas Harvey, et al.
Pubblicazione: (2024)
Detecting Precise Hand Touch Moments in Egocentric Video
di: Nguyen, Huy Anh, et al.
Pubblicazione: (2026)
di: Nguyen, Huy Anh, et al.
Pubblicazione: (2026)
Embodied Domain Adaptation for Object Detection
di: Shi, Xiangyu, et al.
Pubblicazione: (2025)
di: Shi, Xiangyu, et al.
Pubblicazione: (2025)
ObjectReact: Learning Object-Relative Control for Visual Navigation
di: Garg, Sourav, et al.
Pubblicazione: (2025)
di: Garg, Sourav, et al.
Pubblicazione: (2025)
PoIFusion: Multi-Modal 3D Object Detection via Fusion at Points of Interest
di: Deng, Jiajun, et al.
Pubblicazione: (2024)
di: Deng, Jiajun, et al.
Pubblicazione: (2024)
AIMC-Spec: A Benchmark Dataset for Automatic Intrapulse Modulation Classification under Variable Noise Conditions
di: Cocks, Sebastian L., et al.
Pubblicazione: (2026)
di: Cocks, Sebastian L., et al.
Pubblicazione: (2026)
KITE: Keyframe-Indexed Tokenized Evidence for VLM-Based Robot Failure Analysis
di: Hosseinzadeh, Mehdi, et al.
Pubblicazione: (2026)
di: Hosseinzadeh, Mehdi, et al.
Pubblicazione: (2026)
ExelMap: Explainable Element-based HD-Map Change Detection and Update
di: Wild, Lena, et al.
Pubblicazione: (2024)
di: Wild, Lena, et al.
Pubblicazione: (2024)
Improving Online Source-free Domain Adaptation for Object Detection by Unsupervised Data Acquisition
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)
QueryAdapter: Rapid Adaptation of Vision-Language Models in Response to Natural Language Queries
di: Chapman, Nicolas Harvey, et al.
Pubblicazione: (2025)
di: Chapman, Nicolas Harvey, et al.
Pubblicazione: (2025)
AARK: An Open Toolkit for Autonomous Racing Research
di: Bockman, James, et al.
Pubblicazione: (2024)
di: Bockman, James, et al.
Pubblicazione: (2024)
Physically Embodied Gaussian Splatting: A Realtime Correctable World Model for Robotics
di: Abou-Chakra, Jad, et al.
Pubblicazione: (2024)
di: Abou-Chakra, Jad, et al.
Pubblicazione: (2024)
Segment Beyond View: Handling Partially Missing Modality for Audio-Visual Semantic Segmentation
di: Wu, Renjie, et al.
Pubblicazione: (2023)
di: Wu, Renjie, et al.
Pubblicazione: (2023)
3D-LLaVA: Towards Generalist 3D LMMs with Omni Superpoint Transformer
di: Deng, Jiajun, et al.
Pubblicazione: (2025)
di: Deng, Jiajun, et al.
Pubblicazione: (2025)
Finding Outliers in a Haystack: Anomaly Detection for Large Pointcloud Scenes
di: Faulkner, Ryan, et al.
Pubblicazione: (2025)
di: Faulkner, Ryan, et al.
Pubblicazione: (2025)
LangMap: A Human-Verified Benchmark for Hierarchical Open-Vocabulary Goal Navigation
di: Miao, Bo, et al.
Pubblicazione: (2026)
di: Miao, Bo, et al.
Pubblicazione: (2026)
QueSTMaps: Queryable Semantic Topological Maps for 3D Scene Understanding
di: Mehan, Yash, et al.
Pubblicazione: (2024)
di: Mehan, Yash, et al.
Pubblicazione: (2024)
Uncertainty-Guided Edge Learning for Deep Image Regression in Remote Sensing
di: Nguyen, Anh Vu, et al.
Pubblicazione: (2026)
di: Nguyen, Anh Vu, et al.
Pubblicazione: (2026)
Camera-Pose Robust Crater Detection from Chang'e 5
di: Rodda, Matthew, et al.
Pubblicazione: (2024)
di: Rodda, Matthew, et al.
Pubblicazione: (2024)
StyleCity: Large-Scale 3D Urban Scenes Stylization
di: Chen, Yingshu, et al.
Pubblicazione: (2024)
di: Chen, Yingshu, et al.
Pubblicazione: (2024)
Hybrid Navigation Acceptability and Safety
di: Clement, Benoit, et al.
Pubblicazione: (2024)
di: Clement, Benoit, et al.
Pubblicazione: (2024)
CTRL-D: Controllable Dynamic 3D Scene Editing with Personalized 2D Diffusion
di: He, Kai, et al.
Pubblicazione: (2024)
di: He, Kai, et al.
Pubblicazione: (2024)
SmartWay: Enhanced Waypoint Prediction and Backtracking for Zero-Shot Vision-and-Language Navigation
di: Shi, Xiangyu, et al.
Pubblicazione: (2025)
di: Shi, Xiangyu, et al.
Pubblicazione: (2025)
City-Mesh3R: Simulation-Ready City-Scale 3D Mesh Reconstruction from Multi-View Images
di: Paul, Sayan, et al.
Pubblicazione: (2026)
di: Paul, Sayan, et al.
Pubblicazione: (2026)
Improved 3D Scene Stylization via Text-Guided Generative Image Editing with Region-Based Control
di: Fujiwara, Haruo, et al.
Pubblicazione: (2025)
di: Fujiwara, Haruo, et al.
Pubblicazione: (2025)
Revisit Anything: Visual Place Recognition via Image Segment Retrieval
di: Garg, Kartik, et al.
Pubblicazione: (2024)
di: Garg, Kartik, et al.
Pubblicazione: (2024)
LUSD: Localized Update Score Distillation for Text-Guided Image Editing
di: Chinchuthakun, Worameth, et al.
Pubblicazione: (2025)
di: Chinchuthakun, Worameth, et al.
Pubblicazione: (2025)
CodeUpdateArena: Benchmarking Knowledge Editing on API Updates
di: Liu, Zeyu Leo, et al.
Pubblicazione: (2024)
di: Liu, Zeyu Leo, et al.
Pubblicazione: (2024)
Predictive and adaptive maps for long-term visual navigation in changing environments
di: Halodova, Lucie, et al.
Pubblicazione: (2026)
di: Halodova, Lucie, et al.
Pubblicazione: (2026)
LiDAR-based 3D Change Detection at City Scale
di: Albagami, Hezam, et al.
Pubblicazione: (2025)
di: Albagami, Hezam, et al.
Pubblicazione: (2025)
Geometry-Guided Reinforcement Learning for Multi-view Consistent 3D Scene Editing
di: Wang, Jiyuan, et al.
Pubblicazione: (2026)
di: Wang, Jiyuan, et al.
Pubblicazione: (2026)
AI-Enabled Crater-Based Navigation for Lunar Mapping
di: McLeod, Sofia, et al.
Pubblicazione: (2025)
di: McLeod, Sofia, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Robust Scene Change Detection Using Visual Foundation Models and Cross-Attention Mechanisms
di: Lin, Chun-Jung, et al.
Pubblicazione: (2024) -
To Ask or Not to Ask? Detecting Absence of Information in Vision and Language Navigation
di: Abraham, Savitha Sam, et al.
Pubblicazione: (2024) -
Vision Foundation Models for Domain Generalisable Cross-View Localisation in Planetary Ground-Aerial Robotic Teams
di: Holden, Lachlan, et al.
Pubblicazione: (2026) -
RoboHop: Segment-based Topological Map Representation for Open-World Visual Navigation
di: Garg, Sourav, et al.
Pubblicazione: (2024) -
TANGO: Traversability-Aware Navigation with Local Metric Control for Topological Goals
di: Podgorski, Stefan, et al.
Pubblicazione: (2025)