Salvato in:
| Autori principali: | Miao, Bo, Liu, Weijia, Luo, Jun, Shinnick, Lachlan, Liu, Jian, Hamilton-Smith, Thomas, Yang, Yuhe, Wu, Zijie, Videnovic, Vanja, Dayoub, Feras, Hengel, Anton van den |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.02220 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TANGO: Traversability-Aware Navigation with Local Metric Control for Topological Goals
di: Podgorski, Stefan, et al.
Pubblicazione: (2025)
di: Podgorski, Stefan, et al.
Pubblicazione: (2025)
RoboHop: Segment-based Topological Map Representation for Open-World Visual Navigation
di: Garg, Sourav, et al.
Pubblicazione: (2024)
di: Garg, Sourav, et al.
Pubblicazione: (2024)
Procedural Pretraining: Warming Up Language Models with Abstract Data
di: Jiang, Liangze, et al.
Pubblicazione: (2026)
di: Jiang, Liangze, et al.
Pubblicazione: (2026)
Can You Learn to See Without Images? Procedural Warm-Up for Vision Transformers
di: Shinnick, Zachary, et al.
Pubblicazione: (2025)
di: Shinnick, Zachary, et al.
Pubblicazione: (2025)
Transformers Pretrained on Procedural Data Contain Modular Structures for Algorithmic Reasoning
di: Shinnick, Zachary, et al.
Pubblicazione: (2025)
di: Shinnick, Zachary, et al.
Pubblicazione: (2025)
To Ask or Not to Ask? Detecting Absence of Information in Vision and Language Navigation
di: Abraham, Savitha Sam, et al.
Pubblicazione: (2024)
di: Abraham, Savitha Sam, et al.
Pubblicazione: (2024)
AARK: An Open Toolkit for Autonomous Racing Research
di: Bockman, James, et al.
Pubblicazione: (2024)
di: Bockman, James, et al.
Pubblicazione: (2024)
ObjectReact: Learning Object-Relative Control for Visual Navigation
di: Garg, Sourav, et al.
Pubblicazione: (2025)
di: Garg, Sourav, et al.
Pubblicazione: (2025)
LangHOPS: Language Grounded Hierarchical Open-Vocabulary Part Segmentation
di: Miao, Yang, et al.
Pubblicazione: (2025)
di: Miao, Yang, et al.
Pubblicazione: (2025)
SceneEdited: A City-Scale Benchmark for 3D HD Map Updating via Image-Guided Change Detection
di: Lin, Chun-Jung, et al.
Pubblicazione: (2025)
di: Lin, Chun-Jung, et al.
Pubblicazione: (2025)
Vision Foundation Models for Domain Generalisable Cross-View Localisation in Planetary Ground-Aerial Robotic Teams
di: Holden, Lachlan, et al.
Pubblicazione: (2026)
di: Holden, Lachlan, et al.
Pubblicazione: (2026)
Embodied Domain Adaptation for Object Detection
di: Shi, Xiangyu, et al.
Pubblicazione: (2025)
di: Shi, Xiangyu, et al.
Pubblicazione: (2025)
Temporal Attention for Cross-View Sequential Image Localization
di: Yuan, Dong, et al.
Pubblicazione: (2024)
di: Yuan, Dong, et al.
Pubblicazione: (2024)
A Physical Agentic Loop for Language-Guided Grasping with Execution-State Monitoring
di: Wang, Wenze, et al.
Pubblicazione: (2026)
di: Wang, Wenze, et al.
Pubblicazione: (2026)
Wasserstein Distance-based Expansion of Low-Density Latent Regions for Unknown Class Detection
di: Mallick, Prakash, et al.
Pubblicazione: (2024)
di: Mallick, Prakash, et al.
Pubblicazione: (2024)
AIMC-Spec: A Benchmark Dataset for Automatic Intrapulse Modulation Classification under Variable Noise Conditions
di: Cocks, Sebastian L., et al.
Pubblicazione: (2026)
di: Cocks, Sebastian L., et al.
Pubblicazione: (2026)
Hybrid Navigation Acceptability and Safety
di: Clement, Benoit, et al.
Pubblicazione: (2024)
di: Clement, Benoit, et al.
Pubblicazione: (2024)
KITE: Keyframe-Indexed Tokenized Evidence for VLM-Based Robot Failure Analysis
di: Hosseinzadeh, Mehdi, et al.
Pubblicazione: (2026)
di: Hosseinzadeh, Mehdi, et al.
Pubblicazione: (2026)
Detecting Precise Hand Touch Moments in Egocentric Video
di: Nguyen, Huy Anh, et al.
Pubblicazione: (2026)
di: Nguyen, Huy Anh, et al.
Pubblicazione: (2026)
OVAL: Open-Vocabulary Augmented Memory Model for Lifelong Object Goal Navigation
di: Pei, Jiahua, et al.
Pubblicazione: (2026)
di: Pei, Jiahua, et al.
Pubblicazione: (2026)
Improving Online Source-free Domain Adaptation for Object Detection by Unsupervised Data Acquisition
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)
QueryAdapter: Rapid Adaptation of Vision-Language Models in Response to Natural Language Queries
di: Chapman, Nicolas Harvey, et al.
Pubblicazione: (2025)
di: Chapman, Nicolas Harvey, et al.
Pubblicazione: (2025)
Enhancing Embodied Object Detection through Language-Image Pre-training and Implicit Object Memory
di: Chapman, Nicolas Harvey, et al.
Pubblicazione: (2024)
di: Chapman, Nicolas Harvey, et al.
Pubblicazione: (2024)
HM3D-OVON: A Dataset and Benchmark for Open-Vocabulary Object Goal Navigation
di: Yokoyama, Naoki, et al.
Pubblicazione: (2024)
di: Yokoyama, Naoki, et al.
Pubblicazione: (2024)
SmartWay: Enhanced Waypoint Prediction and Backtracking for Zero-Shot Vision-and-Language Navigation
di: Shi, Xiangyu, et al.
Pubblicazione: (2025)
di: Shi, Xiangyu, et al.
Pubblicazione: (2025)
Physically Embodied Gaussian Splatting: A Realtime Correctable World Model for Robotics
di: Abou-Chakra, Jad, et al.
Pubblicazione: (2024)
di: Abou-Chakra, Jad, et al.
Pubblicazione: (2024)
Segment Beyond View: Handling Partially Missing Modality for Audio-Visual Semantic Segmentation
di: Wu, Renjie, et al.
Pubblicazione: (2023)
di: Wu, Renjie, et al.
Pubblicazione: (2023)
OVSegDT: Segmenting Transformer for Open-Vocabulary Object Goal Navigation
di: Zemskova, Tatiana, et al.
Pubblicazione: (2025)
di: Zemskova, Tatiana, et al.
Pubblicazione: (2025)
Grounded Vision-Language Navigation for UAVs with Open-Vocabulary Goal Understanding
di: Zhang, Yuhang, et al.
Pubblicazione: (2025)
di: Zhang, Yuhang, et al.
Pubblicazione: (2025)
Uncertainty-Informed Active Perception for Open Vocabulary Object Goal Navigation
di: Bajpai, Utkarsh, et al.
Pubblicazione: (2025)
di: Bajpai, Utkarsh, et al.
Pubblicazione: (2025)
Points-to-3D: Structure-Aware 3D Generation with Point Cloud Priors
di: Xia, Jiatong, et al.
Pubblicazione: (2026)
di: Xia, Jiatong, et al.
Pubblicazione: (2026)
Robust Scene Change Detection Using Visual Foundation Models and Cross-Attention Mechanisms
di: Lin, Chun-Jung, et al.
Pubblicazione: (2024)
di: Lin, Chun-Jung, et al.
Pubblicazione: (2024)
GoalSwarm: Multi-UAV Semantic Coordination for Open-Vocabulary Object Navigation
di: James, MoniJesu Wonders, et al.
Pubblicazione: (2026)
di: James, MoniJesu Wonders, et al.
Pubblicazione: (2026)
Hierarchical Process Reward Models are Symbolic Vision Learners
di: Zhang, Shan, et al.
Pubblicazione: (2025)
di: Zhang, Shan, et al.
Pubblicazione: (2025)
Query-Based Knowledge Sharing for Open-Vocabulary Multi-Label Classification
di: Zhu, Xuelin, et al.
Pubblicazione: (2024)
di: Zhu, Xuelin, et al.
Pubblicazione: (2024)
UAV-ON: A Benchmark for Open-World Object Goal Navigation with Aerial Agents
di: Xiao, Jianqiang, et al.
Pubblicazione: (2025)
di: Xiao, Jianqiang, et al.
Pubblicazione: (2025)
Let Your Video Listen to Your Music!
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
MuseBarControl: Enhancing Fine-Grained Control in Symbolic Music Generation through Pre-Training and Counterfactual Loss
di: Shu, Yangyang, et al.
Pubblicazione: (2024)
di: Shu, Yangyang, et al.
Pubblicazione: (2024)
Scaling up Multi-domain Semantic Segmentation with Sentence Embeddings
di: Yin, Wei, et al.
Pubblicazione: (2022)
di: Yin, Wei, et al.
Pubblicazione: (2022)
VLNVerse: A Benchmark for Vision-Language Navigation with Versatile, Embodied, Realistic Simulation and Evaluation
di: Lin, Sihao, et al.
Pubblicazione: (2025)
di: Lin, Sihao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TANGO: Traversability-Aware Navigation with Local Metric Control for Topological Goals
di: Podgorski, Stefan, et al.
Pubblicazione: (2025) -
RoboHop: Segment-based Topological Map Representation for Open-World Visual Navigation
di: Garg, Sourav, et al.
Pubblicazione: (2024) -
Procedural Pretraining: Warming Up Language Models with Abstract Data
di: Jiang, Liangze, et al.
Pubblicazione: (2026) -
Can You Learn to See Without Images? Procedural Warm-Up for Vision Transformers
di: Shinnick, Zachary, et al.
Pubblicazione: (2025) -
Transformers Pretrained on Procedural Data Contain Modular Structures for Algorithmic Reasoning
di: Shinnick, Zachary, et al.
Pubblicazione: (2025)