REGNav: Room Expert Guided Image-Goal Navigation
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Pengna, Wu, Kangyi, Fu, Jingwen, Zhou, Sanping |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Mind the Gap: Aligning Vision Foundation Models to Image Feature Matching
por: Liu, Yuhan, et al.
Publicado: (2025)
por: Liu, Yuhan, et al.
Publicado: (2025)
Camera-aware Label Refinement for Unsupervised Person Re-identification
por: Li, Pengna, et al.
Publicado: (2024)
por: Li, Pengna, et al.
Publicado: (2024)
RSRNav: Reasoning Spatial Relationship for Image-Goal Navigation
por: Qin, Zheng, et al.
Publicado: (2025)
por: Qin, Zheng, et al.
Publicado: (2025)
Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
por: Wu, Kangyi, et al.
Publicado: (2026)
por: Wu, Kangyi, et al.
Publicado: (2026)
SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation
por: Li, Pengna, et al.
Publicado: (2026)
por: Li, Pengna, et al.
Publicado: (2026)
DAMap: Distance-aware MapNet for High Quality HD Map Construction
por: Dong, Jinpeng, et al.
Publicado: (2025)
por: Dong, Jinpeng, et al.
Publicado: (2025)
StructVPR++: Distill Structural and Semantic Knowledge with Weighting Samples for Visual Place Recognition
por: Shen, Yanqing, et al.
Publicado: (2025)
por: Shen, Yanqing, et al.
Publicado: (2025)
HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System
por: Lyu, Kailin, et al.
Publicado: (2026)
por: Lyu, Kailin, et al.
Publicado: (2026)
Instance-aware Exploration-Verification-Exploitation for Instance ImageGoal Navigation
por: Lei, Xiaohan, et al.
Publicado: (2024)
por: Lei, Xiaohan, et al.
Publicado: (2024)
Instruction-as-State: Environment-Guided and State-Conditioned Semantic Understanding for Embodied Navigation
por: Liu, Zhen, et al.
Publicado: (2026)
por: Liu, Zhen, et al.
Publicado: (2026)
PMT: Progressive Mean Teacher via Exploring Temporal Consistency for Semi-Supervised Medical Image Segmentation
por: Gao, Ning, et al.
Publicado: (2024)
por: Gao, Ning, et al.
Publicado: (2024)
PR-DETR: Injecting Position and Relation Prior for Dense Video Captioning
por: Li, Yizhe, et al.
Publicado: (2025)
por: Li, Yizhe, et al.
Publicado: (2025)
PIG-Nav: Key Insights for Pretrained Image Goal Navigation Models
por: Wan, Jiansong, et al.
Publicado: (2025)
por: Wan, Jiansong, et al.
Publicado: (2025)
Learning Goal-Oriented Vision-and-Language Navigation with Self-Improving Demonstrations at Scale
por: Li, Songze, et al.
Publicado: (2025)
por: Li, Songze, et al.
Publicado: (2025)
Diversifying Query: Region-Guided Transformer for Temporal Sentence Grounding
por: Sun, Xiaolong, et al.
Publicado: (2024)
por: Sun, Xiaolong, et al.
Publicado: (2024)
UniGoal: Towards Universal Zero-shot Goal-oriented Navigation
por: Yin, Hang, et al.
Publicado: (2025)
por: Yin, Hang, et al.
Publicado: (2025)
Towards Generalizable Multi-Object Tracking
por: Qin, Zheng, et al.
Publicado: (2024)
por: Qin, Zheng, et al.
Publicado: (2024)
LayoutRAG: Retrieval-Augmented Model for Content-agnostic Conditional Layout Generation
por: Wu, Yuxuan, et al.
Publicado: (2025)
por: Wu, Yuxuan, et al.
Publicado: (2025)
Action Hints: Semantic Typicality and Context Uniqueness for Generalizable Skeleton-based Video Anomaly Detection
por: Tang, Canhui, et al.
Publicado: (2025)
por: Tang, Canhui, et al.
Publicado: (2025)
Advancing Pre-trained Teacher: Towards Robust Feature Discrepancy for Anomaly Detection
por: Tang, Canhui, et al.
Publicado: (2024)
por: Tang, Canhui, et al.
Publicado: (2024)
DiffusionAgent: Navigating Expert Models for Agentic Image Generation
por: Qin, Jie, et al.
Publicado: (2024)
por: Qin, Jie, et al.
Publicado: (2024)
Goal2Pixel: Grounding Goals to Pixels for Vision-Language Navigation
por: Bao, Muyi, et al.
Publicado: (2026)
por: Bao, Muyi, et al.
Publicado: (2026)
LiteVLoc: Map-Lite Visual Localization for Image Goal Navigation
por: Jiao, Jianhao, et al.
Publicado: (2024)
por: Jiao, Jianhao, et al.
Publicado: (2024)
SegMoTE: Token-Level Mixture of Experts for Medical Image Segmentation
por: Lu, Yujie, et al.
Publicado: (2026)
por: Lu, Yujie, et al.
Publicado: (2026)
The Essence of Balance for Self-Improving Agents in Vision-and-Language Navigation
por: Liu, Zhen, et al.
Publicado: (2026)
por: Liu, Zhen, et al.
Publicado: (2026)
From Mapping to Composing: A Two-Stage Framework for Zero-shot Composed Image Retrieval
por: Wang, Yabing, et al.
Publicado: (2025)
por: Wang, Yabing, et al.
Publicado: (2025)
DR.Experts: Differential Refinement of Distortion-Aware Experts for Blind Image Quality Assessment
por: Fu, Bohan, et al.
Publicado: (2026)
por: Fu, Bohan, et al.
Publicado: (2026)
Hierarchical Scoring with 3D Gaussian Splatting for Instance Image-Goal Navigation
por: Deng, Yijie, et al.
Publicado: (2025)
por: Deng, Yijie, et al.
Publicado: (2025)
AnyImageNav: Any-View Geometry for Precise Last-Meter Image-Goal Navigation
por: Deng, Yijie, et al.
Publicado: (2026)
por: Deng, Yijie, et al.
Publicado: (2026)
UniLayDiff: A Unified Diffusion Transformer for Content-Aware Layout Generation
por: Liu, Zeyang, et al.
Publicado: (2025)
por: Liu, Zeyang, et al.
Publicado: (2025)
Labeled-to-Unlabeled Distribution Alignment for Partially-Supervised Multi-Organ Medical Image Segmentation
por: Jiang, Xixi, et al.
Publicado: (2024)
por: Jiang, Xixi, et al.
Publicado: (2024)
uLayout: Unified Room Layout Estimation for Perspective and Panoramic Images
por: Lee, Jonathan, et al.
Publicado: (2025)
por: Lee, Jonathan, et al.
Publicado: (2025)
FreqGRL: Suppressing Low-Frequency Bias and Mining High-Frequency Knowledge for Cross-Domain Few-Shot Learning
por: Hui, Siqi, et al.
Publicado: (2025)
por: Hui, Siqi, et al.
Publicado: (2025)
Voxel or Pillar: Exploring Efficient Point Cloud Representation for 3D Object Detection
por: Huang, Yuhao, et al.
Publicado: (2023)
por: Huang, Yuhao, et al.
Publicado: (2023)
Boosting Semi-Supervised Temporal Action Localization by Learning from Non-Target Classes
por: Xia, Kun, et al.
Publicado: (2024)
por: Xia, Kun, et al.
Publicado: (2024)
Enhancing Mamba Decoder with Bidirectional Interaction in Multi-Task Dense Prediction
por: Cao, Mang, et al.
Publicado: (2025)
por: Cao, Mang, et al.
Publicado: (2025)
Distilling LLM Prior to Flow Model for Generalizable Agent's Imagination in Object Goal Navigation
por: Li, Badi, et al.
Publicado: (2025)
por: Li, Badi, et al.
Publicado: (2025)
Statistical Characteristic-Guided Denoising for Rapid High-Resolution Transmission Electron Microscopy Imaging
por: Li, Hesong, et al.
Publicado: (2026)
por: Li, Hesong, et al.
Publicado: (2026)
WorldMesh: Generating Navigable Multi-Room 3D Scenes via Mesh-Conditioned Image Diffusion
por: Schneider, Manuel-Andreas, et al.
Publicado: (2026)
por: Schneider, Manuel-Andreas, et al.
Publicado: (2026)
FreqPDE: Rethinking Positional Depth Embedding for Multi-View 3D Object Detection Transformers
por: Su, Haisheng, et al.
Publicado: (2025)
por: Su, Haisheng, et al.
Publicado: (2025)
Ejemplares similares
-
Mind the Gap: Aligning Vision Foundation Models to Image Feature Matching
por: Liu, Yuhan, et al.
Publicado: (2025) -
Camera-aware Label Refinement for Unsupervised Person Re-identification
por: Li, Pengna, et al.
Publicado: (2024) -
RSRNav: Reasoning Spatial Relationship for Image-Goal Navigation
por: Qin, Zheng, et al.
Publicado: (2025) -
Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
por: Wu, Kangyi, et al.
Publicado: (2026) -
SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation
por: Li, Pengna, et al.
Publicado: (2026)