OctoNav: Towards Generalist Embodied Navigation
Fuente:
arXiv
Guardado en:
| Autores principales: | Gao, Chen, Jin, Liankai, Peng, Xingyu, Zhang, Jiazhao, Deng, Yue, Li, Annan, Wang, He, Liu, Si |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
VLingNav: Embodied Navigation with Adaptive Reasoning and Visual-Assisted Linguistic Memory
por: Wang, Shaoan, et al.
Publicado: (2026)
por: Wang, Shaoan, et al.
Publicado: (2026)
TopV-Nav: Unlocking the Top-View Spatial Reasoning Potential of MLLM for Zero-shot Object Navigation
por: Zhong, Linqing, et al.
Publicado: (2024)
por: Zhong, Linqing, et al.
Publicado: (2024)
SocialNav: Training Human-Inspired Foundation Model for Socially-Aware Embodied Navigation
por: Chen, Ziyi, et al.
Publicado: (2025)
por: Chen, Ziyi, et al.
Publicado: (2025)
Nav-R1: Reasoning and Navigation in Embodied Scenes
por: Liu, Qingxiang, et al.
Publicado: (2025)
por: Liu, Qingxiang, et al.
Publicado: (2025)
Vision-Language Navigation with Embodied Intelligence: A Survey
por: Gao, Peng, et al.
Publicado: (2024)
por: Gao, Peng, et al.
Publicado: (2024)
NavTrust: Benchmarking Trustworthiness for Embodied Navigation
por: Jiang, Huaide, et al.
Publicado: (2026)
por: Jiang, Huaide, et al.
Publicado: (2026)
MM-Nav: Multi-View VLA Model for Robust Visual Navigation via Multi-Expert Learning
por: Xu, Tianyu, et al.
Publicado: (2025)
por: Xu, Tianyu, et al.
Publicado: (2025)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
por: Liu, Youzhi, et al.
Publicado: (2024)
por: Liu, Youzhi, et al.
Publicado: (2024)
IndustryNav: Exploring Spatial Reasoning of Embodied Agents in Dynamic Industrial Navigation
por: Li, Yifan, et al.
Publicado: (2025)
por: Li, Yifan, et al.
Publicado: (2025)
MemoNav: Working Memory Model for Visual Navigation
por: Li, Hongxin, et al.
Publicado: (2024)
por: Li, Hongxin, et al.
Publicado: (2024)
Vidar: Embodied Video Diffusion Model for Generalist Manipulation
por: Feng, Yao, et al.
Publicado: (2025)
por: Feng, Yao, et al.
Publicado: (2025)
LangNav: Language as a Perceptual Representation for Navigation
por: Pan, Bowen, et al.
Publicado: (2023)
por: Pan, Bowen, et al.
Publicado: (2023)
Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks
por: Zhang, Jiazhao, et al.
Publicado: (2024)
por: Zhang, Jiazhao, et al.
Publicado: (2024)
TrackVLA++: Unleashing Reasoning and Memory Capabilities in VLA Models for Embodied Visual Tracking
por: Liu, Jiahang, et al.
Publicado: (2025)
por: Liu, Jiahang, et al.
Publicado: (2025)
Embodied Navigation at the Art Gallery
por: Bigazzi, Roberto, et al.
Publicado: (2022)
por: Bigazzi, Roberto, et al.
Publicado: (2022)
Towards Learning a Generalist Model for Embodied Navigation
por: Zheng, Duo, et al.
Publicado: (2023)
por: Zheng, Duo, et al.
Publicado: (2023)
BiCoord: A Bimanual Manipulation Benchmark towards Long-Horizon Spatial-Temporal Coordination
por: Peng, Xingyu, et al.
Publicado: (2026)
por: Peng, Xingyu, et al.
Publicado: (2026)
ReWorld: Multi-Dimensional Reward Modeling for Embodied World Models
por: Peng, Baorui, et al.
Publicado: (2026)
por: Peng, Baorui, et al.
Publicado: (2026)
Dejavu: Towards Experience Feedback Learning for Embodied Intelligence
por: Wu, Shaokai, et al.
Publicado: (2025)
por: Wu, Shaokai, et al.
Publicado: (2025)
NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks
por: Hung, Chia-Yu, et al.
Publicado: (2025)
por: Hung, Chia-Yu, et al.
Publicado: (2025)
CogNav: Cognitive Process Modeling for Object Goal Navigation with LLMs
por: Cao, Yihan, et al.
Publicado: (2024)
por: Cao, Yihan, et al.
Publicado: (2024)
ComposableNav: Instruction-Following Navigation in Dynamic Environments via Composable Diffusion
por: Hu, Zichao, et al.
Publicado: (2025)
por: Hu, Zichao, et al.
Publicado: (2025)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
por: Zhang, Jiwen, et al.
Publicado: (2026)
por: Zhang, Jiwen, et al.
Publicado: (2026)
FloNa: Floor Plan Guided Embodied Visual Navigation
por: Li, Jiaxin, et al.
Publicado: (2024)
por: Li, Jiaxin, et al.
Publicado: (2024)
ABot-N0: Technical Report on the VLA Foundation Model for Versatile Embodied Navigation
por: Chu, Zedong, et al.
Publicado: (2026)
por: Chu, Zedong, et al.
Publicado: (2026)
TOP-Nav: Legged Navigation Integrating Terrain, Obstacle and Proprioception Estimation
por: Ren, Junli, et al.
Publicado: (2024)
por: Ren, Junli, et al.
Publicado: (2024)
PanoNav: Mapless Zero-Shot Object Navigation with Panoramic Scene Parsing and Dynamic Memory
por: Jin, Qunchao, et al.
Publicado: (2025)
por: Jin, Qunchao, et al.
Publicado: (2025)
World-Ego Modeling for Long-Horizon Evolution in Hybrid Embodied Tasks
por: Lin, Zuyao, et al.
Publicado: (2026)
por: Lin, Zuyao, et al.
Publicado: (2026)
CoNav: A Benchmark for Human-Centered Collaborative Navigation
por: Li, Changhao, et al.
Publicado: (2024)
por: Li, Changhao, et al.
Publicado: (2024)
Towards Physically Realizable Adversarial Attacks in Embodied Vision Navigation
por: Chen, Meng, et al.
Publicado: (2024)
por: Chen, Meng, et al.
Publicado: (2024)
AnyImageNav: Any-View Geometry for Precise Last-Meter Image-Goal Navigation
por: Deng, Yijie, et al.
Publicado: (2026)
por: Deng, Yijie, et al.
Publicado: (2026)
FOM-Nav: Frontier-Object Maps for Object Goal Navigation
por: Chabal, Thomas, et al.
Publicado: (2025)
por: Chabal, Thomas, et al.
Publicado: (2025)
TrackVLA: Embodied Visual Tracking in the Wild
por: Wang, Shaoan, et al.
Publicado: (2025)
por: Wang, Shaoan, et al.
Publicado: (2025)
NavSpace: How Navigation Agents Follow Spatial Intelligence Instructions
por: Yang, Haolin, et al.
Publicado: (2025)
por: Yang, Haolin, et al.
Publicado: (2025)
ManiSoft: Towards Vision-Language Manipulation for Soft Continuum Robotics
por: Wei, Ziyu, et al.
Publicado: (2026)
por: Wei, Ziyu, et al.
Publicado: (2026)
DynaNav: Dynamic Feature and Layer Selection for Efficient Visual Navigation
por: Wang, Jiahui, et al.
Publicado: (2025)
por: Wang, Jiahui, et al.
Publicado: (2025)
CapNav: Benchmarking Vision Language Models on Capability-conditioned Indoor Navigation
por: Su, Xia, et al.
Publicado: (2026)
por: Su, Xia, et al.
Publicado: (2026)
PIG-Nav: Key Insights for Pretrained Image Goal Navigation Models
por: Wan, Jiansong, et al.
Publicado: (2025)
por: Wan, Jiansong, et al.
Publicado: (2025)
InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment
por: Long, Yuxing, et al.
Publicado: (2024)
por: Long, Yuxing, et al.
Publicado: (2024)
LongNav-R1: Horizon-Adaptive Multi-Turn RL for Long-Horizon VLA Navigation
por: Hu, Yue, et al.
Publicado: (2026)
por: Hu, Yue, et al.
Publicado: (2026)
Ejemplares similares
-
VLingNav: Embodied Navigation with Adaptive Reasoning and Visual-Assisted Linguistic Memory
por: Wang, Shaoan, et al.
Publicado: (2026) -
TopV-Nav: Unlocking the Top-View Spatial Reasoning Potential of MLLM for Zero-shot Object Navigation
por: Zhong, Linqing, et al.
Publicado: (2024) -
SocialNav: Training Human-Inspired Foundation Model for Socially-Aware Embodied Navigation
por: Chen, Ziyi, et al.
Publicado: (2025) -
Nav-R1: Reasoning and Navigation in Embodied Scenes
por: Liu, Qingxiang, et al.
Publicado: (2025) -
Vision-Language Navigation with Embodied Intelligence: A Survey
por: Gao, Peng, et al.
Publicado: (2024)