LangNav: Language as a Perceptual Representation for Navigation
Fuente:
arXiv
Guardado en:
| Autores principales: | Pan, Bowen, Panda, Rameswar, Jin, SouYoung, Feris, Rogerio, Oliva, Aude, Isola, Phillip, Kim, Yoon |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Unsafe2Safe: Controllable Image Anonymization for Downstream Utility
por: Dinh, Mih, et al.
Publicado: (2026)
por: Dinh, Mih, et al.
Publicado: (2026)
Beyond Final Answers: CRYSTAL Benchmark for Transparent Multimodal Reasoning Evaluation
por: Barrios, Wayner, et al.
Publicado: (2026)
por: Barrios, Wayner, et al.
Publicado: (2026)
Multi-layer Learnable Attention Mask for Multimodal Tasks
por: Barrios, Wayner, et al.
Publicado: (2024)
por: Barrios, Wayner, et al.
Publicado: (2024)
VL-Nav: A Neuro-Symbolic Approach for Reasoning-based Vision-Language Navigation
por: Du, Yi, et al.
Publicado: (2025)
por: Du, Yi, et al.
Publicado: (2025)
FT2TF: First-Person Statement Text-To-Talking Face Generation
por: Diao, Xingjian, et al.
Publicado: (2023)
por: Diao, Xingjian, et al.
Publicado: (2023)
OctoNav: Towards Generalist Embodied Navigation
por: Gao, Chen, et al.
Publicado: (2025)
por: Gao, Chen, et al.
Publicado: (2025)
NavQ: Learning a Q-Model for Foresighted Vision-and-Language Navigation
por: Xu, Peiran, et al.
Publicado: (2025)
por: Xu, Peiran, et al.
Publicado: (2025)
CapNav: Benchmarking Vision Language Models on Capability-conditioned Indoor Navigation
por: Su, Xia, et al.
Publicado: (2026)
por: Su, Xia, et al.
Publicado: (2026)
PanoNav: Mapless Zero-Shot Object Navigation with Panoramic Scene Parsing and Dynamic Memory
por: Jin, Qunchao, et al.
Publicado: (2025)
por: Jin, Qunchao, et al.
Publicado: (2025)
Nav-R1: Reasoning and Navigation in Embodied Scenes
por: Liu, Qingxiang, et al.
Publicado: (2025)
por: Liu, Qingxiang, et al.
Publicado: (2025)
Dense Training, Sparse Inference: Rethinking Training of Mixture-of-Experts Language Models
por: Pan, Bowen, et al.
Publicado: (2024)
por: Pan, Bowen, et al.
Publicado: (2024)
VoroNav: Voronoi-based Zero-shot Object Navigation with Large Language Model
por: Wu, Pengying, et al.
Publicado: (2024)
por: Wu, Pengying, et al.
Publicado: (2024)
NavGPT-2: Unleashing Navigational Reasoning Capability for Large Vision-Language Models
por: Zhou, Gengze, et al.
Publicado: (2024)
por: Zhou, Gengze, et al.
Publicado: (2024)
CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model
por: Yu, Zhuoyuan, et al.
Publicado: (2025)
por: Yu, Zhuoyuan, et al.
Publicado: (2025)
Context-Nav: Context-Driven Exploration and Viewpoint-Aware 3D Spatial Reasoning for Instance Navigation
por: Jang, Won Shik, et al.
Publicado: (2026)
por: Jang, Won Shik, et al.
Publicado: (2026)
UrbanNav: Learning Language-Guided Urban Navigation from Web-Scale Human Trajectories
por: Mei, Yanghong, et al.
Publicado: (2025)
por: Mei, Yanghong, et al.
Publicado: (2025)
ShadowNav: Autonomous Global Localization for Lunar Navigation in Darkness
por: Atha, Deegan, et al.
Publicado: (2024)
por: Atha, Deegan, et al.
Publicado: (2024)
Hyp2Nav: Hyperbolic Planning and Curiosity for Crowd Navigation
por: di Melendugno, Guido Maria D'Amely, et al.
Publicado: (2024)
por: di Melendugno, Guido Maria D'Amely, et al.
Publicado: (2024)
CoNav: A Benchmark for Human-Centered Collaborative Navigation
por: Li, Changhao, et al.
Publicado: (2024)
por: Li, Changhao, et al.
Publicado: (2024)
FOM-Nav: Frontier-Object Maps for Object Goal Navigation
por: Chabal, Thomas, et al.
Publicado: (2025)
por: Chabal, Thomas, et al.
Publicado: (2025)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
por: Wang, Yunheng, et al.
Publicado: (2025)
por: Wang, Yunheng, et al.
Publicado: (2025)
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
por: Lin, Bingqian, et al.
Publicado: (2024)
por: Lin, Bingqian, et al.
Publicado: (2024)
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
por: Qiao, Yanyuan, et al.
Publicado: (2024)
por: Qiao, Yanyuan, et al.
Publicado: (2024)
HaltNav: Reactive Visual Halting over Lightweight Topological Priors for Robust Vision-Language Navigation
por: Yu, Zihui, et al.
Publicado: (2026)
por: Yu, Zihui, et al.
Publicado: (2026)
Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation
por: Zheng, Wanrong, et al.
Publicado: (2026)
por: Zheng, Wanrong, et al.
Publicado: (2026)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
por: Liu, Youzhi, et al.
Publicado: (2024)
por: Liu, Youzhi, et al.
Publicado: (2024)
DynaNav: Dynamic Feature and Layer Selection for Efficient Visual Navigation
por: Wang, Jiahui, et al.
Publicado: (2025)
por: Wang, Jiahui, et al.
Publicado: (2025)
PIG-Nav: Key Insights for Pretrained Image Goal Navigation Models
por: Wan, Jiansong, et al.
Publicado: (2025)
por: Wan, Jiansong, et al.
Publicado: (2025)
GuideNav: User-Informed Development of a Vision-Only Robotic Navigation Assistant For Blind Travelers
por: Hwang, Hochul, et al.
Publicado: (2025)
por: Hwang, Hochul, et al.
Publicado: (2025)
MemoNav: Working Memory Model for Visual Navigation
por: Li, Hongxin, et al.
Publicado: (2024)
por: Li, Hongxin, et al.
Publicado: (2024)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
por: Zhang, Jiwen, et al.
Publicado: (2026)
por: Zhang, Jiwen, et al.
Publicado: (2026)
NavForesee: A Unified Vision-Language World Model for Hierarchical Planning and Dual-Horizon Navigation Prediction
por: Liu, Fei, et al.
Publicado: (2025)
por: Liu, Fei, et al.
Publicado: (2025)
NavSpace: How Navigation Agents Follow Spatial Intelligence Instructions
por: Yang, Haolin, et al.
Publicado: (2025)
por: Yang, Haolin, et al.
Publicado: (2025)
IndustryNav: Exploring Spatial Reasoning of Embodied Agents in Dynamic Industrial Navigation
por: Li, Yifan, et al.
Publicado: (2025)
por: Li, Yifan, et al.
Publicado: (2025)
IGL-Nav: Incremental 3D Gaussian Localization for Image-goal Navigation
por: Guo, Wenxuan, et al.
Publicado: (2025)
por: Guo, Wenxuan, et al.
Publicado: (2025)
VLingNav: Embodied Navigation with Adaptive Reasoning and Visual-Assisted Linguistic Memory
por: Wang, Shaoan, et al.
Publicado: (2026)
por: Wang, Shaoan, et al.
Publicado: (2026)
SocialNav-SUB: Benchmarking VLMs for Scene Understanding in Social Robot Navigation
por: Munje, Michael J., et al.
Publicado: (2025)
por: Munje, Michael J., et al.
Publicado: (2025)
MG-Nav: Dual-Scale Visual Navigation via Sparse Spatial Memory
por: Wang, Bo, et al.
Publicado: (2025)
por: Wang, Bo, et al.
Publicado: (2025)
InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment
por: Long, Yuxing, et al.
Publicado: (2024)
por: Long, Yuxing, et al.
Publicado: (2024)
Distilled Feature Fields Enable Few-Shot Language-Guided Manipulation
por: Shen, William, et al.
Publicado: (2023)
por: Shen, William, et al.
Publicado: (2023)
Ejemplares similares
-
Unsafe2Safe: Controllable Image Anonymization for Downstream Utility
por: Dinh, Mih, et al.
Publicado: (2026) -
Beyond Final Answers: CRYSTAL Benchmark for Transparent Multimodal Reasoning Evaluation
por: Barrios, Wayner, et al.
Publicado: (2026) -
Multi-layer Learnable Attention Mask for Multimodal Tasks
por: Barrios, Wayner, et al.
Publicado: (2024) -
VL-Nav: A Neuro-Symbolic Approach for Reasoning-based Vision-Language Navigation
por: Du, Yi, et al.
Publicado: (2025) -
FT2TF: First-Person Statement Text-To-Talking Face Generation
por: Diao, Xingjian, et al.
Publicado: (2023)