ImagineNav: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Xinxin, Cai, Wenzhe, Tang, Likun, Wang, Teng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ImagineNav++: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination
por: Wang, Teng, et al.
Publicado: (2025)
por: Wang, Teng, et al.
Publicado: (2025)
Imaginative World Modeling with Scene Graphs for Embodied Agent Navigation
por: Hu, Yue, et al.
Publicado: (2025)
por: Hu, Yue, et al.
Publicado: (2025)
ForesightNav: Learning Scene Imagination for Efficient Exploration
por: Shah, Hardik, et al.
Publicado: (2025)
por: Shah, Hardik, et al.
Publicado: (2025)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
por: Wang, Yunheng, et al.
Publicado: (2025)
por: Wang, Yunheng, et al.
Publicado: (2025)
Nav-R1: Reasoning and Navigation in Embodied Scenes
por: Liu, Qingxiang, et al.
Publicado: (2025)
por: Liu, Qingxiang, et al.
Publicado: (2025)
VISTA: Generative Visual Imagination for Vision-and-Language Navigation
por: Huang, Yanjia, et al.
Publicado: (2025)
por: Huang, Yanjia, et al.
Publicado: (2025)
Recursive Visual Imagination and Adaptive Linguistic Grounding for Vision Language Navigation
por: Chen, Bolei, et al.
Publicado: (2025)
por: Chen, Bolei, et al.
Publicado: (2025)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
por: Huang, Yanjia, et al.
Publicado: (2025)
por: Huang, Yanjia, et al.
Publicado: (2025)
ImagineUAV: Aerial Vision-Language Navigation via World-Action Modeling and Kinodynamic Planning
por: Liu, Xuchen, et al.
Publicado: (2026)
por: Liu, Xuchen, et al.
Publicado: (2026)
Do Visual Imaginations Improve Vision-and-Language Navigation Agents?
por: Perincherry, Akhil, et al.
Publicado: (2025)
por: Perincherry, Akhil, et al.
Publicado: (2025)
Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
por: Pan, Yiyuan, et al.
Publicado: (2024)
por: Pan, Yiyuan, et al.
Publicado: (2024)
Pelican-Unify 1.0: A Unified Embodied Intelligence Model for Understanding, Reasoning, Imagination and Action
por: Zhang, Yi, et al.
Publicado: (2026)
por: Zhang, Yi, et al.
Publicado: (2026)
SPAN-Nav: Generalized Spatial Awareness for Versatile Vision-Language Navigation
por: Liu, Jiahang, et al.
Publicado: (2026)
por: Liu, Jiahang, et al.
Publicado: (2026)
ImagiNav: Scalable Embodied Navigation via Generative Visual Prediction and Inverse Dynamics
por: Chen, Jie, et al.
Publicado: (2026)
por: Chen, Jie, et al.
Publicado: (2026)
AdaNav: Adaptive Reasoning with Uncertainty for Vision-Language Navigation
por: Ding, Xin, et al.
Publicado: (2025)
por: Ding, Xin, et al.
Publicado: (2025)
NavDP: Learning Sim-to-Real Navigation Diffusion Policy with Privileged Information Guidance
por: Cai, Wenzhe, et al.
Publicado: (2025)
por: Cai, Wenzhe, et al.
Publicado: (2025)
VLM-Social-Nav: Socially Aware Robot Navigation through Scoring using Vision-Language Models
por: Song, Daeun, et al.
Publicado: (2024)
por: Song, Daeun, et al.
Publicado: (2024)
Dream to Recall: Imagination-Guided Experience Retrieval for Memory-Persistent Vision-and-Language Navigation
por: Xu, Yunzhe, et al.
Publicado: (2025)
por: Xu, Yunzhe, et al.
Publicado: (2025)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
por: Zhang, Jiwen, et al.
Publicado: (2026)
por: Zhang, Jiwen, et al.
Publicado: (2026)
OctoNav: Towards Generalist Embodied Navigation
por: Gao, Chen, et al.
Publicado: (2025)
por: Gao, Chen, et al.
Publicado: (2025)
Imagine2Act: Leveraging Object-Action Motion Consistency from Imagined Goals for Robotic Manipulation
por: Heng, Liang, et al.
Publicado: (2025)
por: Heng, Liang, et al.
Publicado: (2025)
PM-Nav: Priori-Map Guided Embodied Navigation in Functional Buildings
por: Gao, Jiang, et al.
Publicado: (2026)
por: Gao, Jiang, et al.
Publicado: (2026)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
por: Liu, Youzhi, et al.
Publicado: (2024)
por: Liu, Youzhi, et al.
Publicado: (2024)
RAIL: Robot Affordance Imagination with Large Language Models
por: Zhang, Ceng, et al.
Publicado: (2024)
por: Zhang, Ceng, et al.
Publicado: (2024)
InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment
por: Long, Yuxing, et al.
Publicado: (2024)
por: Long, Yuxing, et al.
Publicado: (2024)
NavTrust: Benchmarking Trustworthiness for Embodied Navigation
por: Jiang, Huaide, et al.
Publicado: (2026)
por: Jiang, Huaide, et al.
Publicado: (2026)
NaviTrace: Evaluating Embodied Navigation of Vision-Language Models
por: Windecker, Tim, et al.
Publicado: (2025)
por: Windecker, Tim, et al.
Publicado: (2025)
PSG-Nav: Probabilistic Scene Graph Navigation via Multiverse Decision Making
por: Chen, Rufeng, et al.
Publicado: (2026)
por: Chen, Rufeng, et al.
Publicado: (2026)
DeCoNav: Dialog enhanced Long-Horizon Collaborative Vision-Language Navigation
por: Zhou, Sunyao, et al.
Publicado: (2026)
por: Zhou, Sunyao, et al.
Publicado: (2026)
Imagine, Verify, Execute: Memory-guided Agentic Exploration with Vision-Language Models
por: Lee, Seungjae, et al.
Publicado: (2025)
por: Lee, Seungjae, et al.
Publicado: (2025)
Nav-EE: Navigation-Guided Early Exiting for Efficient Vision-Language Models in Autonomous Driving
por: Hu, Haibo, et al.
Publicado: (2025)
por: Hu, Haibo, et al.
Publicado: (2025)
SG-Bot: Object Rearrangement via Coarse-to-Fine Robotic Imagination on Scene Graphs
por: Zhai, Guangyao, et al.
Publicado: (2023)
por: Zhai, Guangyao, et al.
Publicado: (2023)
Schrödinger's Navigator: Imagining an Ensemble of Futures for Zero-Shot Object Navigation
por: He, Yu, et al.
Publicado: (2025)
por: He, Yu, et al.
Publicado: (2025)
NavQ: Learning a Q-Model for Foresighted Vision-and-Language Navigation
por: Xu, Peiran, et al.
Publicado: (2025)
por: Xu, Peiran, et al.
Publicado: (2025)
CapNav: Benchmarking Vision Language Models on Capability-conditioned Indoor Navigation
por: Su, Xia, et al.
Publicado: (2026)
por: Su, Xia, et al.
Publicado: (2026)
P$^{3}$Nav: End-to-End Perception, Prediction and Planning for Vision-and-Language Navigation
por: Li, Tianfu, et al.
Publicado: (2026)
por: Li, Tianfu, et al.
Publicado: (2026)
PixelNav: Towards Model-based Vision-Only Navigation with Topological Graphs
por: Bakulin, Sergey, et al.
Publicado: (2025)
por: Bakulin, Sergey, et al.
Publicado: (2025)
RoboTron-Nav: A Unified Framework for Embodied Navigation Integrating Perception, Planning, and Prediction
por: Zhong, Yufeng, et al.
Publicado: (2025)
por: Zhong, Yufeng, et al.
Publicado: (2025)
VLingNav: Embodied Navigation with Adaptive Reasoning and Visual-Assisted Linguistic Memory
por: Wang, Shaoan, et al.
Publicado: (2026)
por: Wang, Shaoan, et al.
Publicado: (2026)
MapNav: A Novel Memory Representation via Annotated Semantic Maps for Vision-and-Language Navigation
por: Zhang, Lingfeng, et al.
Publicado: (2025)
por: Zhang, Lingfeng, et al.
Publicado: (2025)
Ejemplares similares
-
ImagineNav++: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination
por: Wang, Teng, et al.
Publicado: (2025) -
Imaginative World Modeling with Scene Graphs for Embodied Agent Navigation
por: Hu, Yue, et al.
Publicado: (2025) -
ForesightNav: Learning Scene Imagination for Efficient Exploration
por: Shah, Hardik, et al.
Publicado: (2025) -
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
por: Wang, Yunheng, et al.
Publicado: (2025) -
Nav-R1: Reasoning and Navigation in Embodied Scenes
por: Liu, Qingxiang, et al.
Publicado: (2025)