Lookahead Exploration with Neural Radiance Representation for Continuous Vision-Language Navigation
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Zihan, Li, Xiangyang, Yang, Jiahao, Liu, Yeqi, Hu, Junjie, Jiang, Ming, Jiang, Shuqiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation
di: Wang, Zihan, et al.
Pubblicazione: (2024)
di: Wang, Zihan, et al.
Pubblicazione: (2024)
GA-VLN: Geometry-Aware BEV Representation for Efficient Vision-Language Navigation
di: Yang, Jiahao, et al.
Pubblicazione: (2026)
di: Yang, Jiahao, et al.
Pubblicazione: (2026)
Neural Radiance Maps for Extraterrestrial Navigation and Path Planning
di: Dai, Adam, et al.
Pubblicazione: (2026)
di: Dai, Adam, et al.
Pubblicazione: (2026)
Let's Reward Step-by-Step: Step-Aware Contrastive Alignment for Vision-Language Navigation in Continuous Environments
di: Li, Haoyuan, et al.
Pubblicazione: (2026)
di: Li, Haoyuan, et al.
Pubblicazione: (2026)
DiffGen: Robot Demonstration Generation via Differentiable Physics Simulation, Differentiable Rendering, and Vision-Language Model
di: Jin, Yang, et al.
Pubblicazione: (2024)
di: Jin, Yang, et al.
Pubblicazione: (2024)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
di: Huang, Yanjia, et al.
Pubblicazione: (2025)
di: Huang, Yanjia, et al.
Pubblicazione: (2025)
Dynam3D: Dynamic Layered 3D Tokens Empower VLM for Vision-and-Language Navigation
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
Implicit Geometry Representations for Vision-and-Language Navigation from Web Videos
di: Han, Mingfei, et al.
Pubblicazione: (2026)
di: Han, Mingfei, et al.
Pubblicazione: (2026)
Constraint-Aware Zero-Shot Vision-Language Navigation in Continuous Environments
di: Chen, Kehan, et al.
Pubblicazione: (2024)
di: Chen, Kehan, et al.
Pubblicazione: (2024)
TagaVLM: Topology-Aware Global Action Reasoning for Vision-Language Navigation
di: Liu, Jiaxing, et al.
Pubblicazione: (2026)
di: Liu, Jiaxing, et al.
Pubblicazione: (2026)
FantasyVLN: Unified Multimodal Chain-of-Thought Reasoning for Vision-Language Navigation
di: Zuo, Jing, et al.
Pubblicazione: (2026)
di: Zuo, Jing, et al.
Pubblicazione: (2026)
D3D-VLP: Dynamic 3D Vision-Language-Planning Model for Embodied Grounding and Navigation
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
Turning Adaptation into Assets: Cross-Domain Bridging for Online Vision-Language Navigation
di: Hu, Zixuan, et al.
Pubblicazione: (2026)
di: Hu, Zixuan, et al.
Pubblicazione: (2026)
Stop Wandering: Efficient Vision-Language Navigation via Metacognitive Reasoning
di: Li, Xueying, et al.
Pubblicazione: (2026)
di: Li, Xueying, et al.
Pubblicazione: (2026)
Towards Realistic UAV Vision-Language Navigation: Platform, Benchmark, and Methodology
di: Wang, Xiangyu, et al.
Pubblicazione: (2024)
di: Wang, Xiangyu, et al.
Pubblicazione: (2024)
TeX-NeRF: Neural Radiance Fields from Pseudo-TeX Vision
di: Zhong, Chonghao, et al.
Pubblicazione: (2024)
di: Zhong, Chonghao, et al.
Pubblicazione: (2024)
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
di: Qiao, Yanyuan, et al.
Pubblicazione: (2024)
di: Qiao, Yanyuan, et al.
Pubblicazione: (2024)
HERE: Hierarchical Active Exploration of Radiance Field with Epistemic Uncertainty Minimization
di: Lee, Taekbeom, et al.
Pubblicazione: (2026)
di: Lee, Taekbeom, et al.
Pubblicazione: (2026)
DAgger Diffusion Navigation: DAgger Boosted Diffusion Policy for Vision-Language Navigation
di: Shi, Haoxiang, et al.
Pubblicazione: (2025)
di: Shi, Haoxiang, et al.
Pubblicazione: (2025)
Camera Relocalization in Shadow-free Neural Radiance Fields
di: Xu, Shiyao, et al.
Pubblicazione: (2024)
di: Xu, Shiyao, et al.
Pubblicazione: (2024)
ProFocus: Proactive Perception and Focused Reasoning in Vision-and-Language Navigation
di: Xue, Wei, et al.
Pubblicazione: (2026)
di: Xue, Wei, et al.
Pubblicazione: (2026)
VoxNeRF: Bridging Voxel Representation and Neural Radiance Fields for Enhanced Indoor View Synthesis
di: Wang, Sen, et al.
Pubblicazione: (2023)
di: Wang, Sen, et al.
Pubblicazione: (2023)
ST-Booster: An Iterative SpatioTemporal Perception Booster for Vision-and-Language Navigation in Continuous Environments
di: Yue, Lu, et al.
Pubblicazione: (2025)
di: Yue, Lu, et al.
Pubblicazione: (2025)
Hijacking Vision-and-Language Navigation Agents with Adversarial Environmental Attacks
di: Yang, Zijiao, et al.
Pubblicazione: (2024)
di: Yang, Zijiao, et al.
Pubblicazione: (2024)
AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation
di: Guo, Wenxuan, et al.
Pubblicazione: (2026)
di: Guo, Wenxuan, et al.
Pubblicazione: (2026)
Thermal-NeRF: Neural Radiance Fields from an Infrared Camera
di: Ye, Tianxiang, et al.
Pubblicazione: (2024)
di: Ye, Tianxiang, et al.
Pubblicazione: (2024)
DOPE: Dual Object Perception-Enhancement Network for Vision-and-Language Navigation
di: Yu, Yinfeng, et al.
Pubblicazione: (2025)
di: Yu, Yinfeng, et al.
Pubblicazione: (2025)
High-fidelity 3D Reconstruction of Plants using Neural Radiance Field
di: Hu, Kewei, et al.
Pubblicazione: (2023)
di: Hu, Kewei, et al.
Pubblicazione: (2023)
View Invariant Learning for Vision-Language Navigation in Continuous Environments
di: Sun, Josh Qixuan, et al.
Pubblicazione: (2025)
di: Sun, Josh Qixuan, et al.
Pubblicazione: (2025)
NaVILA: Legged Robot Vision-Language-Action Model for Navigation
di: Cheng, An-Chieh, et al.
Pubblicazione: (2024)
di: Cheng, An-Chieh, et al.
Pubblicazione: (2024)
Guide, Think, Act: Interactive Embodied Reasoning in Vision-Language-Action Models
di: Ling, Yiran, et al.
Pubblicazione: (2026)
di: Ling, Yiran, et al.
Pubblicazione: (2026)
MonoDream: Monocular Vision-Language Navigation with Panoramic Dreaming
di: Wang, Shuo, et al.
Pubblicazione: (2025)
di: Wang, Shuo, et al.
Pubblicazione: (2025)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System
di: Lyu, Kailin, et al.
Pubblicazione: (2026)
di: Lyu, Kailin, et al.
Pubblicazione: (2026)
Structured Observation Language for Efficient and Generalizable Vision-Language Navigation
di: Peng, Daojie, et al.
Pubblicazione: (2026)
di: Peng, Daojie, et al.
Pubblicazione: (2026)
FASTer: Toward Efficient Autoregressive Vision Language Action Modeling via Neural Action Tokenization
di: Liu, Yicheng, et al.
Pubblicazione: (2025)
di: Liu, Yicheng, et al.
Pubblicazione: (2025)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
di: An, Dong, et al.
Pubblicazione: (2023)
di: An, Dong, et al.
Pubblicazione: (2023)
FlexVLN: Flexible Adaptation for Diverse Vision-and-Language Navigation Tasks
di: Zhang, Siqi, et al.
Pubblicazione: (2025)
di: Zhang, Siqi, et al.
Pubblicazione: (2025)
WorldMAP: Bootstrapping Vision-Language Navigation Trajectory Prediction with Generative World Models
di: Chen, Hongjin, et al.
Pubblicazione: (2026)
di: Chen, Hongjin, et al.
Pubblicazione: (2026)
COSMO: Combination of Selective Memorization for Low-cost Vision-and-Language Navigation
di: Zhang, Siqi, et al.
Pubblicazione: (2025)
di: Zhang, Siqi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation
di: Wang, Zihan, et al.
Pubblicazione: (2024) -
GA-VLN: Geometry-Aware BEV Representation for Efficient Vision-Language Navigation
di: Yang, Jiahao, et al.
Pubblicazione: (2026) -
Neural Radiance Maps for Extraterrestrial Navigation and Path Planning
di: Dai, Adam, et al.
Pubblicazione: (2026) -
Let's Reward Step-by-Step: Step-Aware Contrastive Alignment for Vision-Language Navigation in Continuous Environments
di: Li, Haoyuan, et al.
Pubblicazione: (2026) -
DiffGen: Robot Demonstration Generation via Differentiable Physics Simulation, Differentiable Rendering, and Vision-Language Model
di: Jin, Yang, et al.
Pubblicazione: (2024)