Gespeichert in:
| Hauptverfasser: | Kuang, Yuxuan, Lin, Hai, Jiang, Meng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2402.10670 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
DivScene: Towards Open-Vocabulary Object Navigation with Large Vision Language Models in Diverse Scenes
von: Wang, Zhaowei, et al.
Veröffentlicht: (2024)
von: Wang, Zhaowei, et al.
Veröffentlicht: (2024)
Affordances-Oriented Planning using Foundation Models for Continuous Vision-Language Navigation
von: Chen, Jiaqi, et al.
Veröffentlicht: (2024)
von: Chen, Jiaqi, et al.
Veröffentlicht: (2024)
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
von: Qiao, Yanyuan, et al.
Veröffentlicht: (2024)
von: Qiao, Yanyuan, et al.
Veröffentlicht: (2024)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
von: Wang, Yunheng, et al.
Veröffentlicht: (2025)
von: Wang, Yunheng, et al.
Veröffentlicht: (2025)
REFLEX: Metacognitive Reasoning for Reflective Zero-Shot Robotic Planning with Large Language Models
von: Lin, Wenjie, et al.
Veröffentlicht: (2025)
von: Lin, Wenjie, et al.
Veröffentlicht: (2025)
DOZE: A Dataset for Open-Vocabulary Zero-Shot Object Navigation in Dynamic Environments
von: Ma, Ji, et al.
Veröffentlicht: (2024)
von: Ma, Ji, et al.
Veröffentlicht: (2024)
Can an Embodied Agent Find Your "Cat-shaped Mug"? LLM-Guided Exploration for Zero-Shot Object Navigation
von: Dorbala, Vishnu Sashank, et al.
Veröffentlicht: (2023)
von: Dorbala, Vishnu Sashank, et al.
Veröffentlicht: (2023)
Unseen from Seen: Rewriting Observation-Instruction Using Foundation Models for Augmenting Vision-Language Navigation
von: Wei, Ziming, et al.
Veröffentlicht: (2025)
von: Wei, Ziming, et al.
Veröffentlicht: (2025)
HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System
von: Lyu, Kailin, et al.
Veröffentlicht: (2026)
von: Lyu, Kailin, et al.
Veröffentlicht: (2026)
Mechanistic Finetuning of Vision-Language-Action Models via Few-Shot Demonstrations
von: Mitra, Chancharik, et al.
Veröffentlicht: (2025)
von: Mitra, Chancharik, et al.
Veröffentlicht: (2025)
LOC-ZSON: Language-driven Object-Centric Zero-Shot Object Retrieval and Navigation
von: Guan, Tianrui, et al.
Veröffentlicht: (2024)
von: Guan, Tianrui, et al.
Veröffentlicht: (2024)
Think, Act, and Ask: Open-World Interactive Personalized Robot Navigation
von: Dai, Yinpei, et al.
Veröffentlicht: (2023)
von: Dai, Yinpei, et al.
Veröffentlicht: (2023)
osmAG-LLM: Zero-Shot Open-Vocabulary Object Navigation via Semantic Maps and Large Language Models Reasoning
von: Xie, Fujing, et al.
Veröffentlicht: (2025)
von: Xie, Fujing, et al.
Veröffentlicht: (2025)
Language Models as Zero-Shot Trajectory Generators
von: Kwon, Teyun, et al.
Veröffentlicht: (2023)
von: Kwon, Teyun, et al.
Veröffentlicht: (2023)
Polaris: Open-ended Interactive Robotic Manipulation via Syn2Real Visual Grounding and Large Language Models
von: Wang, Tianyu, et al.
Veröffentlicht: (2024)
von: Wang, Tianyu, et al.
Veröffentlicht: (2024)
FetchBot: Learning Generalizable Object Fetching in Cluttered Scenes via Zero-Shot Sim2Real
von: Liu, Weiheng, et al.
Veröffentlicht: (2025)
von: Liu, Weiheng, et al.
Veröffentlicht: (2025)
Navigating Beyond Instructions: Vision-and-Language Navigation in Obstructed Environments
von: Hong, Haodong, et al.
Veröffentlicht: (2024)
von: Hong, Haodong, et al.
Veröffentlicht: (2024)
Large Language Models as Zero-Shot Human Models for Human-Robot Interaction
von: Zhang, Bowen, et al.
Veröffentlicht: (2023)
von: Zhang, Bowen, et al.
Veröffentlicht: (2023)
Stable Language Guidance for Vision-Language-Action Models
von: Zhan, Zhihao, et al.
Veröffentlicht: (2026)
von: Zhan, Zhihao, et al.
Veröffentlicht: (2026)
Open-Source Image Editing Models Are Zero-Shot Vision Learners
von: Liu, Wei, et al.
Veröffentlicht: (2026)
von: Liu, Wei, et al.
Veröffentlicht: (2026)
OpenVLN: Open-world Aerial Vision-Language Navigation
von: Lin, Peican, et al.
Veröffentlicht: (2025)
von: Lin, Peican, et al.
Veröffentlicht: (2025)
Schrödinger's Navigator: Imagining an Ensemble of Futures for Zero-Shot Object Navigation
von: He, Yu, et al.
Veröffentlicht: (2025)
von: He, Yu, et al.
Veröffentlicht: (2025)
ZISVFM: Zero-Shot Object Instance Segmentation in Indoor Robotic Environments with Vision Foundation Models
von: Zhang, Ying, et al.
Veröffentlicht: (2025)
von: Zhang, Ying, et al.
Veröffentlicht: (2025)
Self-Prompting Large Language Models for Zero-Shot Open-Domain QA
von: Li, Junlong, et al.
Veröffentlicht: (2022)
von: Li, Junlong, et al.
Veröffentlicht: (2022)
PREDILECT: Preferences Delineated with Zero-Shot Language-based Reasoning in Reinforcement Learning
von: Holk, Simon, et al.
Veröffentlicht: (2024)
von: Holk, Simon, et al.
Veröffentlicht: (2024)
Constraint-Aware Zero-Shot Vision-Language Navigation in Continuous Environments
von: Chen, Kehan, et al.
Veröffentlicht: (2024)
von: Chen, Kehan, et al.
Veröffentlicht: (2024)
What Limits Vision-and-Language Navigation ?
von: Wang, Yunheng, et al.
Veröffentlicht: (2026)
von: Wang, Yunheng, et al.
Veröffentlicht: (2026)
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
von: Lin, Bingqian, et al.
Veröffentlicht: (2024)
von: Lin, Bingqian, et al.
Veröffentlicht: (2024)
Hierarchical Open-Vocabulary 3D Scene Graphs for Language-Grounded Robot Navigation
von: Werby, Abdelrhman, et al.
Veröffentlicht: (2024)
von: Werby, Abdelrhman, et al.
Veröffentlicht: (2024)
Open-Loop Planning, Closed-Loop Verification: Speculative Verification for VLA
von: Wang, Zihua, et al.
Veröffentlicht: (2026)
von: Wang, Zihua, et al.
Veröffentlicht: (2026)
End-to-End Navigation with Vision Language Models: Transforming Spatial Reasoning into Question-Answering
von: Goetting, Dylan, et al.
Veröffentlicht: (2024)
von: Goetting, Dylan, et al.
Veröffentlicht: (2024)
History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation
von: Habibpour, Mobin, et al.
Veröffentlicht: (2025)
von: Habibpour, Mobin, et al.
Veröffentlicht: (2025)
Towards Multimodal Social Conversations with Robots: Using Vision-Language Models
von: Janssens, Ruben, et al.
Veröffentlicht: (2025)
von: Janssens, Ruben, et al.
Veröffentlicht: (2025)
Mind the Error! Detection and Localization of Instruction Errors in Vision-and-Language Navigation
von: Taioli, Francesco, et al.
Veröffentlicht: (2024)
von: Taioli, Francesco, et al.
Veröffentlicht: (2024)
Vision-and-Language Navigation Generative Pretrained Transformer
von: Hanlin, Wen
Veröffentlicht: (2024)
von: Hanlin, Wen
Veröffentlicht: (2024)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
von: An, Dong, et al.
Veröffentlicht: (2023)
von: An, Dong, et al.
Veröffentlicht: (2023)
Open-Set 3D Semantic Instance Maps for Vision Language Navigation -- O3D-SIM
von: Nanwani, Laksh, et al.
Veröffentlicht: (2024)
von: Nanwani, Laksh, et al.
Veröffentlicht: (2024)
Zero-shot Object Navigation with Vision-Language Models Reasoning
von: Wen, Congcong, et al.
Veröffentlicht: (2024)
von: Wen, Congcong, et al.
Veröffentlicht: (2024)
Towards Open-World Grasping with Large Vision-Language Models
von: Tziafas, Georgios, et al.
Veröffentlicht: (2024)
von: Tziafas, Georgios, et al.
Veröffentlicht: (2024)
SemNav: A Model-Based Planner for Zero-Shot Object Goal Navigation Using Vision-Foundation Models
von: Debnath, Arnab, et al.
Veröffentlicht: (2025)
von: Debnath, Arnab, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
DivScene: Towards Open-Vocabulary Object Navigation with Large Vision Language Models in Diverse Scenes
von: Wang, Zhaowei, et al.
Veröffentlicht: (2024) -
Affordances-Oriented Planning using Foundation Models for Continuous Vision-Language Navigation
von: Chen, Jiaqi, et al.
Veröffentlicht: (2024) -
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
von: Qiao, Yanyuan, et al.
Veröffentlicht: (2024) -
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
von: Wang, Yunheng, et al.
Veröffentlicht: (2025) -
REFLEX: Metacognitive Reasoning for Reflective Zero-Shot Robotic Planning with Large Language Models
von: Lin, Wenjie, et al.
Veröffentlicht: (2025)