Vision Language Models Can Parse Floor Plan Maps
Fuente:
arXiv
Saved in:
| Main Authors: | DeFazio, David, Mehta, Hrudayangam, Wang, Meng, Yang, Ping, Blackburn, Jeremy, Zhang, Shiqi |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning Quadruped Locomotion Policies using Logical Rules
by: DeFazio, David, et al.
Published: (2021)
by: DeFazio, David, et al.
Published: (2021)
Evaluating Large Language Models for Detecting Antisemitism
by: Patel, Jay, et al.
Published: (2025)
by: Patel, Jay, et al.
Published: (2025)
From Woofs to Words: Towards Intelligent Robotic Guide Dogs with Verbal Communication
by: Hayamizu, Yohei, et al.
Published: (2026)
by: Hayamizu, Yohei, et al.
Published: (2026)
DKPROMPT: Domain Knowledge Prompting Vision-Language Models for Open-World Planning
by: Zhang, Xiaohan, et al.
Published: (2024)
by: Zhang, Xiaohan, et al.
Published: (2024)
Grounded Vision-Language Interpreter for Integrated Task and Motion Planning
by: Siburian, Jeremy, et al.
Published: (2025)
by: Siburian, Jeremy, et al.
Published: (2025)
Vision-Language-Policy Model for Dynamic Robot Task Planning
by: Wang, Jin, et al.
Published: (2025)
by: Wang, Jin, et al.
Published: (2025)
GAN-SLAM: Real-Time GAN Aided Floor Plan Creation Through SLAM
by: Davies, Leon, et al.
Published: (2025)
by: Davies, Leon, et al.
Published: (2025)
World-aware Planning Narratives Enhance Large Vision-Language Model Planner
by: Shi, Junhao, et al.
Published: (2025)
by: Shi, Junhao, et al.
Published: (2025)
Robot Task Planning and Situation Handling in Open Worlds
by: Ding, Yan, et al.
Published: (2022)
by: Ding, Yan, et al.
Published: (2022)
V-VLAPS: Value-Guided Planning for Vision-Language-Action Models
by: Ren, Ke, et al.
Published: (2026)
by: Ren, Ke, et al.
Published: (2026)
Planning with Vision-Language Models and a Use Case in Robot-Assisted Teaching
by: Dang, Xuzhe, et al.
Published: (2025)
by: Dang, Xuzhe, et al.
Published: (2025)
GAgent: An Adaptive Rigid-Soft Gripping Agent with Vision Language Models for Complex Lighting Environments
by: Li, Zhuowei, et al.
Published: (2024)
by: Li, Zhuowei, et al.
Published: (2024)
SeqWalker: Sequential-Horizon Vision-and-Language Navigation with Hierarchical Planning
by: Han, Zebin, et al.
Published: (2026)
by: Han, Zebin, et al.
Published: (2026)
AppleVLM: End-to-end Autonomous Driving with Advanced Perception and Planning-Enhanced Vision-Language Models
by: Han, Yuxuan, et al.
Published: (2026)
by: Han, Yuxuan, et al.
Published: (2026)
Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics
by: Wang, Taowen, et al.
Published: (2024)
by: Wang, Taowen, et al.
Published: (2024)
VLMPlanner: Integrating Visual Language Models with Motion Planning
by: Tang, Zhipeng, et al.
Published: (2025)
by: Tang, Zhipeng, et al.
Published: (2025)
MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation
by: Chen, Jiaqi, et al.
Published: (2024)
by: Chen, Jiaqi, et al.
Published: (2024)
FloNa: Floor Plan Guided Embodied Visual Navigation
by: Li, Jiaxin, et al.
Published: (2024)
by: Li, Jiaxin, et al.
Published: (2024)
HBTP: Heuristic Behavior Tree Planning with Large Language Model Reasoning
by: Cai, Yishuai, et al.
Published: (2024)
by: Cai, Yishuai, et al.
Published: (2024)
VLM-DEWM: Dynamic External World Model for Verifiable and Resilient Vision-Language Planning in Manufacturing
by: Tang, Guoqin, et al.
Published: (2026)
by: Tang, Guoqin, et al.
Published: (2026)
Continually Evolving Skill Knowledge in Vision Language Action Model
by: Wu, Yuxuan, et al.
Published: (2025)
by: Wu, Yuxuan, et al.
Published: (2025)
CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory
by: Zhang, Weichen, et al.
Published: (2025)
by: Zhang, Weichen, et al.
Published: (2025)
Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation
by: Feng, Yunhai, et al.
Published: (2025)
by: Feng, Yunhai, et al.
Published: (2025)
LLM-A*: Large Language Model Enhanced Incremental Heuristic Search on Path Planning
by: Meng, Silin, et al.
Published: (2024)
by: Meng, Silin, et al.
Published: (2024)
MapDream: Task-Driven Map Learning for Vision-Language Navigation
by: Lian, Guoxin, et al.
Published: (2026)
by: Lian, Guoxin, et al.
Published: (2026)
PALMS+: Modular Image-Based Floor Plan Localization Leveraging Depth Foundation Model
by: Cheng, Yunqian, et al.
Published: (2025)
by: Cheng, Yunqian, et al.
Published: (2025)
ChainFlow-VLA: Causal Flow Planning with Vision-Language Models
by: Wang, Xiyang, et al.
Published: (2026)
by: Wang, Xiyang, et al.
Published: (2026)
Can LLM-Reasoning Models Replace Classical Planning? A Benchmark Study
by: Goebel, Kai, et al.
Published: (2025)
by: Goebel, Kai, et al.
Published: (2025)
Align-Then-stEer: Adapting the Vision-Language Action Models through Unified Latent Guidance
by: Zhang, Yang, et al.
Published: (2025)
by: Zhang, Yang, et al.
Published: (2025)
A Survey of Optimization-based Task and Motion Planning: From Classical To Learning Approaches
by: Zhao, Zhigen, et al.
Published: (2024)
by: Zhao, Zhigen, et al.
Published: (2024)
ViLAM: Distilling Vision-Language Reasoning into Attention Maps for Social Robot Navigation
by: Elnoor, Mohamed, et al.
Published: (2025)
by: Elnoor, Mohamed, et al.
Published: (2025)
Steering Vision-Language-Action Models as Anti-Exploration: A Test-Time Scaling Approach
by: Yang, Siyuan, et al.
Published: (2025)
by: Yang, Siyuan, et al.
Published: (2025)
RePO-VLA: Recovery-Driven Policy Optimization for Vision-Language-Action Models
by: Liufu, Weijia, et al.
Published: (2026)
by: Liufu, Weijia, et al.
Published: (2026)
Can only LLMs do Reasoning?: Potential of Small Language Models in Task Planning
by: Choi, Gawon, et al.
Published: (2024)
by: Choi, Gawon, et al.
Published: (2024)
Vision-Language Interpreter for Robot Task Planning
by: Shirai, Keisuke, et al.
Published: (2023)
by: Shirai, Keisuke, et al.
Published: (2023)
Conformal Temporal Logic Planning using Large Language Models
by: Wang, Jun, et al.
Published: (2023)
by: Wang, Jun, et al.
Published: (2023)
10 Open Challenges Steering the Future of Vision-Language-Action Models
by: Poria, Soujanya, et al.
Published: (2025)
by: Poria, Soujanya, et al.
Published: (2025)
SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning
by: Zhang, Borong, et al.
Published: (2025)
by: Zhang, Borong, et al.
Published: (2025)
CubeRobot: Grounding Language in Rubik's Cube Manipulation via Vision-Language Model
by: Wang, Feiyang, et al.
Published: (2025)
by: Wang, Feiyang, et al.
Published: (2025)
Survey of Vision-Language-Action Models for Embodied Manipulation
by: Li, Haoran, et al.
Published: (2025)
by: Li, Haoran, et al.
Published: (2025)
Similar Items
-
Learning Quadruped Locomotion Policies using Logical Rules
by: DeFazio, David, et al.
Published: (2021) -
Evaluating Large Language Models for Detecting Antisemitism
by: Patel, Jay, et al.
Published: (2025) -
From Woofs to Words: Towards Intelligent Robotic Guide Dogs with Verbal Communication
by: Hayamizu, Yohei, et al.
Published: (2026) -
DKPROMPT: Domain Knowledge Prompting Vision-Language Models for Open-World Planning
by: Zhang, Xiaohan, et al.
Published: (2024) -
Grounded Vision-Language Interpreter for Integrated Task and Motion Planning
by: Siburian, Jeremy, et al.
Published: (2025)