Cog-GA: A Large Language Models-based Generative Agent for Vision-Language Navigation in Continuous Environments
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Zhiyuan, Lu, Yanfeng, Mu, Yao, Qiao, Hong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Vision-Language Navigation with Continual Learning
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments
di: Li, Zerui, et al.
Pubblicazione: (2025)
di: Li, Zerui, et al.
Pubblicazione: (2025)
Interactive Navigation in Environments with Traversable Obstacles Using Large Language and Vision-Language Models
di: Zhang, Zhen, et al.
Pubblicazione: (2023)
di: Zhang, Zhen, et al.
Pubblicazione: (2023)
IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor Environments
di: Liu, Xu, et al.
Pubblicazione: (2025)
di: Liu, Xu, et al.
Pubblicazione: (2025)
AINav: Large Language Model-Based Adaptive Interactive Navigation
di: Zhou, Kangjie, et al.
Pubblicazione: (2025)
di: Zhou, Kangjie, et al.
Pubblicazione: (2025)
GAgent: An Adaptive Rigid-Soft Gripping Agent with Vision Language Models for Complex Lighting Environments
di: Li, Zhuowei, et al.
Pubblicazione: (2024)
di: Li, Zhuowei, et al.
Pubblicazione: (2024)
How Secure Are Large Language Models (LLMs) for Navigation in Urban Environments?
di: Wen, Congcong, et al.
Pubblicazione: (2024)
di: Wen, Congcong, et al.
Pubblicazione: (2024)
VLA-AN: An Efficient and Onboard Vision-Language-Action Framework for Aerial Navigation in Complex Environments
di: Wu, Yuze, et al.
Pubblicazione: (2025)
di: Wu, Yuze, et al.
Pubblicazione: (2025)
SayNav: Grounding Large Language Models for Dynamic Planning to Navigation in New Environments
di: Rajvanshi, Abhinav, et al.
Pubblicazione: (2023)
di: Rajvanshi, Abhinav, et al.
Pubblicazione: (2023)
Learning Reward for Robot Skills Using Large Language Models via Self-Alignment
di: Zeng, Yuwei, et al.
Pubblicazione: (2024)
di: Zeng, Yuwei, et al.
Pubblicazione: (2024)
Endowing Embodied Agents with Spatial Reasoning Capabilities for Vision-and-Language Navigation
di: Bai, Qianqian, et al.
Pubblicazione: (2025)
di: Bai, Qianqian, et al.
Pubblicazione: (2025)
LACY: A Vision-Language Model-based Language-Action Cycle for Self-Improving Robotic Manipulation
di: Hong, Youngjin, et al.
Pubblicazione: (2025)
di: Hong, Youngjin, et al.
Pubblicazione: (2025)
SafeDrive: Knowledge- and Data-Driven Risk-Sensitive Decision-Making for Autonomous Vehicles with Large Language Models
di: Zhou, Zhiyuan, et al.
Pubblicazione: (2024)
di: Zhou, Zhiyuan, et al.
Pubblicazione: (2024)
SkyVLN: Vision-and-Language Navigation and NMPC Control for UAVs in Urban Environments
di: Li, Tianshun, et al.
Pubblicazione: (2025)
di: Li, Tianshun, et al.
Pubblicazione: (2025)
Continually Evolving Skill Knowledge in Vision Language Action Model
di: Wu, Yuxuan, et al.
Pubblicazione: (2025)
di: Wu, Yuxuan, et al.
Pubblicazione: (2025)
CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
Zero-shot Object Navigation with Vision-Language Models Reasoning
di: Wen, Congcong, et al.
Pubblicazione: (2024)
di: Wen, Congcong, et al.
Pubblicazione: (2024)
HiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
Active Test-time Vision-Language Navigation
di: Ko, Heeju, et al.
Pubblicazione: (2025)
di: Ko, Heeju, et al.
Pubblicazione: (2025)
CoFL: Continuous Flow Fields for Language-Conditioned Navigation
di: Liu, Haokun, et al.
Pubblicazione: (2026)
di: Liu, Haokun, et al.
Pubblicazione: (2026)
General-Purpose Aerial Intelligent Agents Empowered by Large Language Models
di: Zhao, Ji, et al.
Pubblicazione: (2025)
di: Zhao, Ji, et al.
Pubblicazione: (2025)
WMPO: World Model-based Policy Optimization for Vision-Language-Action Models
di: Zhu, Fangqi, et al.
Pubblicazione: (2025)
di: Zhu, Fangqi, et al.
Pubblicazione: (2025)
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
di: Wu, Yanru, et al.
Pubblicazione: (2026)
di: Wu, Yanru, et al.
Pubblicazione: (2026)
HTNav: A Hybrid Navigation Framework with Tiered Structure for Urban Aerial Vision-and-Language Navigation
di: Fan, Chengjie, et al.
Pubblicazione: (2026)
di: Fan, Chengjie, et al.
Pubblicazione: (2026)
Probing a Vision-Language-Action Model for Symbolic States and Integration into a Cognitive Architecture
di: Lu, Hong, et al.
Pubblicazione: (2025)
di: Lu, Hong, et al.
Pubblicazione: (2025)
SmoothVLA: Aligning Vision-Language-Action Models with Physical Constraints via Intrinsic Smoothness Optimization
di: Li, Jiashun, et al.
Pubblicazione: (2026)
di: Li, Jiashun, et al.
Pubblicazione: (2026)
3DGSNav: Enhancing Vision-Language Model Reasoning for Object Navigation via Active 3D Gaussian Splatting
di: Zheng, Wancai, et al.
Pubblicazione: (2026)
di: Zheng, Wancai, et al.
Pubblicazione: (2026)
SUM-AgriVLN: Spatial Understanding Memory for Agricultural Vision-and-Language Navigation
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
OpenNav: Open-World Navigation with Multimodal Large Language Models
di: Yuan, Mingfeng, et al.
Pubblicazione: (2025)
di: Yuan, Mingfeng, et al.
Pubblicazione: (2025)
Co-NavGPT: Multi-Robot Cooperative Visual Semantic Navigation Using Vision Language Models
di: Yu, Bangguo, et al.
Pubblicazione: (2023)
di: Yu, Bangguo, et al.
Pubblicazione: (2023)
Eurekaverse: Environment Curriculum Generation via Large Language Models
di: Liang, William, et al.
Pubblicazione: (2024)
di: Liang, William, et al.
Pubblicazione: (2024)
DexHiL: A Human-in-the-Loop Framework for Vision-Language-Action Model Post-Training in Dexterous Manipulation
di: Han, Yifan, et al.
Pubblicazione: (2026)
di: Han, Yifan, et al.
Pubblicazione: (2026)
ProgressVLA: Progress-Guided Diffusion Policy for Vision-Language Robotic Manipulation
di: Yan, Hongyu, et al.
Pubblicazione: (2026)
di: Yan, Hongyu, et al.
Pubblicazione: (2026)
Less is More: Lean yet Powerful Vision-Language Model for Autonomous Driving
di: Yang, Sheng, et al.
Pubblicazione: (2025)
di: Yang, Sheng, et al.
Pubblicazione: (2025)
History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation
di: Habibpour, Mobin, et al.
Pubblicazione: (2025)
di: Habibpour, Mobin, et al.
Pubblicazione: (2025)
VLM-RRT: Vision Language Model Guided RRT Search for Autonomous UAV Navigation
di: Ye, Jianlin, et al.
Pubblicazione: (2025)
di: Ye, Jianlin, et al.
Pubblicazione: (2025)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
EvoNav: Evolutionary Reward Function Design for Robot Navigation with Large Language Models
di: Zhao, Zhikai, et al.
Pubblicazione: (2026)
di: Zhao, Zhikai, et al.
Pubblicazione: (2026)
A Large Vision-Language Model based Environment Perception System for Visually Impaired People
di: Chen, Zezhou, et al.
Pubblicazione: (2025)
di: Chen, Zezhou, et al.
Pubblicazione: (2025)
SAFE: Multitask Failure Detection for Vision-Language-Action Models
di: Gu, Qiao, et al.
Pubblicazione: (2025)
di: Gu, Qiao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Vision-Language Navigation with Continual Learning
di: Li, Zhiyuan, et al.
Pubblicazione: (2024) -
Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments
di: Li, Zerui, et al.
Pubblicazione: (2025) -
Interactive Navigation in Environments with Traversable Obstacles Using Large Language and Vision-Language Models
di: Zhang, Zhen, et al.
Pubblicazione: (2023) -
IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor Environments
di: Liu, Xu, et al.
Pubblicazione: (2025) -
AINav: Large Language Model-Based Adaptive Interactive Navigation
di: Zhou, Kangjie, et al.
Pubblicazione: (2025)