Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Zhang, Jiazhao, Wang, Kunyu, Wang, Shaoan, Li, Minghan, Liu, Haoran, Wei, Songlin, Wang, Zhongyuan, Zhang, Zhizheng, Wang, He
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!