Visual-O1: Understanding Ambiguous Instructions via Multi-modal Multi-turn Chain-of-thoughts Reasoning

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Ni, Minheng, Fan, Yutao, Zhang, Lei, Zuo, Wangmeng
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!