What is the Visual Cognition Gap between Humans and Multimodal LLMs?

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Cao, Xu, Shen, Yifan, Lai, Bolin, Ye, Wenqian, Ma, Yunsheng, Heintz, Joerg, Chen, Jintai, Huang, Meihuan, Cao, Jianguo, Zhang, Aidong, Rehg, James M.
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!