SnapNTell: Enhancing Entity-Centric Visual Question Answering with Retrieval Augmented Multimodal LLM

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Qiu, Jielin, Madotto, Andrea, Lin, Zhaojiang, Crook, Paul A., Xu, Yifan Ethan, Dong, Xin Luna, Faloutsos, Christos, Li, Lei, Damavandi, Babak, Moon, Seungwhan
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!