Joint Visual and Text Prompting for Improved Object-Centric Perception with Multimodal Large Language Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Jiang, Songtao, Zhang, Yan, Zhou, Chenyi, Jin, Yeying, Feng, Yang, Wu, Jian, Liu, Zuozhu
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!