$\left|\,\circlearrowright\,\boxed{\text{BUS}}\,\right|$: A Large and Diverse Multimodal Benchmark for evaluating the ability of Vision-Language Models to understand Rebus Puzzles

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Das, Trishanu, Nandy, Abhilash, Bajaj, Khush, S, Deepiha
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!