"I See What You Did There": Can Large Vision-Language Models Understand Multimodal Puns?

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Xu, Naen, Sheng, Jiayi, Li, Changjiang, Zhou, Chunyi, Li, Yuyuan, Du, Tianyu, Wang, Jun, Fu, Zhihui, Li, Jinbao, Ji, Shouling
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!

Ähnliche Einträge