VISTA-Bench: Do Vision-Language Models Really Understand Visualized Text as Well as Pure Text?

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Liu, Qing'an, Feng, Juntong, Wang, Yuhao, Han, Xinzhe, Cheng, Yujie, Zhu, Yue, Diao, Haiwen, Zhuge, Yunzhi, Lu, Huchuan
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!