AVID: A Benchmark for Omni-Modal Audio-Visual Inconsistency Understanding via Agent-Driven Construction

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Chen, Zixuan, Wang, Depeng, Lin, Hao, Luo, Li, Xu, Ke, Guo, Ya, Zhu, Huijia, Sun, Tanfeng, Jiang, Xinghao
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!