AV-Reasoner: Improving and Benchmarking Clue-Grounded Audio-Visual Counting for MLLMs

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Lu, Lidong, Chen, Guo, Li, Zhiqi, Liu, Yicheng, Lu, Tong
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!