AMUSE: Audio-Visual Benchmark and Alignment Framework for Agentic Multi-Speaker Understanding

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Chowdhury, Sanjoy, Yang, Karren D., Liu, Xudong, Faghri, Fartash, Vasu, Pavan Kumar Anasosalu, Tuzel, Oncel, Manocha, Dinesh, Li, Chun-Liang, Vemulapalli, Raviteja
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!