WAVE: Learning Unified & Versatile Audio-Visual Embeddings with Multimodal LLM

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Tang, Changli, Xiao, Qinfan, Mei, Ke, Wang, Tianyi, Rao, Fengyun, Zhang, Chao
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!