SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Yin, Han, Chen, Yafeng, Deng, Chong, Cheng, Luyao, Wang, Hui, Tan, Chao-Hong, Chen, Qian, Wang, Wen, Li, Xiangang
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!