HALL-E: Hierarchical Neural Codec Language Model for Minute-Long Zero-Shot Text-to-Speech Synthesis

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Nishimura, Yuto, Hirose, Takumi, Ohi, Masanari, Nakayama, Hideki, Inoue, Nakamasa
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!