LongCat-AudioDiT: High-Fidelity Diffusion Text-to-Speech in the Waveform Latent Space

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Xin, Detai, Hu, Shujie, Yang, Chengzuo, Huang, Chen, Yu, Guoqiao, Wan, Guanglu, Cai, Xunliang
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!