Weiter zum Inhalt
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Login
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Erweitert
  • Takin: A Cohort of Superior Quality Zero-shot Speech Generation Models
Buchumschlag

Takin: A Cohort of Superior Quality Zero-shot Speech Generation Models

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Chen, Sijing, Feng, Yuan, He, Laipeng, He, Tianwei, He, Wendi, Hu, Yanni, Lin, Bin, Lin, Yiting, Pan, Yu, Tan, Pengfei, Tian, Chengwei, Wang, Chen, Wang, Zhicheng, Xie, Ruoye, Yao, Jixun, Yan, Quanlei, Yang, Yuguang, Ye, Jianhao, Yin, Jingjing, Yu, Yanzhen, Zhang, Huimin, Zhang, Xiang, Zhao, Guangcheng, Zhou, Hongbin, Zou, Pengpeng
Format: Preprint
Veröffentlicht: 2024
Schlagworte:
Sound
Artificial Intelligence
Audio and Speech Processing
Online-Zugang:
Acceder al recurso
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
  • Zitieren
  • SMS versenden
  • Als E-Mail versenden
  • Drucken
  • Datensatz exportieren
    • Exportieren nach RefWorks
    • Exportieren nach EndNoteWeb
    • Exportieren nach EndNote
  • Zu den Favoriten
  • Persistenter Link
  • Exemplare
  • Beschreibung
  • Kommentare
  • Ähnliche Einträge
  • Internformat

Online

https://arxiv.org/abs/2409.12139

Ähnliche Einträge

  • Takin-ADA: Emotion Controllable Audio-Driven Animation with Canonical and Landmark Loss Optimization
    von: Lin, Bin, et al.
    Veröffentlicht: (2024)
  • Takin-VC: Expressive Zero-Shot Voice Conversion via Adaptive Hybrid Content Encoding and Enhanced Timbre Modeling
    von: Yang, Yuguang, et al.
    Veröffentlicht: (2024)
  • ClapFM-EVC: High-Fidelity and Flexible Emotional Voice Conversion with Dual Control from Natural Language and Speech
    von: Pan, Yu, et al.
    Veröffentlicht: (2025)
  • Fine-grained Preference Optimization Improves Zero-shot Text-to-Speech
    von: Yao, Jixun, et al.
    Veröffentlicht: (2025)
  • PSCodec: A Series of High-Fidelity Low-bitrate Neural Speech Codecs Leveraging Prompt Encoders
    von: Pan, Yu, et al.
    Veröffentlicht: (2024)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 192,120© 2026 Universidad del Mar