Prompt-Singer: Controllable Singing-Voice-Synthesis with Natural Language Prompt
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Yongqi, Hu, Ruofan, Huang, Rongjie, Hong, Zhiqing, Li, Ruiqi, Liu, Wenrui, You, Fuming, Jin, Tao, Zhao, Zhou |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Robust Singing Voice Transcription Serves Synthesis
por: Li, Ruiqi, et al.
Publicado: (2024)
por: Li, Ruiqi, et al.
Publicado: (2024)
Self-Supervised Singing Voice Pre-Training towards Speech-to-Singing Conversion
por: Li, Ruiqi, et al.
Publicado: (2024)
por: Li, Ruiqi, et al.
Publicado: (2024)
Accompanied Singing Voice Synthesis with Fully Text-controlled Melody
por: Li, Ruiqi, et al.
Publicado: (2024)
por: Li, Ruiqi, et al.
Publicado: (2024)
StyleSinger: Style Transfer for Out-of-Domain Singing Voice Synthesis
por: Zhang, Yu, et al.
Publicado: (2023)
por: Zhang, Yu, et al.
Publicado: (2023)
SingIt! Singer Voice Transformation
por: Eliav, Amit, et al.
Publicado: (2024)
por: Eliav, Amit, et al.
Publicado: (2024)
BiSinger: Bilingual Singing Voice Synthesis
por: Zhou, Huali, et al.
Publicado: (2023)
por: Zhou, Huali, et al.
Publicado: (2023)
VS-Singer: Vision-Guided Stereo Singing Voice Synthesis with Consistency Schrödinger Bridge
por: Zhao, Zijing, et al.
Publicado: (2025)
por: Zhao, Zijing, et al.
Publicado: (2025)
TCSinger: Zero-Shot Singing Voice Synthesis with Style Transfer and Multi-Level Style Control
por: Zhang, Yu, et al.
Publicado: (2024)
por: Zhang, Yu, et al.
Publicado: (2024)
Synthetic Singers: A Review of Deep-Learning-based Singing Voice Synthesis Approaches
por: Pan, Changhao, et al.
Publicado: (2026)
por: Pan, Changhao, et al.
Publicado: (2026)
Period Singer: Integrating Periodic and Aperiodic Variational Autoencoders for Natural-Sounding End-to-End Singing Voice Synthesis
por: Kim, Taewoo, et al.
Publicado: (2024)
por: Kim, Taewoo, et al.
Publicado: (2024)
Speech-to-Speech Translation with Discrete-Unit-Based Style Transfer
por: Wang, Yongqi, et al.
Publicado: (2023)
por: Wang, Yongqi, et al.
Publicado: (2023)
MoMu-Diffusion: On Learning Long-Term Motion-Music Synchronization and Correspondence
por: You, Fuming, et al.
Publicado: (2024)
por: You, Fuming, et al.
Publicado: (2024)
Versatile Framework for Song Generation with Prompt-based Control
por: Zhang, Yu, et al.
Publicado: (2025)
por: Zhang, Yu, et al.
Publicado: (2025)
YingMusic-Singer-Plus: Controllable Singing Voice Synthesis with Flexible Lyric Manipulation and Annotation-free Melody Guidance
por: Hao, Chunbo, et al.
Publicado: (2026)
por: Hao, Chunbo, et al.
Publicado: (2026)
PerformSinger: Multimodal Singing Voice Synthesis Leveraging Synchronized Lip Cues from Singing Performance Videos
por: Gu, Ke, et al.
Publicado: (2025)
por: Gu, Ke, et al.
Publicado: (2025)
MuSE-SVS: Multi-Singer Emotional Singing Voice Synthesizer that Controls Emotional Intensity
por: Kim, Sungjae, et al.
Publicado: (2022)
por: Kim, Sungjae, et al.
Publicado: (2022)
TokSing: Singing Voice Synthesis based on Discrete Tokens
por: Wu, Yuning, et al.
Publicado: (2024)
por: Wu, Yuning, et al.
Publicado: (2024)
SoulX-Singer: Towards High-Quality Zero-Shot Singing Voice Synthesis
por: Qian, Jiale, et al.
Publicado: (2026)
por: Qian, Jiale, et al.
Publicado: (2026)
PromptEVC: Controllable Emotional Voice Conversion with Natural Language Prompts
por: Qi, Tianhua, et al.
Publicado: (2025)
por: Qi, Tianhua, et al.
Publicado: (2025)
Everyone-Can-Sing: Zero-Shot Singing Voice Synthesis and Conversion with Speech Reference
por: Dai, Shuqi, et al.
Publicado: (2025)
por: Dai, Shuqi, et al.
Publicado: (2025)
Muskits-ESPnet: A Comprehensive Toolkit for Singing Voice Synthesis in New Paradigm
por: Wu, Yuning, et al.
Publicado: (2024)
por: Wu, Yuning, et al.
Publicado: (2024)
LDM-SVC: Latent Diffusion Model Based Zero-Shot Any-to-Any Singing Voice Conversion with Singer Guidance
por: Chen, Shihao, et al.
Publicado: (2024)
por: Chen, Shihao, et al.
Publicado: (2024)
ConSinger: Efficient High-Fidelity Singing Voice Generation with Minimal Steps
por: Song, Yulin, et al.
Publicado: (2024)
por: Song, Yulin, et al.
Publicado: (2024)
SingMOS: An extensive Open-Source Singing Voice Dataset for MOS Prediction
por: Tang, Yuxun, et al.
Publicado: (2024)
por: Tang, Yuxun, et al.
Publicado: (2024)
SingFake: Singing Voice Deepfake Detection
por: Zang, Yongyi, et al.
Publicado: (2023)
por: Zang, Yongyi, et al.
Publicado: (2023)
Frieren: Efficient Video-to-Audio Generation Network with Rectified Flow Matching
por: Wang, Yongqi, et al.
Publicado: (2024)
por: Wang, Yongqi, et al.
Publicado: (2024)
TCSinger 2: Customizable Multilingual Zero-shot Singing Voice Synthesis
por: Zhang, Yu, et al.
Publicado: (2025)
por: Zhang, Yu, et al.
Publicado: (2025)
Singing Voice Data Scaling-up: An Introduction to ACE-Opencpop and ACE-KiSing
por: Shi, Jiatong, et al.
Publicado: (2024)
por: Shi, Jiatong, et al.
Publicado: (2024)
Enhancing Spectrogram Realism in Singing Voice Synthesis via Explicit Bandwidth Extension Prior to Vocoder
por: Yang, Runxuan, et al.
Publicado: (2025)
por: Yang, Runxuan, et al.
Publicado: (2025)
RDSinger: Reference-based Diffusion Network for Singing Voice Synthesis
por: Sui, Kehan, et al.
Publicado: (2024)
por: Sui, Kehan, et al.
Publicado: (2024)
Neural Concatenative Singing Voice Conversion: Rethinking Concatenation-Based Approach for One-Shot Singing Voice Conversion
por: Sha, Binzhu, et al.
Publicado: (2023)
por: Sha, Binzhu, et al.
Publicado: (2023)
Adversarial Multi-Task Learning for Disentangling Timbre and Pitch in Singing Voice Synthesis
por: Kim, Tae-Woo, et al.
Publicado: (2022)
por: Kim, Tae-Woo, et al.
Publicado: (2022)
Singing Voice Synthesis Using Differentiable LPC and Glottal-Flow-Inspired Wavetables
por: Yu, Chin-Yun, et al.
Publicado: (2023)
por: Yu, Chin-Yun, et al.
Publicado: (2023)
SingVERSE: A Diverse, Real-World Benchmark for Singing Voice Enhancement
por: Jiang, Shaohan, et al.
Publicado: (2025)
por: Jiang, Shaohan, et al.
Publicado: (2025)
InstructSing: High-Fidelity Singing Voice Generation via Instructing Yourself
por: Zeng, Chang, et al.
Publicado: (2024)
por: Zeng, Chang, et al.
Publicado: (2024)
Text-to-Song: Towards Controllable Music Generation Incorporating Vocals and Accompaniment
por: Hong, Zhiqing, et al.
Publicado: (2024)
por: Hong, Zhiqing, et al.
Publicado: (2024)
Controllable Singing Voice Synthesis using Phoneme-Level Energy Sequence
por: Ryu, Yerin, et al.
Publicado: (2025)
por: Ryu, Yerin, et al.
Publicado: (2025)
SingNet: Towards a Large-Scale, Diverse, and In-the-Wild Singing Voice Dataset
por: Gu, Yicheng, et al.
Publicado: (2025)
por: Gu, Yicheng, et al.
Publicado: (2025)
SVDD 2024: The Inaugural Singing Voice Deepfake Detection Challenge
por: Zhang, You, et al.
Publicado: (2024)
por: Zhang, You, et al.
Publicado: (2024)
SiFiSinger: A High-Fidelity End-to-End Singing Voice Synthesizer based on Source-filter Model
por: Cui, Jianwei, et al.
Publicado: (2024)
por: Cui, Jianwei, et al.
Publicado: (2024)
Ejemplares similares
-
Robust Singing Voice Transcription Serves Synthesis
por: Li, Ruiqi, et al.
Publicado: (2024) -
Self-Supervised Singing Voice Pre-Training towards Speech-to-Singing Conversion
por: Li, Ruiqi, et al.
Publicado: (2024) -
Accompanied Singing Voice Synthesis with Fully Text-controlled Melody
por: Li, Ruiqi, et al.
Publicado: (2024) -
StyleSinger: Style Transfer for Out-of-Domain Singing Voice Synthesis
por: Zhang, Yu, et al.
Publicado: (2023) -
SingIt! Singer Voice Transformation
por: Eliav, Amit, et al.
Publicado: (2024)