Enregistré dans:
| Auteurs principaux: | Wang, Zihao, Yuan, Ruibin, Geng, Ziqi, Li, Hengjia, Qu, Xingwei, Li, Xinyi, Chen, Songye, Fu, Haoying, Dannenberg, Roger B., Zhang, Kejun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2512.07005 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Singing Timbre Popularity Assessment Based on Multimodal Large Foundation Model
par: Wang, Zihao, et autres
Publié: (2025)
par: Wang, Zihao, et autres
Publié: (2025)
Everyone-Can-Sing: Zero-Shot Singing Voice Synthesis and Conversion with Speech Reference
par: Dai, Shuqi, et autres
Publié: (2025)
par: Dai, Shuqi, et autres
Publié: (2025)
UniVocal: Unified Speech-Singing Code-Switching Synthesis
par: Shi, Yufei, et autres
Publié: (2026)
par: Shi, Yufei, et autres
Publié: (2026)
Investigation of Deep Neural Network Acoustic Modelling Approaches for Low Resource Accented Mandarin Speech Recognition
par: Xie, Xurong, et autres
Publié: (2022)
par: Xie, Xurong, et autres
Publié: (2022)
SingNet: Towards a Large-Scale, Diverse, and In-the-Wild Singing Voice Dataset
par: Gu, Yicheng, et autres
Publié: (2025)
par: Gu, Yicheng, et autres
Publié: (2025)
A Unified Model For Voice and Accent Conversion In Speech and Singing using Self-Supervised Learning and Feature Extraction
par: Cheripally, Sowmya
Publié: (2024)
par: Cheripally, Sowmya
Publié: (2024)
MacST: Multi-Accent Speech Synthesis via Text Transliteration for Accent Conversion
par: Inoue, Sho, et autres
Publié: (2024)
par: Inoue, Sho, et autres
Publié: (2024)
AccentFold: A Journey through African Accents for Zero-Shot ASR Adaptation to Target Accents
par: Owodunni, Abraham Toluwase, et autres
Publié: (2024)
par: Owodunni, Abraham Toluwase, et autres
Publié: (2024)
Multi-Scale Accent Modeling and Disentangling for Multi-Speaker Multi-Accent Text-to-Speech Synthesis
par: Zhou, Xuehao, et autres
Publié: (2024)
par: Zhou, Xuehao, et autres
Publié: (2024)
Singing Voice Graph Modeling for SingFake Detection
par: Chen, Xuanjun, et autres
Publié: (2024)
par: Chen, Xuanjun, et autres
Publié: (2024)
SingMOS-Pro: An Comprehensive Benchmark for Singing Quality Assessment
par: Tang, Yuxun, et autres
Publié: (2025)
par: Tang, Yuxun, et autres
Publié: (2025)
CosyAccent: Duration-Controllable Accent Normalization Using Source-Synthesis Training Data
par: Bai, Qibing, et autres
Publié: (2026)
par: Bai, Qibing, et autres
Publié: (2026)
SingMOS: An extensive Open-Source Singing Voice Dataset for MOS Prediction
par: Tang, Yuxun, et autres
Publié: (2024)
par: Tang, Yuxun, et autres
Publié: (2024)
AccentBox: Towards High-Fidelity Zero-Shot Accent Generation
par: Zhong, Jinzuomu, et autres
Publié: (2024)
par: Zhong, Jinzuomu, et autres
Publié: (2024)
CodecMOS-Accent: A MOS Benchmark of Resynthesized and TTS Speech from Neural Codecs Across English Accents
par: Huang, Wen-Chin, et autres
Publié: (2026)
par: Huang, Wen-Chin, et autres
Publié: (2026)
SingVERSE: A Diverse, Real-World Benchmark for Singing Voice Enhancement
par: Jiang, Shaohan, et autres
Publié: (2025)
par: Jiang, Shaohan, et autres
Publié: (2025)
SpeechAccentLLM: A Unified Framework for Foreign Accent Conversion and Text to Speech
par: Cheng, Zhuangfei, et autres
Publié: (2025)
par: Cheng, Zhuangfei, et autres
Publié: (2025)
CartoonSing: Unifying Human and Nonhuman Timbres in Singing Generation
par: Han, Jionghao, et autres
Publié: (2025)
par: Han, Jionghao, et autres
Publié: (2025)
LID Models are Actually Accent Classifiers: Implications and Solutions for LID on Accented Speech
par: Bafna, Niyati, et autres
Publié: (2025)
par: Bafna, Niyati, et autres
Publié: (2025)
Singing Voice Data Scaling-up: An Introduction to ACE-Opencpop and ACE-KiSing
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
Contrastive Regularization for Accent-Robust ASR
par: Thai, Van-Phat, et autres
Publié: (2026)
par: Thai, Van-Phat, et autres
Publié: (2026)
Self-Supervised Singing Voice Pre-Training towards Speech-to-Singing Conversion
par: Li, Ruiqi, et autres
Publié: (2024)
par: Li, Ruiqi, et autres
Publié: (2024)
Spectral Mapping of Singing Voices: U-Net-Assisted Vocal Segmentation
par: Sorrenti, Adam
Publié: (2024)
par: Sorrenti, Adam
Publié: (2024)
SingFake: Singing Voice Deepfake Detection
par: Zang, Yongyi, et autres
Publié: (2023)
par: Zang, Yongyi, et autres
Publié: (2023)
Clustering and Mining Accented Speech for Inclusive and Fair Speech Recognition
par: Kim, Jaeyoung, et autres
Publié: (2024)
par: Kim, Jaeyoung, et autres
Publié: (2024)
Pitch Accent Detection improves Pretrained Automatic Speech Recognition
par: Sasu, David, et autres
Publié: (2025)
par: Sasu, David, et autres
Publié: (2025)
PSP: An Interpretable Per-Dimension Accent Benchmark for Indic Text-to-Speech
par: Menta, Venkata Pushpak Teja
Publié: (2026)
par: Menta, Venkata Pushpak Teja
Publié: (2026)
Generating Separated Singing Vocals Using a Diffusion Model Conditioned on Music Mixtures
par: Plaja-Roglans, Genís, et autres
Publié: (2025)
par: Plaja-Roglans, Genís, et autres
Publié: (2025)
TokSing: Singing Voice Synthesis based on Discrete Tokens
par: Wu, Yuning, et autres
Publié: (2024)
par: Wu, Yuning, et autres
Publié: (2024)
SingingSDS: A Singing-Capable Spoken Dialogue System for Conversational Roleplay Applications
par: Han, Jionghao, et autres
Publié: (2025)
par: Han, Jionghao, et autres
Publié: (2025)
Controllable Accent Normalization via Discrete Diffusion
par: Bai, Qibing, et autres
Publié: (2026)
par: Bai, Qibing, et autres
Publié: (2026)
Effects of Speaker Count, Duration, and Accent Diversity on Zero-Shot Accent Robustness in Low-Resource ASR
par: Yong, Zheng-Xin, et autres
Publié: (2025)
par: Yong, Zheng-Xin, et autres
Publié: (2025)
VocalParse: Towards Unified and Scalable Singing Voice Transcription with Large Audio Language Models
par: Chen, Yukun, et autres
Publié: (2026)
par: Chen, Yukun, et autres
Publié: (2026)
Adapting Automatic Speech Recognition for Accented Air Traffic Control Communications
par: Wee, Marcus Yu Zhe, et autres
Publié: (2025)
par: Wee, Marcus Yu Zhe, et autres
Publié: (2025)
YingMusic-SVC: Real-World Robust Zero-Shot Singing Voice Conversion with Flow-GRPO and Singing-Specific Inductive Biases
par: Chen, Gongyu, et autres
Publié: (2025)
par: Chen, Gongyu, et autres
Publié: (2025)
Poly-SVC: Polyphony-Aware Singing Voice Conversion with Harmonic Modeling
par: Geng, Chen, et autres
Publié: (2026)
par: Geng, Chen, et autres
Publié: (2026)
DJCM: A Deep Joint Cascade Model for Singing Voice Separation and Vocal Pitch Estimation
par: Wei, Haojie, et autres
Publié: (2024)
par: Wei, Haojie, et autres
Publié: (2024)
A Survey on 30+ Years of Automatic Singing Assessment and Singing Information Processing
par: Santos, Arthur N. dos, et autres
Publié: (2026)
par: Santos, Arthur N. dos, et autres
Publié: (2026)
InstructSing: High-Fidelity Singing Voice Generation via Instructing Yourself
par: Zeng, Chang, et autres
Publié: (2024)
par: Zeng, Chang, et autres
Publié: (2024)
Neural Concatenative Singing Voice Conversion: Rethinking Concatenation-Based Approach for One-Shot Singing Voice Conversion
par: Sha, Binzhu, et autres
Publié: (2023)
par: Sha, Binzhu, et autres
Publié: (2023)
Documents similaires
-
Singing Timbre Popularity Assessment Based on Multimodal Large Foundation Model
par: Wang, Zihao, et autres
Publié: (2025) -
Everyone-Can-Sing: Zero-Shot Singing Voice Synthesis and Conversion with Speech Reference
par: Dai, Shuqi, et autres
Publié: (2025) -
UniVocal: Unified Speech-Singing Code-Switching Synthesis
par: Shi, Yufei, et autres
Publié: (2026) -
Investigation of Deep Neural Network Acoustic Modelling Approaches for Low Resource Accented Mandarin Speech Recognition
par: Xie, Xurong, et autres
Publié: (2022) -
SingNet: Towards a Large-Scale, Diverse, and In-the-Wild Singing Voice Dataset
par: Gu, Yicheng, et autres
Publié: (2025)