CtrSVDD: A Benchmark Dataset and Baseline Analysis for Controlled Singing Voice Deepfake Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zang, Yongyi, Shi, Jiatong, Zhang, You, Yamamoto, Ryuichi, Han, Jionghao, Tang, Yuxun, Xu, Shengyuan, Zhao, Wenxiao, Guo, Jing, Toda, Tomoki, Duan, Zhiyao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SVDD 2024: The Inaugural Singing Voice Deepfake Detection Challenge
par: Zhang, You, et autres
Publié: (2024)
par: Zhang, You, et autres
Publié: (2024)
SVDD Challenge 2024: A Singing Voice Deepfake Detection Challenge Evaluation Plan
par: Zhang, You, et autres
Publié: (2024)
par: Zhang, You, et autres
Publié: (2024)
Speech Foundation Model Ensembles for the Controlled Singing Voice Deepfake Detection (CtrSVDD) Challenge 2024
par: Guragain, Anmol, et autres
Publié: (2024)
par: Guragain, Anmol, et autres
Publié: (2024)
SingFake: Singing Voice Deepfake Detection
par: Zang, Yongyi, et autres
Publié: (2023)
par: Zang, Yongyi, et autres
Publié: (2023)
Towards Source Attribution of Singing Voice Deepfake with Multimodal Foundation Models
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
A Multi-Stream Fusion Approach with One-Class Learning for Audio-Visual Deepfake Detection
par: Lee, Kyungbok, et autres
Publié: (2024)
par: Lee, Kyungbok, et autres
Publié: (2024)
SynthTab: Leveraging Synthesized Data for Guitar Tablature Transcription
par: Zang, Yongyi, et autres
Publié: (2023)
par: Zang, Yongyi, et autres
Publié: (2023)
SingMOS: An extensive Open-Source Singing Voice Dataset for MOS Prediction
par: Tang, Yuxun, et autres
Publié: (2024)
par: Tang, Yuxun, et autres
Publié: (2024)
PerformSinger: Multimodal Singing Voice Synthesis Leveraging Synchronized Lip Cues from Singing Performance Videos
par: Gu, Ke, et autres
Publié: (2025)
par: Gu, Ke, et autres
Publié: (2025)
Efficient Adapter Tuning for Joint Singing Voice Beat and Downbeat Tracking with Self-supervised Learning Features
par: Deng, Jiajun, et autres
Publié: (2025)
par: Deng, Jiajun, et autres
Publié: (2025)
VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
SingMOS-Pro: An Comprehensive Benchmark for Singing Quality Assessment
par: Tang, Yuxun, et autres
Publié: (2025)
par: Tang, Yuxun, et autres
Publié: (2025)
MF-AED-AEC: Speech Emotion Recognition by Leveraging Multimodal Fusion, Asr Error Detection, and Asr Error Correction
par: He, Jiajun, et autres
Publié: (2024)
par: He, Jiajun, et autres
Publié: (2024)
TokSing: Singing Voice Synthesis based on Discrete Tokens
par: Wu, Yuning, et autres
Publié: (2024)
par: Wu, Yuning, et autres
Publié: (2024)
MusicSem: A Semantically Rich Language--Audio Dataset of Natural Music Descriptions
par: Salganik, Rebecca, et autres
Publié: (2026)
par: Salganik, Rebecca, et autres
Publié: (2026)
VocalCrypt: Novel Active Defense Against Deepfake Voice Based on Masking Effect
par: Fei, Qingyuan, et autres
Publié: (2025)
par: Fei, Qingyuan, et autres
Publié: (2025)
Muskits-ESPnet: A Comprehensive Toolkit for Singing Voice Synthesis in New Paradigm
par: Wu, Yuning, et autres
Publié: (2024)
par: Wu, Yuning, et autres
Publié: (2024)
RVCBench: Benchmarking the Robustness of Voice Cloning Across Modern Audio Generation Models
par: Jin, Ruinan, et autres
Publié: (2026)
par: Jin, Ruinan, et autres
Publié: (2026)
An Extensive Analysis of the Singing Voice Conversion Challenge 2025 Evaluation Results
par: Violeta, Lester Phillip, et autres
Publié: (2025)
par: Violeta, Lester Phillip, et autres
Publié: (2025)
A Unified Framework for Modality-Agnostic Deepfakes Detection
par: Yu, Cai, et autres
Publié: (2023)
par: Yu, Cai, et autres
Publié: (2023)
VISinger2+: End-to-End Singing Voice Synthesis Augmented by Self-Supervised Learning Representation
par: Yu, Yifeng, et autres
Publié: (2024)
par: Yu, Yifeng, et autres
Publié: (2024)
kNN-SVC: Robust Zero-Shot Singing Voice Conversion with Additive Synthesis and Concatenation Smoothness Optimization
par: Shao, Keren, et autres
Publié: (2025)
par: Shao, Keren, et autres
Publié: (2025)
SingOMD: Singing Oriented Multi-resolution Discrete Representation Construction from Speech Models
par: Tang, Yuxun, et autres
Publié: (2024)
par: Tang, Yuxun, et autres
Publié: (2024)
Singing Voice Data Scaling-up: An Introduction to ACE-Opencpop and ACE-KiSing
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
HybridVC: Efficient Voice Style Conversion with Text and Audio Prompts
par: Niu, Xinlei, et autres
Publié: (2024)
par: Niu, Xinlei, et autres
Publié: (2024)
Face-Voice Association for Audiovisual Active Speaker Detection in Egocentric Recordings
par: Clarke, Jason, et autres
Publié: (2025)
par: Clarke, Jason, et autres
Publié: (2025)
Voice Evaluation of Reasoning Ability: Diagnosing the Modality-Induced Performance Gap
par: Lin, Yueqian, et autres
Publié: (2025)
par: Lin, Yueqian, et autres
Publié: (2025)
Attentive-based Multi-level Feature Fusion for Voice Disorder Diagnosis
par: Shen, Lipeng, et autres
Publié: (2024)
par: Shen, Lipeng, et autres
Publié: (2024)
A Dataset and Baselines for Measuring and Predicting the Music Piece Memorability
par: Tseng, Li-Yang, et autres
Publié: (2024)
par: Tseng, Li-Yang, et autres
Publié: (2024)
A Survey on Speech Deepfake Detection
par: Li, Menglu, et autres
Publié: (2024)
par: Li, Menglu, et autres
Publié: (2024)
Hindi audio-video-Deepfake (HAV-DF): A Hindi language-based Audio-video Deepfake Dataset
par: Kaur, Sukhandeep, et autres
Publié: (2024)
par: Kaur, Sukhandeep, et autres
Publié: (2024)
REWIND: Speech Time Reversal for Enhancing Speaker Representations in Diffusion-based Voice Conversion
par: Biyani, Ishan D., et autres
Publié: (2025)
par: Biyani, Ishan D., et autres
Publié: (2025)
ecVoice: Audio Text Extraction and Optimization of Video Based on Idioms Similarity Replacement
par: Lin, Jinwei
Publié: (2024)
par: Lin, Jinwei
Publié: (2024)
M3SD: Multi-modal, Multi-scenario and Multi-language Speaker Diarization Dataset
par: Wu, Shilong
Publié: (2025)
par: Wu, Shilong
Publié: (2025)
Wavehax: Aliasing-Free Neural Waveform Synthesis Based on 2D Convolution and Harmonic Prior for Reliable Complex Spectrogram Estimation
par: Yoneyama, Reo, et autres
Publié: (2024)
par: Yoneyama, Reo, et autres
Publié: (2024)
ARECHO: Autoregressive Evaluation via Chain-Based Hypothesis Optimization for Speech Multi-Metric Estimation
par: Shi, Jiatong, et autres
Publié: (2025)
par: Shi, Jiatong, et autres
Publié: (2025)
SongBsAb: A Dual Prevention Approach against Singing Voice Conversion based Illegal Song Covers
par: Chen, Guangke, et autres
Publié: (2024)
par: Chen, Guangke, et autres
Publié: (2024)
AsyncVoice Agent: Real-Time Explanation for LLM Planning and Reasoning
par: Lin, Yueqian, et autres
Publié: (2025)
par: Lin, Yueqian, et autres
Publié: (2025)
CommonVoice-SpeechRE and RPG-MoGe: Advancing Speech Relation Extraction with a New Dataset and Multi-Order Generative Framework
par: Ning, Jinzhong, et autres
Publié: (2025)
par: Ning, Jinzhong, et autres
Publié: (2025)
Every Breath You Don't Take: Deepfake Speech Detection Using Breath
par: Layton, Seth, et autres
Publié: (2024)
par: Layton, Seth, et autres
Publié: (2024)
Documents similaires
-
SVDD 2024: The Inaugural Singing Voice Deepfake Detection Challenge
par: Zhang, You, et autres
Publié: (2024) -
SVDD Challenge 2024: A Singing Voice Deepfake Detection Challenge Evaluation Plan
par: Zhang, You, et autres
Publié: (2024) -
Speech Foundation Model Ensembles for the Controlled Singing Voice Deepfake Detection (CtrSVDD) Challenge 2024
par: Guragain, Anmol, et autres
Publié: (2024) -
SingFake: Singing Voice Deepfake Detection
par: Zang, Yongyi, et autres
Publié: (2023) -
Towards Source Attribution of Singing Voice Deepfake with Multimodal Foundation Models
par: Phukan, Orchid Chetia, et autres
Publié: (2025)