ADD 2022: the First Audio Deep Synthesis Detection Challenge
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yi, Jiangyan, Fu, Ruibo, Tao, Jianhua, Nie, Shuai, Ma, Haoxin, Wang, Chenglong, Wang, Tao, Tian, Zhengkun, Zhang, Xiaohui, Bai, Ye, Fan, Cunhang, Liang, Shan, Wang, Shiming, Zhang, Shuai, Yan, Xinrui, Xu, Le, Wen, Zhengqi, Li, Haizhou, Lian, Zheng, Liu, Bin |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SceneFake: An Initial Dataset and Benchmarks for Scene Fake Audio Detection
par: Yi, Jiangyan, et autres
Publié: (2022)
par: Yi, Jiangyan, et autres
Publié: (2022)
ALLM4ADD: Unlocking the Capabilities of Audio Large Language Models for Audio Deepfake Detection
par: Gu, Hao, et autres
Publié: (2025)
par: Gu, Hao, et autres
Publié: (2025)
ADD 2023: Towards Audio Deepfake Detection and Analysis in the Wild
par: Yi, Jiangyan, et autres
Publié: (2024)
par: Yi, Jiangyan, et autres
Publié: (2024)
RPRA-ADD: Forgery Trace Enhancement-Driven Audio Deepfake Detection
par: Fu, Ruibo, et autres
Publié: (2025)
par: Fu, Ruibo, et autres
Publié: (2025)
EmoFake: An Initial Dataset for Emotion Fake Audio Detection
par: Zhao, Yan, et autres
Publié: (2022)
par: Zhao, Yan, et autres
Publié: (2022)
Dual-Branch Knowledge Distillation for Noise-Robust Synthetic Speech Detection
par: Fan, Cunhang, et autres
Publié: (2023)
par: Fan, Cunhang, et autres
Publié: (2023)
Towards Robust Audio Deepfake Detection: A Evolving Benchmark for Continual Learning
par: Zhang, Xiaohui, et autres
Publié: (2024)
par: Zhang, Xiaohui, et autres
Publié: (2024)
RawBMamba: End-to-End Bidirectional State Space Model for Audio Deepfake Detection
par: Chen, Yujie, et autres
Publié: (2024)
par: Chen, Yujie, et autres
Publié: (2024)
P2Mark: Plug-and-play Parameter-level Watermarking for Neural Speech Generation
par: Ren, Yong, et autres
Publié: (2025)
par: Ren, Yong, et autres
Publié: (2025)
Region-Based Optimization in Continual Learning for Audio Deepfake Detection
par: Chen, Yujie, et autres
Publié: (2024)
par: Chen, Yujie, et autres
Publié: (2024)
Distinguishing Neural Speech Synthesis Models Through Fingerprints in Speech Waveforms
par: Zhang, Chu Yuan, et autres
Publié: (2023)
par: Zhang, Chu Yuan, et autres
Publié: (2023)
Audio Deepfake Attribution: An Initial Dataset and Investigation
par: Yan, Xinrui, et autres
Publié: (2022)
par: Yan, Xinrui, et autres
Publié: (2022)
Spatial Reconstructed Local Attention Res2Net with F0 Subband for Fake Speech Detection
par: Fan, Cunhang, et autres
Publié: (2023)
par: Fan, Cunhang, et autres
Publié: (2023)
AT-ADD: All-Type Audio Deepfake Detection Challenge Evaluation Plan
par: Xie, Yuankun, et autres
Publié: (2026)
par: Xie, Yuankun, et autres
Publié: (2026)
Edit Content, Preserve Acoustics: Imperceptible Text-Based Speech Editing via Self-Consistency Rewards
par: Ren, Yong, et autres
Publié: (2026)
par: Ren, Yong, et autres
Publié: (2026)
Fake News Detection and Manipulation Reasoning via Large Vision-Language Models
par: Jin, Ruihan, et autres
Publié: (2024)
par: Jin, Ruihan, et autres
Publié: (2024)
Utilizing Speaker Profiles for Impersonation Audio Detection
par: Gu, Hao, et autres
Publié: (2024)
par: Gu, Hao, et autres
Publié: (2024)
An Unsupervised Domain Adaptation Method for Locating Manipulated Region in partially fake Audio
par: Zeng, Siding, et autres
Publié: (2024)
par: Zeng, Siding, et autres
Publié: (2024)
TraceableSpeech: Towards Proactively Traceable Text-to-Speech with Watermarking
par: Zhou, Junzuo, et autres
Publié: (2024)
par: Zhou, Junzuo, et autres
Publié: (2024)
Residual Speaker Representation for One-Shot Voice Conversion
par: Xu, Le, et autres
Publié: (2023)
par: Xu, Le, et autres
Publié: (2023)
Generalized Source Tracing: Detecting Novel Audio Deepfake Algorithm with Real Emphasis and Fake Dispersion Strategy
par: Xie, Yuankun, et autres
Publié: (2024)
par: Xie, Yuankun, et autres
Publié: (2024)
Exploring the Role of Audio in Multimodal Misinformation Detection
par: Liu, Moyang, et autres
Publié: (2024)
par: Liu, Moyang, et autres
Publié: (2024)
MINT: a Multi-modal Image and Narrative Text Dubbing Dataset for Foley Audio Content Planning and Generation
par: Fu, Ruibo, et autres
Publié: (2024)
par: Fu, Ruibo, et autres
Publié: (2024)
Reject Threshold Adaptation for Open-Set Model Attribution of Deepfake Audio
par: Yan, Xinrui, et autres
Publié: (2024)
par: Yan, Xinrui, et autres
Publié: (2024)
SecoustiCodec: Cross-Modal Aligned Streaming Single-Codecbook Speech Codec
par: Qiang, Chunyu, et autres
Publié: (2025)
par: Qiang, Chunyu, et autres
Publié: (2025)
Manipulated Regions Localization For Partially Deepfake Audio: A Survey
par: He, Jiayi, et autres
Publié: (2025)
par: He, Jiayi, et autres
Publié: (2025)
PPPR: Portable Plug-in Prompt Refiner for Text to Audio Generation
par: Shi, Shuchen, et autres
Publié: (2024)
par: Shi, Shuchen, et autres
Publié: (2024)
ASRRL-TTS: Agile Speaker Representation Reinforcement Learning for Text-to-Speech Speaker Adaptation
par: Fu, Ruibo, et autres
Publié: (2024)
par: Fu, Ruibo, et autres
Publié: (2024)
AudioRAG: A Challenging Benchmark for Audio Reasoning and Information Retrieval
par: Lin, Jingru, et autres
Publié: (2026)
par: Lin, Jingru, et autres
Publié: (2026)
Does Current Deepfake Audio Detection Model Effectively Detect ALM-based Deepfake Audio?
par: Xie, Yuankun, et autres
Publié: (2024)
par: Xie, Yuankun, et autres
Publié: (2024)
OV-InstructTTS: Towards Open-Vocabulary Instruct Text-to-Speech
par: Ren, Yong, et autres
Publié: (2026)
par: Ren, Yong, et autres
Publié: (2026)
VQ-CTAP: Cross-Modal Fine-Grained Sequence Representation Learning for Speech Processing
par: Qiang, Chunyu, et autres
Publié: (2024)
par: Qiang, Chunyu, et autres
Publié: (2024)
WMCodec: End-to-End Neural Speech Codec with Deep Watermarking for Authenticity Verification
par: Zhou, Junzuo, et autres
Publié: (2024)
par: Zhou, Junzuo, et autres
Publié: (2024)
RadialRouter: Structured Representation for Efficient and Robust Large Language Models Routing
par: Jin, Ruihan, et autres
Publié: (2025)
par: Jin, Ruihan, et autres
Publié: (2025)
Spark: Strategic Policy-Aware Exploration via Dynamic Branching for Long-Horizon Agentic Learning
par: Wu, Jinyang, et autres
Publié: (2026)
par: Wu, Jinyang, et autres
Publié: (2026)
The Codecfake Dataset and Countermeasures for the Universally Detection of Deepfake Audio
par: Xie, Yuankun, et autres
Publié: (2024)
par: Xie, Yuankun, et autres
Publié: (2024)
KS-LLM: Knowledge Selection of Large Language Models with Evidence Document for Question Answering
par: Zheng, Xinxin, et autres
Publié: (2024)
par: Zheng, Xinxin, et autres
Publié: (2024)
Codecfake: An Initial Dataset for Detecting LLM-based Deepfake Audio
par: Lu, Yi, et autres
Publié: (2024)
par: Lu, Yi, et autres
Publié: (2024)
Generalized Fake Audio Detection via Deep Stable Learning
par: Wang, Zhiyong, et autres
Publié: (2024)
par: Wang, Zhiyong, et autres
Publié: (2024)
Text Prompt is Not Enough: Sound Event Enhanced Prompt Adapter for Target Style Audio Generation
par: Xiong, Chenxu, et autres
Publié: (2024)
par: Xiong, Chenxu, et autres
Publié: (2024)
Documents similaires
-
SceneFake: An Initial Dataset and Benchmarks for Scene Fake Audio Detection
par: Yi, Jiangyan, et autres
Publié: (2022) -
ALLM4ADD: Unlocking the Capabilities of Audio Large Language Models for Audio Deepfake Detection
par: Gu, Hao, et autres
Publié: (2025) -
ADD 2023: Towards Audio Deepfake Detection and Analysis in the Wild
par: Yi, Jiangyan, et autres
Publié: (2024) -
RPRA-ADD: Forgery Trace Enhancement-Driven Audio Deepfake Detection
par: Fu, Ruibo, et autres
Publié: (2025) -
EmoFake: An Initial Dataset for Emotion Fake Audio Detection
par: Zhao, Yan, et autres
Publié: (2022)