Audio Deepfake Detection with Self-Supervised WavLM and Multi-Fusion Attentive Classifier
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Yinlin, Huang, Haofan, Chen, Xi, Zhao, He, Wang, Yuehai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exploring WavLM Back-ends for Speech Spoofing and Deepfake Detection
di: Stourbe, Theophile, et al.
Pubblicazione: (2024)
di: Stourbe, Theophile, et al.
Pubblicazione: (2024)
SA-WavLM: Speaker-Aware Self-Supervised Pre-training for Mixture Speech
di: Lin, Jingru, et al.
Pubblicazione: (2024)
di: Lin, Jingru, et al.
Pubblicazione: (2024)
WavLM model ensemble for audio deepfake detection
di: Combei, David, et al.
Pubblicazione: (2024)
di: Combei, David, et al.
Pubblicazione: (2024)
Adapting WavLM for Speech Emotion Recognition
di: Diatlova, Daria, et al.
Pubblicazione: (2024)
di: Diatlova, Daria, et al.
Pubblicazione: (2024)
PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)
Frame-Aligned Fusion of Canary and WavLM for Non-Intrusive Intelligibility Prediction of Hearing-Aid-Processed Speech
di: Nakazawa, Kazushi
Pubblicazione: (2026)
di: Nakazawa, Kazushi
Pubblicazione: (2026)
XWSB: A Blend System Utilizing XLS-R and WavLM with SLS Classifier detection system for SVDD 2024 Challenge
di: Zhang, Qishan, et al.
Pubblicazione: (2024)
di: Zhang, Qishan, et al.
Pubblicazione: (2024)
Eta-WavLM: Efficient Speaker Identity Removal in Self-Supervised Speech Representations Using a Simple Linear Equation
di: Ruggiero, Giuseppe, et al.
Pubblicazione: (2025)
di: Ruggiero, Giuseppe, et al.
Pubblicazione: (2025)
Audio is all in one: speech-driven gesture synthetics using WavLM pre-trained model
di: Zhang, Fan, et al.
Pubblicazione: (2023)
di: Zhang, Fan, et al.
Pubblicazione: (2023)
Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM
di: Sun, Zhaokai, et al.
Pubblicazione: (2025)
di: Sun, Zhaokai, et al.
Pubblicazione: (2025)
FLY-TTS: Fast, Lightweight and High-Quality End-to-End Text-to-Speech Synthesis
di: Guo, Yinlin, et al.
Pubblicazione: (2024)
di: Guo, Yinlin, et al.
Pubblicazione: (2024)
Audio Deepfake Detection at the First Greeting: "Hi!"
di: Shi, Haohan, et al.
Pubblicazione: (2026)
di: Shi, Haohan, et al.
Pubblicazione: (2026)
WavCraft: Audio Editing and Generation with Large Language Models
di: Liang, Jinhua, et al.
Pubblicazione: (2024)
di: Liang, Jinhua, et al.
Pubblicazione: (2024)
Generalizable Detection of Audio Deepfakes
di: Lopez, Jose A., et al.
Pubblicazione: (2025)
di: Lopez, Jose A., et al.
Pubblicazione: (2025)
Detection of Deepfake Environmental Audio
di: Ouajdi, Hafsa, et al.
Pubblicazione: (2024)
di: Ouajdi, Hafsa, et al.
Pubblicazione: (2024)
Cyclostationarity Analysis as a Complement to Self-Supervised Representations for Speech Deepfake Detection
di: Hanilçi, Cemal, et al.
Pubblicazione: (2026)
di: Hanilçi, Cemal, et al.
Pubblicazione: (2026)
HCFD: A Benchmark for Audio Deepfake Detection in Healthcare
di: Akhtar, Mohd Mujtaba, et al.
Pubblicazione: (2026)
di: Akhtar, Mohd Mujtaba, et al.
Pubblicazione: (2026)
Audio Deepfake Verification
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
Continuous Target Speech Extraction: Enhancing Personalized Diarization and Extraction on Complex Recordings
di: Zhao, He, et al.
Pubblicazione: (2024)
di: Zhao, He, et al.
Pubblicazione: (2024)
Retrieval-Augmented Audio Deepfake Detection
di: Kang, Zuheng, et al.
Pubblicazione: (2024)
di: Kang, Zuheng, et al.
Pubblicazione: (2024)
Multi-Granularity Adaptive Time-Frequency Attention Framework for Audio Deepfake Detection under Real-World Communication Degradations
di: Shi, Haohan, et al.
Pubblicazione: (2025)
di: Shi, Haohan, et al.
Pubblicazione: (2025)
WavMark: Watermarking for Audio Generation
di: Chen, Guangyu, et al.
Pubblicazione: (2023)
di: Chen, Guangyu, et al.
Pubblicazione: (2023)
Generalized Audio Deepfake Detection Using Frame-level Latent Information Entropy
di: Zhao, Botao, et al.
Pubblicazione: (2025)
di: Zhao, Botao, et al.
Pubblicazione: (2025)
BreathNet: Generalizable Audio Deepfake Detection via Breath-Cue-Guided Feature Refinement
di: Ye, Zhe, et al.
Pubblicazione: (2026)
di: Ye, Zhe, et al.
Pubblicazione: (2026)
Similarity Choice and Negative Scaling in Supervised Contrastive Learning for Deepfake Audio Detection
di: Sudan, Jaskirat, et al.
Pubblicazione: (2026)
di: Sudan, Jaskirat, et al.
Pubblicazione: (2026)
Transferable Adversarial Attacks on Audio Deepfake Detection
di: Farooq, Muhammad Umar, et al.
Pubblicazione: (2025)
di: Farooq, Muhammad Umar, et al.
Pubblicazione: (2025)
WavRAG: Audio-Integrated Retrieval Augmented Generation for Spoken Dialogue Models
di: Chen, Yifu, et al.
Pubblicazione: (2025)
di: Chen, Yifu, et al.
Pubblicazione: (2025)
Benchmarking Audio Deepfake Detection Robustness in Real-world Communication Scenarios
di: Shi, Haohan, et al.
Pubblicazione: (2025)
di: Shi, Haohan, et al.
Pubblicazione: (2025)
TADA: Training-free Attribution and Out-of-Domain Detection of Audio Deepfakes
di: Stan, Adriana, et al.
Pubblicazione: (2025)
di: Stan, Adriana, et al.
Pubblicazione: (2025)
Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation
di: Huang, Wen, et al.
Pubblicazione: (2025)
di: Huang, Wen, et al.
Pubblicazione: (2025)
Attentive-based Multi-level Feature Fusion for Voice Disorder Diagnosis
di: Shen, Lipeng, et al.
Pubblicazione: (2024)
di: Shen, Lipeng, et al.
Pubblicazione: (2024)
Continuous Learning of Transformer-based Audio Deepfake Detection
di: Le, Tuan Duy Nguyen, et al.
Pubblicazione: (2024)
di: Le, Tuan Duy Nguyen, et al.
Pubblicazione: (2024)
Classical Machine Learning Baselines for Deepfake Audio Detection on the Fake-or-Real Dataset
di: Ahmad, Faheem, et al.
Pubblicazione: (2026)
di: Ahmad, Faheem, et al.
Pubblicazione: (2026)
Attentive AV-FusionNet: Audio-Visual Quality Prediction with Hybrid Attention
di: Salaj, Ina, et al.
Pubblicazione: (2025)
di: Salaj, Ina, et al.
Pubblicazione: (2025)
Source Tracing of Audio Deepfake Systems
di: Klein, Nicholas, et al.
Pubblicazione: (2024)
di: Klein, Nicholas, et al.
Pubblicazione: (2024)
A SUPERB-Style Benchmark of Self-Supervised Speech Models for Audio Deepfake Detection
di: Ali, Hashim, et al.
Pubblicazione: (2026)
di: Ali, Hashim, et al.
Pubblicazione: (2026)
RawBMamba: End-to-End Bidirectional State Space Model for Audio Deepfake Detection
di: Chen, Yujie, et al.
Pubblicazione: (2024)
di: Chen, Yujie, et al.
Pubblicazione: (2024)
XLSR-MamBo: Scaling the Hybrid Mamba-Attention Backbone for Audio Deepfake Detection
di: Ng, Kwok-Ho, et al.
Pubblicazione: (2026)
di: Ng, Kwok-Ho, et al.
Pubblicazione: (2026)
Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection
di: Kheir, Yassine El, et al.
Pubblicazione: (2025)
di: Kheir, Yassine El, et al.
Pubblicazione: (2025)
SynHate: Detecting Hate Speech in Synthetic Deepfake Audio
di: Ranjan, Rishabh, et al.
Pubblicazione: (2025)
di: Ranjan, Rishabh, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Exploring WavLM Back-ends for Speech Spoofing and Deepfake Detection
di: Stourbe, Theophile, et al.
Pubblicazione: (2024) -
SA-WavLM: Speaker-Aware Self-Supervised Pre-training for Mixture Speech
di: Lin, Jingru, et al.
Pubblicazione: (2024) -
WavLM model ensemble for audio deepfake detection
di: Combei, David, et al.
Pubblicazione: (2024) -
Adapting WavLM for Speech Emotion Recognition
di: Diatlova, Daria, et al.
Pubblicazione: (2024) -
PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)