A Comparative Study on Proactive and Passive Detection of Deepfake Speech
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Chia-Hua, Ge, Wanying, Wang, Xin, Yamagishi, Junichi, Tsao, Yu, Wang, Hsin-Min |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LENS-DF: Deepfake Detection and Temporal Localization for Long-Form Noisy Speech
por: Liu, Xuechen, et al.
Publicado: (2025)
por: Liu, Xuechen, et al.
Publicado: (2025)
From Sharpness to Better Generalization for Speech Deepfake Detection
por: Huang, Wen, et al.
Publicado: (2025)
por: Huang, Wen, et al.
Publicado: (2025)
Towards Data Drift Monitoring for Speech Deepfake Detection in the context of MLOps
por: Wang, Xin, et al.
Publicado: (2025)
por: Wang, Xin, et al.
Publicado: (2025)
Does Fine-tuning by Reinforcement Learning Improve Generalization in Binary Speech Deepfake Detection?
por: Wang, Xin, et al.
Publicado: (2026)
por: Wang, Xin, et al.
Publicado: (2026)
Post-training for Deepfake Speech Detection
por: Ge, Wanying, et al.
Publicado: (2025)
por: Ge, Wanying, et al.
Publicado: (2025)
SAVe: Self-Supervised Audio-visual Deepfake Detection Exploiting Visual Artifacts and Audio-visual Misalignment
por: Shahzad, Sahibzada Adil, et al.
Publicado: (2026)
por: Shahzad, Sahibzada Adil, et al.
Publicado: (2026)
FakeMark: Deepfake Speech Attribution With Watermarked Artifacts
por: Ge, Wanying, et al.
Publicado: (2025)
por: Ge, Wanying, et al.
Publicado: (2025)
Self Voice Conversion as an Attack against Neural Audio Watermarking
por: Özer, Yigitcan, et al.
Publicado: (2026)
por: Özer, Yigitcan, et al.
Publicado: (2026)
Spoofing attack augmentation: can differently-trained attack models improve generalisation?
por: Ge, Wanying, et al.
Publicado: (2023)
por: Ge, Wanying, et al.
Publicado: (2023)
Zero-Day Audio DeepFake Detection via Retrieval Augmentation and Profile Matching
por: Liu, Xuechen, et al.
Publicado: (2025)
por: Liu, Xuechen, et al.
Publicado: (2025)
A Preliminary Case Study on Long-Form In-the-Wild Audio Spoofing Detection
por: Liu, Xuechen, et al.
Publicado: (2024)
por: Liu, Xuechen, et al.
Publicado: (2024)
The VoiceMOS Challenge 2024: Beyond Speech Quality Prediction
por: Huang, Wen-Chin, et al.
Publicado: (2024)
por: Huang, Wen-Chin, et al.
Publicado: (2024)
ASVspoof 5: Evaluation of Spoofing, Deepfake, and Adversarial Attack Detection Using Crowdsourced Speech
por: Wang, Xin, et al.
Publicado: (2026)
por: Wang, Xin, et al.
Publicado: (2026)
Understanding Audiovisual Deepfake Detection: Techniques, Challenges, Human Factors and Perceptual Insights
por: Hashmi, Ammarah, et al.
Publicado: (2024)
por: Hashmi, Ammarah, et al.
Publicado: (2024)
AVTENet: A Human-Cognition-Inspired Audio-Visual Transformer-Based Ensemble Network for Video Deepfake Detection
por: Hashmi, Ammarah, et al.
Publicado: (2023)
por: Hashmi, Ammarah, et al.
Publicado: (2023)
A Study on Zero-shot Non-intrusive Speech Assessment using Large Language Models
por: Zezario, Ryandhimas E., et al.
Publicado: (2024)
por: Zezario, Ryandhimas E., et al.
Publicado: (2024)
A Study on Speech Assessment with Visual Cues
por: Ahmed, Shafique, et al.
Publicado: (2025)
por: Ahmed, Shafique, et al.
Publicado: (2025)
A Study on Incorporating Whisper for Robust Speech Assessment
por: Zezario, Ryandhimas E., et al.
Publicado: (2023)
por: Zezario, Ryandhimas E., et al.
Publicado: (2023)
QualiSpeech: A Speech Quality Assessment Dataset with Natural Language Reasoning and Descriptions
por: Wang, Siyin, et al.
Publicado: (2025)
por: Wang, Siyin, et al.
Publicado: (2025)
A Study on Zero-Shot Non-Intrusive Speech Intelligibility for Hearing Aids Using Large Language Models
por: Zezario, Ryandhimas E., et al.
Publicado: (2025)
por: Zezario, Ryandhimas E., et al.
Publicado: (2025)
SVSNet+: Enhancing Speaker Voice Similarity Assessment Models with Representations from Speech Foundation Models
por: Yin, Chun, et al.
Publicado: (2024)
por: Yin, Chun, et al.
Publicado: (2024)
ZMM-TTS: Zero-shot Multilingual and Multispeaker Speech Synthesis Conditioned on Self-supervised Discrete Speech Representations
por: Gong, Cheng, et al.
Publicado: (2023)
por: Gong, Cheng, et al.
Publicado: (2023)
Speech Intelligibility Assessment with Uncertainty-Aware Whisper Embeddings and sLSTM
por: Zezario, Ryandhimas E., et al.
Publicado: (2025)
por: Zezario, Ryandhimas E., et al.
Publicado: (2025)
ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale
por: Wang, Xin, et al.
Publicado: (2024)
por: Wang, Xin, et al.
Publicado: (2024)
Feature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids
por: Zezario, Ryandhimas E., et al.
Publicado: (2025)
por: Zezario, Ryandhimas E., et al.
Publicado: (2025)
Comparative Analysis of ASR Methods for Speech Deepfake Detection
por: Salvi, Davide, et al.
Publicado: (2024)
por: Salvi, Davide, et al.
Publicado: (2024)
AV-Lip-Sync+: Leveraging AV-HuBERT to Exploit Multimodal Inconsistency for Deepfake Detection of Frontal Face Videos
por: Shahzad, Sahibzada Adil, et al.
Publicado: (2023)
por: Shahzad, Sahibzada Adil, et al.
Publicado: (2023)
Fake Speech Wild: Detecting Deepfake Speech on Social Media Platform
por: Xie, Yuankun, et al.
Publicado: (2025)
por: Xie, Yuankun, et al.
Publicado: (2025)
Non-Intrusive Speech Intelligibility Prediction for Hearing Aids using Whisper and Metadata
por: Zezario, Ryandhimas E., et al.
Publicado: (2023)
por: Zezario, Ryandhimas E., et al.
Publicado: (2023)
Towards An Integrated Approach for Expressive Piano Performance Synthesis from Music Scores
por: Tang, Jingjing, et al.
Publicado: (2025)
por: Tang, Jingjing, et al.
Publicado: (2025)
Robust Audio-Visual Speech Enhancement: Correcting Misassignments in Complex Environments with Advanced Post-Processing
por: Ren, Wenze, et al.
Publicado: (2024)
por: Ren, Wenze, et al.
Publicado: (2024)
Spoofing-Aware Speaker Verification Robust Against Domain and Channel Mismatches
por: Zeng, Chang, et al.
Publicado: (2024)
por: Zeng, Chang, et al.
Publicado: (2024)
Deepfake Word Detection by Next-token Prediction using Fine-tuned Whisper
por: Tran, Hoan My, et al.
Publicado: (2026)
por: Tran, Hoan My, et al.
Publicado: (2026)
Generating Speakers by Prompting Listener Impressions for Pre-trained Multi-Speaker Text-to-Speech Systems
por: Chen, Zhengyang, et al.
Publicado: (2024)
por: Chen, Zhengyang, et al.
Publicado: (2024)
Training Dynamics-Aware Multi-Factor Curriculum Learning for Target Speaker Extraction
por: Liu, Yun, et al.
Publicado: (2026)
por: Liu, Yun, et al.
Publicado: (2026)
RTCFake: Speech Deepfake Detection in Real-Time Communication
por: Xue, Jun, et al.
Publicado: (2026)
por: Xue, Jun, et al.
Publicado: (2026)
Improving curriculum learning for target speaker extraction with synthetic speakers
por: Liu, Yun, et al.
Publicado: (2024)
por: Liu, Yun, et al.
Publicado: (2024)
Mitigating Language Mismatch in SSL-Based Speaker Anonymization
por: Zhang, Zhe, et al.
Publicado: (2025)
por: Zhang, Zhe, et al.
Publicado: (2025)
Multi-Task Pseudo-Label Learning for Non-Intrusive Speech Quality Assessment Model
por: Zezario, Ryandhimas E., et al.
Publicado: (2023)
por: Zezario, Ryandhimas E., et al.
Publicado: (2023)
Attention-based Mixture of Experts for Robust Speech Deepfake Detection
por: Negroni, Viola, et al.
Publicado: (2025)
por: Negroni, Viola, et al.
Publicado: (2025)
Ejemplares similares
-
LENS-DF: Deepfake Detection and Temporal Localization for Long-Form Noisy Speech
por: Liu, Xuechen, et al.
Publicado: (2025) -
From Sharpness to Better Generalization for Speech Deepfake Detection
por: Huang, Wen, et al.
Publicado: (2025) -
Towards Data Drift Monitoring for Speech Deepfake Detection in the context of MLOps
por: Wang, Xin, et al.
Publicado: (2025) -
Does Fine-tuning by Reinforcement Learning Improve Generalization in Binary Speech Deepfake Detection?
por: Wang, Xin, et al.
Publicado: (2026) -
Post-training for Deepfake Speech Detection
por: Ge, Wanying, et al.
Publicado: (2025)