Cross-Technology Generalization in Synthesized Speech Detection: Evaluating AST Models with Modern Voice Generators
Fuente:
arXiv
Guardado en:
| Autores principales: | Ustinov, Andrew, Yordanov, Matey, Kuchma, Andrei, Bychkov, Mikhail |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Benchmarking Fake Voice Detection in the Fake Voice Generation Arms Race
por: Mao, Xutao, et al.
Publicado: (2025)
por: Mao, Xutao, et al.
Publicado: (2025)
Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation
por: Zhang, Kuiyuan, et al.
Publicado: (2024)
por: Zhang, Kuiyuan, et al.
Publicado: (2024)
Privacy in Speech Technology
por: Bäckström, Tom
Publicado: (2023)
por: Bäckström, Tom
Publicado: (2023)
Why Speech Deepfake Detectors Won't Generalize: The Limits of Detection in an Open World
por: Berisha, Visar, et al.
Publicado: (2025)
por: Berisha, Visar, et al.
Publicado: (2025)
Evaluating Synthetic Command Attacks on Smart Voice Assistants
por: He, Zhengxian, et al.
Publicado: (2024)
por: He, Zhengxian, et al.
Publicado: (2024)
Synthetic Voices, Real Threats: Evaluating Large Text-to-Speech Models in Generating Harmful Audio
por: Chen, Guangke, et al.
Publicado: (2025)
por: Chen, Guangke, et al.
Publicado: (2025)
Hybrid Audio Detection Using Fine-Tuned Audio Spectrogram Transformers: A Dataset-Driven Evaluation of Mixed AI-Human Speech
por: Huang, Kunyang, et al.
Publicado: (2025)
por: Huang, Kunyang, et al.
Publicado: (2025)
Your Microphone Array Retains Your Identity: A Robust Voice Liveness Detection System for Smart Speakers
por: Meng, Yan, et al.
Publicado: (2025)
por: Meng, Yan, et al.
Publicado: (2025)
Frame-level Temporal Difference Learning for Partial Deepfake Speech Detection
por: Li, Menglu, et al.
Publicado: (2025)
por: Li, Menglu, et al.
Publicado: (2025)
LENS-DF: Deepfake Detection and Temporal Localization for Long-Form Noisy Speech
por: Liu, Xuechen, et al.
Publicado: (2025)
por: Liu, Xuechen, et al.
Publicado: (2025)
A Practical Survey on Emerging Threats from AI-driven Voice Attacks: How Vulnerable are Commercial Voice Control Systems?
por: Wang, Yuanda, et al.
Publicado: (2023)
por: Wang, Yuanda, et al.
Publicado: (2023)
Quantifying Source Speaker Leakage in One-to-One Voice Conversion
por: Wellington, Scott, et al.
Publicado: (2025)
por: Wellington, Scott, et al.
Publicado: (2025)
Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection
por: Kheir, Yassine El, et al.
Publicado: (2025)
por: Kheir, Yassine El, et al.
Publicado: (2025)
DIN-CTS: Low-Complexity Depthwise-Inception Neural Network with Contrastive Training Strategy for Deepfake Speech Detection
por: Pham, Lam, et al.
Publicado: (2025)
por: Pham, Lam, et al.
Publicado: (2025)
VoiceWukong: Benchmarking Deepfake Voice Detection
por: Yan, Ziwei, et al.
Publicado: (2024)
por: Yan, Ziwei, et al.
Publicado: (2024)
Sok: Comprehensive Security Overview, Challenges, and Future Directions of Voice-Controlled Systems
por: Xu, Haozhe, et al.
Publicado: (2024)
por: Xu, Haozhe, et al.
Publicado: (2024)
SuperEar: Eavesdropping on Mobile Voice Calls via Stealthy Acoustic Metamaterials
por: Ning, Zhiyuan, et al.
Publicado: (2025)
por: Ning, Zhiyuan, et al.
Publicado: (2025)
A Survey on Speech Deepfake Detection
por: Li, Menglu, et al.
Publicado: (2024)
por: Li, Menglu, et al.
Publicado: (2024)
MerkleSpeech: Public-Key Verifiable, Chunk-Localised Speech Provenance via Perceptual Fingerprints and Merkle Commitments
por: Ono, Tatsunori
Publicado: (2026)
por: Ono, Tatsunori
Publicado: (2026)
Lightweight Protection for Privacy in Offloaded Speech Understanding
por: Cai, Dongqi
Publicado: (2024)
por: Cai, Dongqi
Publicado: (2024)
Adversarial Attacks and Defenses for Speech Recognition Systems
por: Żelasko, Piotr, et al.
Publicado: (2021)
por: Żelasko, Piotr, et al.
Publicado: (2021)
TriniMark: A Robust Generative Speech Watermarking Method for Trinity-Level Traceability
por: Li, Yue, et al.
Publicado: (2025)
por: Li, Yue, et al.
Publicado: (2025)
WaLi: Can Pressure Sensors in HVAC Systems Capture Human Speech?
por: Tamiti, Tarikul Islam, et al.
Publicado: (2025)
por: Tamiti, Tarikul Islam, et al.
Publicado: (2025)
Zero-Query Adversarial Attack on Black-box Automatic Speech Recognition Systems
por: Fang, Zheng, et al.
Publicado: (2024)
por: Fang, Zheng, et al.
Publicado: (2024)
SpeechVerifier: Robust Acoustic Fingerprint against Tampering Attacks via Watermarking
por: Yao, Lingfeng, et al.
Publicado: (2025)
por: Yao, Lingfeng, et al.
Publicado: (2025)
Acoustic Simulation Framework for Multi-channel Replay Speech Detection
por: Neri, Michael, et al.
Publicado: (2025)
por: Neri, Michael, et al.
Publicado: (2025)
Speech privacy-preserving methods using secret key for convolutional neural network models and their robustness evaluation
por: Niwa, Shoko, et al.
Publicado: (2024)
por: Niwa, Shoko, et al.
Publicado: (2024)
Every Breath You Don't Take: Deepfake Speech Detection Using Breath
por: Layton, Seth, et al.
Publicado: (2024)
por: Layton, Seth, et al.
Publicado: (2024)
Efficient Streaming Voice Steganalysis in Challenging Detection Scenarios
por: Zhou, Pengcheng, et al.
Publicado: (2024)
por: Zhou, Pengcheng, et al.
Publicado: (2024)
Towards Generalized Source Tracing for Codec-Based Deepfake Speech
por: Chen, Xuanjun, et al.
Publicado: (2025)
por: Chen, Xuanjun, et al.
Publicado: (2025)
Interpretable Temporal Class Activation Representation for Audio Spoofing Detection
por: Li, Menglu, et al.
Publicado: (2024)
por: Li, Menglu, et al.
Publicado: (2024)
Exploratory Evaluation of Speech Content Masking
por: Williams, Jennifer, et al.
Publicado: (2024)
por: Williams, Jennifer, et al.
Publicado: (2024)
Pitch Imperfect: Detecting Audio Deepfakes Through Acoustic Prosodic Analysis
por: Warren, Kevin, et al.
Publicado: (2025)
por: Warren, Kevin, et al.
Publicado: (2025)
One-Class Learning with Adaptive Centroid Shift for Audio Deepfake Detection
por: Kim, Hyun Myung, et al.
Publicado: (2024)
por: Kim, Hyun Myung, et al.
Publicado: (2024)
A Systematic Evaluation of Adversarial Attacks against Speech Emotion Recognition Models
por: Facchinetti, Nicolas, et al.
Publicado: (2024)
por: Facchinetti, Nicolas, et al.
Publicado: (2024)
VocalCrypt: Novel Active Defense Against Deepfake Voice Based on Masking Effect
por: Fei, Qingyuan, et al.
Publicado: (2025)
por: Fei, Qingyuan, et al.
Publicado: (2025)
A Preliminary Case Study on Long-Form In-the-Wild Audio Spoofing Detection
por: Liu, Xuechen, et al.
Publicado: (2024)
por: Liu, Xuechen, et al.
Publicado: (2024)
Gumbel Rao Monte Carlo based Bi-Modal Neural Architecture Search for Audio-Visual Deepfake Detection
por: PN, Aravinda Reddy, et al.
Publicado: (2024)
por: PN, Aravinda Reddy, et al.
Publicado: (2024)
Anonymizing Speech: Evaluating and Designing Speaker Anonymization Techniques
por: Champion, Pierre
Publicado: (2023)
por: Champion, Pierre
Publicado: (2023)
Degrading Voice: A Comprehensive Overview of Robust Voice Conversion Through Input Manipulation
por: Song, Xining, et al.
Publicado: (2025)
por: Song, Xining, et al.
Publicado: (2025)
Ejemplares similares
-
Benchmarking Fake Voice Detection in the Fake Voice Generation Arms Race
por: Mao, Xutao, et al.
Publicado: (2025) -
Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation
por: Zhang, Kuiyuan, et al.
Publicado: (2024) -
Privacy in Speech Technology
por: Bäckström, Tom
Publicado: (2023) -
Why Speech Deepfake Detectors Won't Generalize: The Limits of Detection in an Open World
por: Berisha, Visar, et al.
Publicado: (2025) -
Evaluating Synthetic Command Attacks on Smart Voice Assistants
por: He, Zhengxian, et al.
Publicado: (2024)