WST-X Series: Wavelet Scattering Transform for Interpretable Speech Deepfake Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xuan, Xi, Carbone, Davide, Zhang, Wenxin, Pandey, Ruchi, Kinnunen, Tomi H. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
WaveSP-Net: Learnable Wavelet-Domain Sparse Prompt Tuning for Speech Deepfake Detection
par: Xuan, Xi, et autres
Publié: (2025)
par: Xuan, Xi, et autres
Publié: (2025)
Multilingual Source Tracing of Speech Deepfakes: A First Benchmark
par: Xuan, Xi, et autres
Publié: (2025)
par: Xuan, Xi, et autres
Publié: (2025)
Disentangling Speaker Traits for Deepfake Source Verification via Chebyshev Polynomial and Riemannian Metric Learning
par: Xuan, Xi, et autres
Publié: (2026)
par: Xuan, Xi, et autres
Publié: (2026)
Cyclostationarity Analysis as a Complement to Self-Supervised Representations for Speech Deepfake Detection
par: Hanilçi, Cemal, et autres
Publié: (2026)
par: Hanilçi, Cemal, et autres
Publié: (2026)
Fake-Mamba: Real-Time Speech Deepfake Detection Using Bidirectional Mamba as Self-Attention's Alternative
par: Xuan, Xi, et autres
Publié: (2025)
par: Xuan, Xi, et autres
Publié: (2025)
Advancing Zero-Shot Open-Set Speech Deepfake Source Tracing
par: Chhibber, Manasi, et autres
Publié: (2025)
par: Chhibber, Manasi, et autres
Publié: (2025)
Meta-Learning Approaches for Improving Detection of Unseen Speech Deepfakes
par: Kukanov, Ivan, et autres
Publié: (2024)
par: Kukanov, Ivan, et autres
Publié: (2024)
Heart Murmur and Abnormal PCG Detection via Wavelet Scattering Transform & a 1D-CNN
par: Patwa, Ahmed, et autres
Publié: (2023)
par: Patwa, Ahmed, et autres
Publié: (2023)
Towards Explainable Spoofed Speech Attribution and Detection:a Probabilistic Approach for Characterizing Speech Synthesizer Components
par: Mishra, Jagabandhu, et autres
Publié: (2025)
par: Mishra, Jagabandhu, et autres
Publié: (2025)
Benchmarking Audio Deepfake Detection Robustness in Real-world Communication Scenarios
par: Shi, Haohan, et autres
Publié: (2025)
par: Shi, Haohan, et autres
Publié: (2025)
Reduce Computational Complexity for Continuous Wavelet Transform in Acoustic Recognition Using Hop Size
par: Phan, Dang Thoai
Publié: (2024)
par: Phan, Dang Thoai
Publié: (2024)
Textless Unit-to-Unit training for Many-to-Many Multilingual Speech-to-Speech Translation
par: Kim, Minsu, et autres
Publié: (2023)
par: Kim, Minsu, et autres
Publié: (2023)
Kinship Verification Using Voice
par: Mishra, Jagabandhu, et autres
Publié: (2026)
par: Mishra, Jagabandhu, et autres
Publié: (2026)
Visual-Aware Speech Recognition for Noisy Scenarios
par: Balaji, Lakshmipathi, et autres
Publié: (2025)
par: Balaji, Lakshmipathi, et autres
Publié: (2025)
A Large-Scale Evaluation of Speech Foundation Models
par: Yang, Shu-wen, et autres
Publié: (2024)
par: Yang, Shu-wen, et autres
Publié: (2024)
TouchASP: Elastic Automatic Speech Perception that Everyone Can Touch
par: Song, Xingchen, et autres
Publié: (2024)
par: Song, Xingchen, et autres
Publié: (2024)
Beyond Identity: A Generalizable Approach for Deepfake Audio Detection
par: Ahmadiadli, Yasaman, et autres
Publié: (2025)
par: Ahmadiadli, Yasaman, et autres
Publié: (2025)
Automatic Speech Recognition of Non-Native Child Speech for Language Learning Applications
par: Wills, Simone, et autres
Publié: (2023)
par: Wills, Simone, et autres
Publié: (2023)
Attentive Fusion: A Transformer-based Approach to Multimodal Hate Speech Detection
par: Mandal, Atanu, et autres
Publié: (2024)
par: Mandal, Atanu, et autres
Publié: (2024)
Causal Structure Discovery for Error Diagnostics of Children's ASR
par: Singh, Vishwanath Pratap, et autres
Publié: (2025)
par: Singh, Vishwanath Pratap, et autres
Publié: (2025)
Impact of Microphone Array Mismatches to Learning-based Replay Speech Detection
par: Neri, Michael, et autres
Publié: (2025)
par: Neri, Michael, et autres
Publié: (2025)
Multi-channel Replay Speech Detection using an Adaptive Learnable Beamformer
par: Neri, Michael, et autres
Publié: (2025)
par: Neri, Michael, et autres
Publié: (2025)
RIR-Mega-Speech: A Reverberant Speech Corpus with Comprehensive Acoustic Metadata and Reproducible Evaluation
par: Goswami, Mandip
Publié: (2026)
par: Goswami, Mandip
Publié: (2026)
An Explainable Probabilistic Attribute Embedding Approach for Spoofed Speech Characterization
par: Chhibber, Manasi, et autres
Publié: (2024)
par: Chhibber, Manasi, et autres
Publié: (2024)
SpeechMLC: Speech Multi-label Classification
par: Kim, Miseul, et autres
Publié: (2025)
par: Kim, Miseul, et autres
Publié: (2025)
Detection of manatee vocalisations using the Audio Spectrogram Transformer
par: Schiappacasse, Stefano, et autres
Publié: (2024)
par: Schiappacasse, Stefano, et autres
Publié: (2024)
Scattering Transform for Auditory Attention Decoding
par: Pallenberg, René, et autres
Publié: (2026)
par: Pallenberg, René, et autres
Publié: (2026)
Investigating the Potential of Multi-Stage Score Fusion in Spoofing-Aware Speaker Verification
par: Kurnaz, Oguzhan, et autres
Publié: (2025)
par: Kurnaz, Oguzhan, et autres
Publié: (2025)
Parameter-Efficient Fine-Tuning of Foundation Models for CLP Speech Classification
par: Bhattacharjee, Susmita, et autres
Publié: (2025)
par: Bhattacharjee, Susmita, et autres
Publié: (2025)
Speech-Declipping Transformer with Complex Spectrogram and Learnerble Temporal Features
par: Kwon, Younghoo, et autres
Publié: (2024)
par: Kwon, Younghoo, et autres
Publié: (2024)
A Speech Production Model for Radar: Connecting Speech Acoustics with Radar-Measured Vibrations
par: Lenz, Isabella, et autres
Publié: (2025)
par: Lenz, Isabella, et autres
Publié: (2025)
ParaS2S: Benchmarking and Aligning Spoken Language Models for Paralinguistic-aware Speech-to-Speech Interaction
par: Yang, Shu-wen, et autres
Publié: (2025)
par: Yang, Shu-wen, et autres
Publié: (2025)
Binaural Localization Model for Speech in Noise
par: Tokala, Vikas, et autres
Publié: (2025)
par: Tokala, Vikas, et autres
Publié: (2025)
Speech-Based Prioritization for Schizophrenia Intervention
par: Premananth, Gowtham, et autres
Publié: (2025)
par: Premananth, Gowtham, et autres
Publié: (2025)
Prompt-driven Target Speech Diarization
par: Jiang, Yidi, et autres
Publié: (2023)
par: Jiang, Yidi, et autres
Publié: (2023)
Brain-Informed Speech Separation for Cochlear Implants
par: Gajecki, Tom, et autres
Publié: (2026)
par: Gajecki, Tom, et autres
Publié: (2026)
Speech Enhancement based on cascaded two flows
par: Lee, Seonggyu, et autres
Publié: (2025)
par: Lee, Seonggyu, et autres
Publié: (2025)
A SUPERB-Style Benchmark of Self-Supervised Speech Models for Audio Deepfake Detection
par: Ali, Hashim, et autres
Publié: (2026)
par: Ali, Hashim, et autres
Publié: (2026)
Reverberation-based Features for Sound Event Localization and Detection with Distance Estimation
par: Berghi, Davide, et autres
Publié: (2025)
par: Berghi, Davide, et autres
Publié: (2025)
ILD-VIT: A Unified Vision Transformer Architecture for Detection of Interstitial Lung Disease from Respiratory Sounds
par: Hota, Soubhagya Ranjan, et autres
Publié: (2025)
par: Hota, Soubhagya Ranjan, et autres
Publié: (2025)
Documents similaires
-
WaveSP-Net: Learnable Wavelet-Domain Sparse Prompt Tuning for Speech Deepfake Detection
par: Xuan, Xi, et autres
Publié: (2025) -
Multilingual Source Tracing of Speech Deepfakes: A First Benchmark
par: Xuan, Xi, et autres
Publié: (2025) -
Disentangling Speaker Traits for Deepfake Source Verification via Chebyshev Polynomial and Riemannian Metric Learning
par: Xuan, Xi, et autres
Publié: (2026) -
Cyclostationarity Analysis as a Complement to Self-Supervised Representations for Speech Deepfake Detection
par: Hanilçi, Cemal, et autres
Publié: (2026) -
Fake-Mamba: Real-Time Speech Deepfake Detection Using Bidirectional Mamba as Self-Attention's Alternative
par: Xuan, Xi, et autres
Publié: (2025)