WaveSP-Net: Learnable Wavelet-Domain Sparse Prompt Tuning for Speech Deepfake Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Xuan, Xi, Liu, Xuechen, Zhang, Wenxin, Lin, Yi-Cheng, Lin, Xiaojian, Kinnunen, Tomi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WST-X Series: Wavelet Scattering Transform for Interpretable Speech Deepfake Detection
di: Xuan, Xi, et al.
Pubblicazione: (2026)
di: Xuan, Xi, et al.
Pubblicazione: (2026)
Cyclostationarity Analysis as a Complement to Self-Supervised Representations for Speech Deepfake Detection
di: Hanilçi, Cemal, et al.
Pubblicazione: (2026)
di: Hanilçi, Cemal, et al.
Pubblicazione: (2026)
Advancing Zero-Shot Open-Set Speech Deepfake Source Tracing
di: Chhibber, Manasi, et al.
Pubblicazione: (2025)
di: Chhibber, Manasi, et al.
Pubblicazione: (2025)
Multilingual Source Tracing of Speech Deepfakes: A First Benchmark
di: Xuan, Xi, et al.
Pubblicazione: (2025)
di: Xuan, Xi, et al.
Pubblicazione: (2025)
Fake-Mamba: Real-Time Speech Deepfake Detection Using Bidirectional Mamba as Self-Attention's Alternative
di: Xuan, Xi, et al.
Pubblicazione: (2025)
di: Xuan, Xi, et al.
Pubblicazione: (2025)
Multi-channel Replay Speech Detection using an Adaptive Learnable Beamformer
di: Neri, Michael, et al.
Pubblicazione: (2025)
di: Neri, Michael, et al.
Pubblicazione: (2025)
Disentangling Speaker Traits for Deepfake Source Verification via Chebyshev Polynomial and Riemannian Metric Learning
di: Xuan, Xi, et al.
Pubblicazione: (2026)
di: Xuan, Xi, et al.
Pubblicazione: (2026)
Prompt-driven Target Speech Diarization
di: Jiang, Yidi, et al.
Pubblicazione: (2023)
di: Jiang, Yidi, et al.
Pubblicazione: (2023)
Meta-Learning Approaches for Improving Detection of Unseen Speech Deepfakes
di: Kukanov, Ivan, et al.
Pubblicazione: (2024)
di: Kukanov, Ivan, et al.
Pubblicazione: (2024)
Parameter-Efficient Fine-Tuning of Foundation Models for CLP Speech Classification
di: Bhattacharjee, Susmita, et al.
Pubblicazione: (2025)
di: Bhattacharjee, Susmita, et al.
Pubblicazione: (2025)
Post-training for Deepfake Speech Detection
di: Ge, Wanying, et al.
Pubblicazione: (2025)
di: Ge, Wanying, et al.
Pubblicazione: (2025)
Kinship Verification Using Voice
di: Mishra, Jagabandhu, et al.
Pubblicazione: (2026)
di: Mishra, Jagabandhu, et al.
Pubblicazione: (2026)
Towards Explainable Spoofed Speech Attribution and Detection:a Probabilistic Approach for Characterizing Speech Synthesizer Components
di: Mishra, Jagabandhu, et al.
Pubblicazione: (2025)
di: Mishra, Jagabandhu, et al.
Pubblicazione: (2025)
Benchmarking Audio Deepfake Detection Robustness in Real-world Communication Scenarios
di: Shi, Haohan, et al.
Pubblicazione: (2025)
di: Shi, Haohan, et al.
Pubblicazione: (2025)
Rec-RIR: Monaural Blind Room Impulse Response Identification via DNN-based Reverberant Speech Reconstruction in STFT Domain
di: Wang, Pengyu, et al.
Pubblicazione: (2025)
di: Wang, Pengyu, et al.
Pubblicazione: (2025)
Reduce Computational Complexity for Continuous Wavelet Transform in Acoustic Recognition Using Hop Size
di: Phan, Dang Thoai
Pubblicazione: (2024)
di: Phan, Dang Thoai
Pubblicazione: (2024)
SpeechMLC: Speech Multi-label Classification
di: Kim, Miseul, et al.
Pubblicazione: (2025)
di: Kim, Miseul, et al.
Pubblicazione: (2025)
Mel-McNet: A Mel-Scale Framework for Online Multichannel Speech Enhancement
di: Yang, Yujie, et al.
Pubblicazione: (2025)
di: Yang, Yujie, et al.
Pubblicazione: (2025)
Investigating the Potential of Multi-Stage Score Fusion in Spoofing-Aware Speaker Verification
di: Kurnaz, Oguzhan, et al.
Pubblicazione: (2025)
di: Kurnaz, Oguzhan, et al.
Pubblicazione: (2025)
Conditioning and Sampling in Variational Diffusion Models for Speech Super-Resolution
di: Yu, Chin-Yun, et al.
Pubblicazione: (2022)
di: Yu, Chin-Yun, et al.
Pubblicazione: (2022)
A Speech Production Model for Radar: Connecting Speech Acoustics with Radar-Measured Vibrations
di: Lenz, Isabella, et al.
Pubblicazione: (2025)
di: Lenz, Isabella, et al.
Pubblicazione: (2025)
LiSenNet: Lightweight Sub-band and Dual-Path Modeling for Real-Time Speech Enhancement
di: Yan, Haoyin, et al.
Pubblicazione: (2024)
di: Yan, Haoyin, et al.
Pubblicazione: (2024)
ParaS2S: Benchmarking and Aligning Spoken Language Models for Paralinguistic-aware Speech-to-Speech Interaction
di: Yang, Shu-wen, et al.
Pubblicazione: (2025)
di: Yang, Shu-wen, et al.
Pubblicazione: (2025)
Binaural Localization Model for Speech in Noise
di: Tokala, Vikas, et al.
Pubblicazione: (2025)
di: Tokala, Vikas, et al.
Pubblicazione: (2025)
Speech-Based Prioritization for Schizophrenia Intervention
di: Premananth, Gowtham, et al.
Pubblicazione: (2025)
di: Premananth, Gowtham, et al.
Pubblicazione: (2025)
Beyond Identity: A Generalizable Approach for Deepfake Audio Detection
di: Ahmadiadli, Yasaman, et al.
Pubblicazione: (2025)
di: Ahmadiadli, Yasaman, et al.
Pubblicazione: (2025)
An Explainable Probabilistic Attribute Embedding Approach for Spoofed Speech Characterization
di: Chhibber, Manasi, et al.
Pubblicazione: (2024)
di: Chhibber, Manasi, et al.
Pubblicazione: (2024)
Brain-Informed Speech Separation for Cochlear Implants
di: Gajecki, Tom, et al.
Pubblicazione: (2026)
di: Gajecki, Tom, et al.
Pubblicazione: (2026)
Speech Enhancement based on cascaded two flows
di: Lee, Seonggyu, et al.
Pubblicazione: (2025)
di: Lee, Seonggyu, et al.
Pubblicazione: (2025)
Causal Analysis of ASR Errors for Children: Quantifying the Impact of Physiological, Cognitive, and Extrinsic Factors
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2025)
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2025)
FlowSE: Flow Matching-based Speech Enhancement
di: Lee, Seonggyu, et al.
Pubblicazione: (2025)
di: Lee, Seonggyu, et al.
Pubblicazione: (2025)
FullSubNet: A Full-Band and Sub-Band Fusion Model for Real-Time Single-Channel Speech Enhancement
di: Hao, Xiang, et al.
Pubblicazione: (2020)
di: Hao, Xiang, et al.
Pubblicazione: (2020)
Harmonics to the Rescue: Why Voiced Speech is Not a Wss Process
di: Bologni, Giovanni, et al.
Pubblicazione: (2025)
di: Bologni, Giovanni, et al.
Pubblicazione: (2025)
SELM: Speech Enhancement Using Discrete Tokens and Language Models
di: Wang, Ziqian, et al.
Pubblicazione: (2023)
di: Wang, Ziqian, et al.
Pubblicazione: (2023)
Binaural Speech Enhancement Using Complex Convolutional Recurrent Networks
di: Tokala, Vikas, et al.
Pubblicazione: (2025)
di: Tokala, Vikas, et al.
Pubblicazione: (2025)
Analyzing the Impact of Accent on English Speech: Acoustic and Articulatory Perspectives
di: Premananth, Gowtham, et al.
Pubblicazione: (2025)
di: Premananth, Gowtham, et al.
Pubblicazione: (2025)
The Overview of Segmental Durations Modification Algorithms on Speech Signal Characteristics
di: Jang, Kyeomeun, et al.
Pubblicazione: (2025)
di: Jang, Kyeomeun, et al.
Pubblicazione: (2025)
USDnet: Unsupervised Speech Dereverberation via Neural Forward Filtering
di: Wang, Zhong-Qiu
Pubblicazione: (2024)
di: Wang, Zhong-Qiu
Pubblicazione: (2024)
TTSlow: Slow Down Text-to-Speech with Efficiency Robustness Evaluations
di: Gao, Xiaoxue, et al.
Pubblicazione: (2024)
di: Gao, Xiaoxue, et al.
Pubblicazione: (2024)
Bridging the Gap: Integrating Pre-trained Speech Enhancement and Recognition Models for Robust Speech Recognition
di: Wang, Kuan-Chen, et al.
Pubblicazione: (2024)
di: Wang, Kuan-Chen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
WST-X Series: Wavelet Scattering Transform for Interpretable Speech Deepfake Detection
di: Xuan, Xi, et al.
Pubblicazione: (2026) -
Cyclostationarity Analysis as a Complement to Self-Supervised Representations for Speech Deepfake Detection
di: Hanilçi, Cemal, et al.
Pubblicazione: (2026) -
Advancing Zero-Shot Open-Set Speech Deepfake Source Tracing
di: Chhibber, Manasi, et al.
Pubblicazione: (2025) -
Multilingual Source Tracing of Speech Deepfakes: A First Benchmark
di: Xuan, Xi, et al.
Pubblicazione: (2025) -
Fake-Mamba: Real-Time Speech Deepfake Detection Using Bidirectional Mamba as Self-Attention's Alternative
di: Xuan, Xi, et al.
Pubblicazione: (2025)