Are Deep Speech Denoising Models Robust to Adversarial Noise?
Fuente:
arXiv
Salvato in:
| Autori principali: | Schwarzer, Will, Chaudhari, Neel, Thomas, Philip S., Fanelli, Andrea, Liu, Xiaoyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TRNet: Two-level Refinement Network leveraging Speech Enhancement for Noise Robust Speech Emotion Recognition
di: Chen, Chengxin, et al.
Pubblicazione: (2024)
di: Chen, Chengxin, et al.
Pubblicazione: (2024)
Comparative Study on Noise-Augmented Training and its Effect on Adversarial Robustness in ASR Systems
di: Pizzi, Karla, et al.
Pubblicazione: (2024)
di: Pizzi, Karla, et al.
Pubblicazione: (2024)
Noise-aware Speech Enhancement using Diffusion Probabilistic Model
di: Hu, Yuchen, et al.
Pubblicazione: (2023)
di: Hu, Yuchen, et al.
Pubblicazione: (2023)
Wav2code: Restore Clean Speech Representations via Codebook Lookup for Noise-Robust ASR
di: Hu, Yuchen, et al.
Pubblicazione: (2023)
di: Hu, Yuchen, et al.
Pubblicazione: (2023)
Adversarial Training of Denoising Diffusion Model Using Dual Discriminators for High-Fidelity Multi-Speaker TTS
di: Ko, Myeongjin, et al.
Pubblicazione: (2023)
di: Ko, Myeongjin, et al.
Pubblicazione: (2023)
Knowledge Distillation for Speech Denoising by Latent Representation Alignment with Cosine Distance
di: Luong, Diep, et al.
Pubblicazione: (2025)
di: Luong, Diep, et al.
Pubblicazione: (2025)
Are Modern Speech Enhancement Systems Vulnerable to Adversarial Attacks?
di: Makarov, Rostislav, et al.
Pubblicazione: (2025)
di: Makarov, Rostislav, et al.
Pubblicazione: (2025)
Improving the Adversarial Robustness for Speaker Verification by Self-Supervised Learning
di: Wu, Haibin, et al.
Pubblicazione: (2021)
di: Wu, Haibin, et al.
Pubblicazione: (2021)
Run-Time Adaptation of Neural Beamforming for Robust Speech Dereverberation and Denoising
di: Fujita, Yoto, et al.
Pubblicazione: (2024)
di: Fujita, Yoto, et al.
Pubblicazione: (2024)
RobustSpeechFlow: Learning Robust Text-to-Speech Trajectories via Augmentation-based Contrastive Flow Matching
di: Yang, Jinhyeok, et al.
Pubblicazione: (2026)
di: Yang, Jinhyeok, et al.
Pubblicazione: (2026)
HiFi-Stream: Streaming Speech Enhancement with Generative Adversarial Networks
di: Dmitrieva, Ekaterina, et al.
Pubblicazione: (2025)
di: Dmitrieva, Ekaterina, et al.
Pubblicazione: (2025)
Adversarial Data Augmentation for Robust Speaker Verification
di: Zhou, Zhenyu, et al.
Pubblicazione: (2024)
di: Zhou, Zhenyu, et al.
Pubblicazione: (2024)
SSNAPS: Audio-Visual Separation of Speech and Background Noise with Diffusion Inverse Sampling
di: Yemini, Yochai, et al.
Pubblicazione: (2026)
di: Yemini, Yochai, et al.
Pubblicazione: (2026)
Accent Conversion in Text-To-Speech Using Multi-Level VAE and Adversarial Training
di: Melechovsky, Jan, et al.
Pubblicazione: (2024)
di: Melechovsky, Jan, et al.
Pubblicazione: (2024)
A Comparative Evaluation of Deep Learning Models for Speech Enhancement in Real-World Noisy Environments
di: Khondkar, Md Jahangir Alam, et al.
Pubblicazione: (2025)
di: Khondkar, Md Jahangir Alam, et al.
Pubblicazione: (2025)
Quantifying Quanvolutional Neural Networks Robustness for Speech in Healthcare Applications
di: Tran, Ha, et al.
Pubblicazione: (2026)
di: Tran, Ha, et al.
Pubblicazione: (2026)
Transcription-Free Fine-Tuning of Speech Separation Models for Noisy and Reverberant Multi-Speaker Automatic Speech Recognition
di: Ravenscroft, William, et al.
Pubblicazione: (2024)
di: Ravenscroft, William, et al.
Pubblicazione: (2024)
Deep Learning-based Non-Intrusive Multi-Objective Speech Assessment Model with Cross-Domain Features
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2021)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2021)
Automatic Contextual Audio Denoising
di: Luong, Diep, et al.
Pubblicazione: (2026)
di: Luong, Diep, et al.
Pubblicazione: (2026)
GLA-Grad++: An Improved Griffin-Lim Guided Diffusion Model for Speech Synthesis
di: Baoueb, Teysir, et al.
Pubblicazione: (2025)
di: Baoueb, Teysir, et al.
Pubblicazione: (2025)
Dynamic nsNet2: Efficient Deep Noise Suppression with Early Exiting
di: Miccini, Riccardo, et al.
Pubblicazione: (2023)
di: Miccini, Riccardo, et al.
Pubblicazione: (2023)
TextrolSpeech: A Text Style Control Speech Corpus With Codec Language Text-to-Speech Models
di: Ji, Shengpeng, et al.
Pubblicazione: (2023)
di: Ji, Shengpeng, et al.
Pubblicazione: (2023)
Investigating the Effects of Diffusion-based Conditional Generative Speech Models Used for Speech Enhancement on Dysarthric Speech
di: Reszka, Joanna, et al.
Pubblicazione: (2024)
di: Reszka, Joanna, et al.
Pubblicazione: (2024)
Parameter Efficient Finetuning for Speech Emotion Recognition and Domain Adaptation
di: Lashkarashvili, Nineli, et al.
Pubblicazione: (2024)
di: Lashkarashvili, Nineli, et al.
Pubblicazione: (2024)
DDTSE: Discriminative Diffusion Model for Target Speech Extraction
di: Zhang, Leying, et al.
Pubblicazione: (2023)
di: Zhang, Leying, et al.
Pubblicazione: (2023)
UniPET-SPK: A Unified Framework for Parameter-Efficient Tuning of Pre-trained Speech Models for Robust Speaker Verification
di: Sang, Mufan, et al.
Pubblicazione: (2025)
di: Sang, Mufan, et al.
Pubblicazione: (2025)
Domain Adapting Deep Reinforcement Learning for Real-world Speech Emotion Recognition
di: Rajapakshe, Thejan, et al.
Pubblicazione: (2022)
di: Rajapakshe, Thejan, et al.
Pubblicazione: (2022)
Non-intrusive Speech Quality Assessment with Diffusion Models Trained on Clean Speech
di: de Oliveira, Danilo, et al.
Pubblicazione: (2024)
di: de Oliveira, Danilo, et al.
Pubblicazione: (2024)
Speech Denoising with Auditory Models
di: Saddler, Mark R., et al.
Pubblicazione: (2020)
di: Saddler, Mark R., et al.
Pubblicazione: (2020)
Denoising by neural network for muzzle blast detection
di: Pujol, Hadrien, et al.
Pubblicazione: (2025)
di: Pujol, Hadrien, et al.
Pubblicazione: (2025)
TaDiCodec: Text-aware Diffusion Speech Tokenizer for Speech Language Modeling
di: Wang, Yuancheng, et al.
Pubblicazione: (2025)
di: Wang, Yuancheng, et al.
Pubblicazione: (2025)
Multi-channel Speech Separation Using Spatially Selective Deep Non-linear Filters
di: Tesch, Kristina, et al.
Pubblicazione: (2023)
di: Tesch, Kristina, et al.
Pubblicazione: (2023)
SpecDiff-GAN: A Spectrally-Shaped Noise Diffusion GAN for Speech and Music Synthesis
di: Baoueb, Teysir, et al.
Pubblicazione: (2024)
di: Baoueb, Teysir, et al.
Pubblicazione: (2024)
RoVo: Robust Voice Protection Against Unauthorized Speech Synthesis with Embedding-Level Perturbations
di: Kim, Seungmin, et al.
Pubblicazione: (2025)
di: Kim, Seungmin, et al.
Pubblicazione: (2025)
Diffusion Synthesizer for Efficient Multilingual Speech to Speech Translation
di: Hirschkind, Nameer, et al.
Pubblicazione: (2024)
di: Hirschkind, Nameer, et al.
Pubblicazione: (2024)
CPT-Boosted Wav2vec2.0: Towards Noise Robust Speech Recognition for Classroom Environments
di: Attia, Ahmed Adel, et al.
Pubblicazione: (2024)
di: Attia, Ahmed Adel, et al.
Pubblicazione: (2024)
Lightweight DNN for Full-Band Speech Denoising on Mobile Devices: Exploiting Long and Short Temporal Patterns
di: Drossos, Konstantinos, et al.
Pubblicazione: (2025)
di: Drossos, Konstantinos, et al.
Pubblicazione: (2025)
Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM
di: Sun, Zhaokai, et al.
Pubblicazione: (2025)
di: Sun, Zhaokai, et al.
Pubblicazione: (2025)
A Neural Speech Codec for Noise Robust Speech Coding
di: Huang, Jiayi, et al.
Pubblicazione: (2023)
di: Huang, Jiayi, et al.
Pubblicazione: (2023)
Speech to Speech Synthesis for Voice Impersonation
di: Johnson, Bjorn, et al.
Pubblicazione: (2026)
di: Johnson, Bjorn, et al.
Pubblicazione: (2026)
Documenti analoghi
-
TRNet: Two-level Refinement Network leveraging Speech Enhancement for Noise Robust Speech Emotion Recognition
di: Chen, Chengxin, et al.
Pubblicazione: (2024) -
Comparative Study on Noise-Augmented Training and its Effect on Adversarial Robustness in ASR Systems
di: Pizzi, Karla, et al.
Pubblicazione: (2024) -
Noise-aware Speech Enhancement using Diffusion Probabilistic Model
di: Hu, Yuchen, et al.
Pubblicazione: (2023) -
Wav2code: Restore Clean Speech Representations via Codebook Lookup for Noise-Robust ASR
di: Hu, Yuchen, et al.
Pubblicazione: (2023) -
Adversarial Training of Denoising Diffusion Model Using Dual Discriminators for High-Fidelity Multi-Speaker TTS
di: Ko, Myeongjin, et al.
Pubblicazione: (2023)