Are Modern Speech Enhancement Systems Vulnerable to Adversarial Attacks?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Makarov, Rostislav, Schönherr, Lea, Gerkmann, Timo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Diffusion Buffer for Online Generative Speech Enhancement
par: Lay, Bunlong, et autres
Publié: (2025)
par: Lay, Bunlong, et autres
Publié: (2025)
Diffusion Buffer: Online Diffusion-based Speech Enhancement with Sub-Second Latency
par: Lay, Bunlong, et autres
Publié: (2025)
par: Lay, Bunlong, et autres
Publié: (2025)
An Analysis of the Variance of Diffusion-based Speech Enhancement
par: Lay, Bunlong, et autres
Publié: (2024)
par: Lay, Bunlong, et autres
Publié: (2024)
Bone-conduction Guided Multimodal Speech Enhancement with Conditional Diffusion Models
par: Khanagha, Sina, et autres
Publié: (2026)
par: Khanagha, Sina, et autres
Publié: (2026)
The PESQetarian: On the Relevance of Goodhart's Law for Speech Enhancement
par: de Oliveira, Danilo, et autres
Publié: (2024)
par: de Oliveira, Danilo, et autres
Publié: (2024)
Multi-channel Speech Separation Using Spatially Selective Deep Non-linear Filters
par: Tesch, Kristina, et autres
Publié: (2023)
par: Tesch, Kristina, et autres
Publié: (2023)
Speech Enhancement and Dereverberation with Diffusion-based Generative Models
par: Richter, Julius, et autres
Publié: (2022)
par: Richter, Julius, et autres
Publié: (2022)
StoRM: A Diffusion-based Stochastic Regeneration Model for Speech Enhancement and Dereverberation
par: Lemercier, Jean-Marie, et autres
Publié: (2022)
par: Lemercier, Jean-Marie, et autres
Publié: (2022)
EARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dereverberation
par: Richter, Julius, et autres
Publié: (2024)
par: Richter, Julius, et autres
Publié: (2024)
Single and Few-step Diffusion for Generative Speech Enhancement
par: Lay, Bunlong, et autres
Publié: (2023)
par: Lay, Bunlong, et autres
Publié: (2023)
Steering Deep Non-Linear Spatially Selective Filters for Weakly Guided Extraction of Moving Speakers in Dynamic Scenarios
par: Kienegger, Jakob, et autres
Publié: (2025)
par: Kienegger, Jakob, et autres
Publié: (2025)
Autoregressive Guidance of Deep Spatially Selective Filters using Bayesian Tracking for Efficient Extraction of Moving Speakers
par: Kienegger, Jakob, et autres
Publié: (2026)
par: Kienegger, Jakob, et autres
Publié: (2026)
Adaptive Rotary Steering with Joint Autoregression for Robust Extraction of Closely Moving Speakers in Dynamic Scenarios
par: Kienegger, Jakob, et autres
Publié: (2026)
par: Kienegger, Jakob, et autres
Publié: (2026)
Investigating Training Objectives for Generative Speech Enhancement
par: Richter, Julius, et autres
Publié: (2024)
par: Richter, Julius, et autres
Publié: (2024)
Non-intrusive Speech Quality Assessment with Diffusion Models Trained on Clean Speech
par: de Oliveira, Danilo, et autres
Publié: (2024)
par: de Oliveira, Danilo, et autres
Publié: (2024)
Mask-Weighted Spatial Likelihood Coding for Speaker-Independent Joint Localization and Mask Estimation
par: Kienegger, Jakob, et autres
Publié: (2024)
par: Kienegger, Jakob, et autres
Publié: (2024)
Do We Need EMA for Diffusion-Based Speech Enhancement? Toward a Magnitude-Preserving Network Architecture
par: Richter, Julius, et autres
Publié: (2025)
par: Richter, Julius, et autres
Publié: (2025)
Self-Steering Deep Non-Linear Spatially Selective Filters for Efficient Extraction of Moving Speakers under Weak Guidance
par: Kienegger, Jakob, et autres
Publié: (2025)
par: Kienegger, Jakob, et autres
Publié: (2025)
Real-Time Streaming Mel Vocoding with Generative Flow Matching
par: Welker, Simon, et autres
Publié: (2025)
par: Welker, Simon, et autres
Publié: (2025)
Wind Noise Reduction with a Diffusion-based Stochastic Regeneration Model
par: Lemercier, Jean-Marie, et autres
Publié: (2023)
par: Lemercier, Jean-Marie, et autres
Publié: (2023)
HRTF Estimation using a Score-based Prior
par: Thuillier, Etienne, et autres
Publié: (2024)
par: Thuillier, Etienne, et autres
Publié: (2024)
BUDDy: Single-Channel Blind Unsupervised Dereverberation with Diffusion Models
par: Moliner, Eloi, et autres
Publié: (2024)
par: Moliner, Eloi, et autres
Publié: (2024)
Unsupervised Blind Joint Dereverberation and Room Acoustics Estimation with Diffusion Models
par: Lemercier, Jean-Marie, et autres
Publié: (2024)
par: Lemercier, Jean-Marie, et autres
Publié: (2024)
HiFi-Stream: Streaming Speech Enhancement with Generative Adversarial Networks
par: Dmitrieva, Ekaterina, et autres
Publié: (2025)
par: Dmitrieva, Ekaterina, et autres
Publié: (2025)
Diffusion Models for Audio Restoration
par: Lemercier, Jean-Marie, et autres
Publié: (2024)
par: Lemercier, Jean-Marie, et autres
Publié: (2024)
Are These Even Words? Quantifying the Gibberishness of Generative Speech Models
par: de Oliveira, Danilo, et autres
Publié: (2025)
par: de Oliveira, Danilo, et autres
Publié: (2025)
LipDiffuser: Lip-to-Speech Generation with Conditional Diffusion Models
par: Richter, Julius, et autres
Publié: (2025)
par: Richter, Julius, et autres
Publié: (2025)
Test-Time Training for Speech Enhancement
par: Behera, Avishkar, et autres
Publié: (2025)
par: Behera, Avishkar, et autres
Publié: (2025)
Autoregressive Speech Enhancement via Acoustic Tokens
par: Della Libera, Luca, et autres
Publié: (2025)
par: Della Libera, Luca, et autres
Publié: (2025)
Adaptive Slimming for Scalable and Efficient Speech Enhancement
par: Miccini, Riccardo, et autres
Publié: (2025)
par: Miccini, Riccardo, et autres
Publié: (2025)
Scalable Speech Enhancement with Dynamic Channel Pruning
par: Miccini, Riccardo, et autres
Publié: (2024)
par: Miccini, Riccardo, et autres
Publié: (2024)
ReverbFX: A Dataset of Room Impulse Responses Derived from Reverb Effect Plugins for Singing Voice Dereverberation
par: Richter, Julius, et autres
Publié: (2025)
par: Richter, Julius, et autres
Publié: (2025)
Investigating the Effects of Diffusion-based Conditional Generative Speech Models Used for Speech Enhancement on Dysarthric Speech
par: Reszka, Joanna, et autres
Publié: (2024)
par: Reszka, Joanna, et autres
Publié: (2024)
Investigating the Design Space of Diffusion Models for Speech Enhancement
par: Gonzalez, Philippe, et autres
Publié: (2023)
par: Gonzalez, Philippe, et autres
Publié: (2023)
Are Deep Speech Denoising Models Robust to Adversarial Noise?
par: Schwarzer, Will, et autres
Publié: (2025)
par: Schwarzer, Will, et autres
Publié: (2025)
MAIA: An Inpainting-Based Approach for Music Adversarial Attacks
par: Liu, Yuxuan, et autres
Publié: (2025)
par: Liu, Yuxuan, et autres
Publié: (2025)
Posterior Transition Modeling for Unsupervised Diffusion-Based Speech Enhancement
par: Sadeghi, Mostafa, et autres
Publié: (2025)
par: Sadeghi, Mostafa, et autres
Publié: (2025)
High-Fidelity Speech Enhancement via Discrete Audio Tokens
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
Noise-aware Speech Enhancement using Diffusion Probabilistic Model
par: Hu, Yuchen, et autres
Publié: (2023)
par: Hu, Yuchen, et autres
Publié: (2023)
TRNet: Two-level Refinement Network leveraging Speech Enhancement for Noise Robust Speech Emotion Recognition
par: Chen, Chengxin, et autres
Publié: (2024)
par: Chen, Chengxin, et autres
Publié: (2024)
Documents similaires
-
Diffusion Buffer for Online Generative Speech Enhancement
par: Lay, Bunlong, et autres
Publié: (2025) -
Diffusion Buffer: Online Diffusion-based Speech Enhancement with Sub-Second Latency
par: Lay, Bunlong, et autres
Publié: (2025) -
An Analysis of the Variance of Diffusion-based Speech Enhancement
par: Lay, Bunlong, et autres
Publié: (2024) -
Bone-conduction Guided Multimodal Speech Enhancement with Conditional Diffusion Models
par: Khanagha, Sina, et autres
Publié: (2026) -
The PESQetarian: On the Relevance of Goodhart's Law for Speech Enhancement
par: de Oliveira, Danilo, et autres
Publié: (2024)