Detecting and Defending Against Adversarial Attacks on Automatic Speech Recognition via Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kühne, Nikolai L., Kitchen, Astrid H. F., Jensen, Marie S., Brøndt, Mikkel S. L., Gonzalez, Martin, Biscio, Christophe, Tan, Zheng-Hua |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
xLSTM-SENet: xLSTM for Single-Channel Speech Enhancement
par: Kühne, Nikolai Lund, et autres
Publié: (2025)
par: Kühne, Nikolai Lund, et autres
Publié: (2025)
MambAttention: Mamba with Multi-Head Attention for Generalizable Single-Channel Speech Enhancement
par: Kühne, Nikolai Lund, et autres
Publié: (2025)
par: Kühne, Nikolai Lund, et autres
Publié: (2025)
Exploring Resolution-Wise Shared Attention in Hybrid Mamba-U-Nets for Improved Cross-Corpus Speech Enhancement
par: Kühne, Nikolai Lund, et autres
Publié: (2025)
par: Kühne, Nikolai Lund, et autres
Publié: (2025)
Zero-Query Adversarial Attack on Black-box Automatic Speech Recognition Systems
par: Fang, Zheng, et autres
Publié: (2024)
par: Fang, Zheng, et autres
Publié: (2024)
The Effect of Training Dataset Size on Discriminative and Diffusion-Based Speech Enhancement Systems
par: Gonzalez, Philippe, et autres
Publié: (2024)
par: Gonzalez, Philippe, et autres
Publié: (2024)
Adversarial Attacks and Defenses for Speech Recognition Systems
par: Żelasko, Piotr, et autres
Publié: (2021)
par: Żelasko, Piotr, et autres
Publié: (2021)
Fairness of Automatic Speech Recognition in Cleft Lip and Palate Speech
par: Bhattacharjee, Susmita, et autres
Publié: (2025)
par: Bhattacharjee, Susmita, et autres
Publié: (2025)
Speaker Attributed Automatic Speech Recognition Using Speech Aware LLMS
par: Aronowitz, Hagai, et autres
Publié: (2026)
par: Aronowitz, Hagai, et autres
Publié: (2026)
Unsupervised Online Continual Learning for Automatic Speech Recognition
par: Eeckt, Steven Vander, et autres
Publié: (2024)
par: Eeckt, Steven Vander, et autres
Publié: (2024)
Using Songs to Improve Kazakh Automatic Speech Recognition
par: Yeshpanov, Rustem
Publié: (2026)
par: Yeshpanov, Rustem
Publié: (2026)
The RoyalFlush Automatic Speech Diarization and Recognition System for In-Car Multi-Channel Automatic Speech Recognition Challenge
par: Tian, Jingguang, et autres
Publié: (2024)
par: Tian, Jingguang, et autres
Publié: (2024)
Investigating the Design Space of Diffusion Models for Speech Enhancement
par: Gonzalez, Philippe, et autres
Publié: (2023)
par: Gonzalez, Philippe, et autres
Publié: (2023)
Clever Hans Effect Found in Automatic Detection of Alzheimer's Disease through Speech
par: Liu, Yin-Long, et autres
Publié: (2024)
par: Liu, Yin-Long, et autres
Publié: (2024)
Fine-Tuning Automatic Speech Recognition for People with Parkinson's: An Effective Strategy for Enhancing Speech Technology Accessibility
par: Zheng, Xiuwen, et autres
Publié: (2024)
par: Zheng, Xiuwen, et autres
Publié: (2024)
Non-Intrusive Automatic Speech Recognition Refinement: A Survey
par: Peyghan, Mohammad Reza, et autres
Publié: (2025)
par: Peyghan, Mohammad Reza, et autres
Publié: (2025)
Findings of the 2024 Mandarin Stuttering Event Detection and Automatic Speech Recognition Challenge
par: Xue, Hongfei, et autres
Publié: (2024)
par: Xue, Hongfei, et autres
Publié: (2024)
DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification
par: Wang, Qing, et autres
Publié: (2025)
par: Wang, Qing, et autres
Publié: (2025)
MORE: Multi-Objective Adversarial Attacks on Speech Recognition
par: Gao, Xiaoxue, et autres
Publié: (2026)
par: Gao, Xiaoxue, et autres
Publié: (2026)
Complex Recurrent Variational Autoencoder with Application to Speech Enhancement
par: Xie, Yuying, et autres
Publié: (2022)
par: Xie, Yuying, et autres
Publié: (2022)
Too Good to Be True: A Study on Modern Automatic Speech Recognition for the Evaluation of Speech Enhancement
par: de Oliveira, Danilo, et autres
Publié: (2026)
par: de Oliveira, Danilo, et autres
Publié: (2026)
UME: Upcycling Mixture-of-Experts for Scalable and Efficient Automatic Speech Recognition
par: Fu, Li, et autres
Publié: (2024)
par: Fu, Li, et autres
Publié: (2024)
FairASR: Fair Audio Contrastive Learning for Automatic Speech Recognition
par: Kim, Jongsuk, et autres
Publié: (2025)
par: Kim, Jongsuk, et autres
Publié: (2025)
Group-Aware Partial Model Merging for Children's Automatic Speech Recognition
par: Rolland, Thomas, et autres
Publié: (2025)
par: Rolland, Thomas, et autres
Publié: (2025)
ASVspoof 5: Design, Collection and Validation of Resources for Spoofing, Deepfake, and Adversarial Attack Detection Using Crowdsourced Speech
par: Wang, Xin, et autres
Publié: (2025)
par: Wang, Xin, et autres
Publié: (2025)
Disentangled-Transformer: An Explainable End-to-End Automatic Speech Recognition Model with Speech Content-Context Separation
par: Wang, Pu, et autres
Publié: (2024)
par: Wang, Pu, et autres
Publié: (2024)
Improving Automatic Speech Recognition with Decoder-Centric Regularisation in Encoder-Decoder Models
par: Polok, Alexander, et autres
Publié: (2024)
par: Polok, Alexander, et autres
Publié: (2024)
Using Adapters to Overcome Catastrophic Forgetting in End-to-End Automatic Speech Recognition
par: Eeckt, Steven Vander, et autres
Publié: (2022)
par: Eeckt, Steven Vander, et autres
Publié: (2022)
Diffusion-Based Speech Enhancement in Matched and Mismatched Conditions Using a Heun-Based Sampler
par: Gonzalez, Philippe, et autres
Publié: (2023)
par: Gonzalez, Philippe, et autres
Publié: (2023)
Zero-Shot Recognition of Dysarthric Speech Using Commercial Automatic Speech Recognition and Multimodal Large Language Models
par: Alsayegh, Ali, et autres
Publié: (2025)
par: Alsayegh, Ali, et autres
Publié: (2025)
Automatic Speech Recognition for Hindi
par: Saha, Anish, et autres
Publié: (2024)
par: Saha, Anish, et autres
Publié: (2024)
Pitch Accent Detection improves Pretrained Automatic Speech Recognition
par: Sasu, David, et autres
Publié: (2025)
par: Sasu, David, et autres
Publié: (2025)
Augmenting Polish Automatic Speech Recognition System With Synthetic Data
par: Bondaruk, Łukasz, et autres
Publié: (2024)
par: Bondaruk, Łukasz, et autres
Publié: (2024)
Leveraging Self-Supervised Models for Automatic Whispered Speech Recognition
par: Farhadipour, Aref, et autres
Publié: (2024)
par: Farhadipour, Aref, et autres
Publié: (2024)
Rehearsal-Free Online Continual Learning for Automatic Speech Recognition
par: Eeckt, Steven Vander, et autres
Publié: (2023)
par: Eeckt, Steven Vander, et autres
Publié: (2023)
Training Data Augmentation for Dysarthric Automatic Speech Recognition by Text-to-Dysarthric-Speech Synthesis
par: Leung, Wing-Zin, et autres
Publié: (2024)
par: Leung, Wing-Zin, et autres
Publié: (2024)
Zero Shot Text to Speech Augmentation for Automatic Speech Recognition on Low-Resource Accented Speech Corpora
par: Nespoli, Francesco, et autres
Publié: (2024)
par: Nespoli, Francesco, et autres
Publié: (2024)
PhoWhisper: Automatic Speech Recognition for Vietnamese
par: Le, Thanh-Thien, et autres
Publié: (2024)
par: Le, Thanh-Thien, et autres
Publié: (2024)
Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models
par: Lin, Yuke, et autres
Publié: (2025)
par: Lin, Yuke, et autres
Publié: (2025)
Lost in Transcription: Identifying and Quantifying the Accuracy Biases of Automatic Speech Recognition Systems Against Disfluent Speech
par: Mujtaba, Dena, et autres
Publié: (2024)
par: Mujtaba, Dena, et autres
Publié: (2024)
WeDefense: A Toolkit to Defend Against Fake Audio
par: Zhang, Lin, et autres
Publié: (2026)
par: Zhang, Lin, et autres
Publié: (2026)
Documents similaires
-
xLSTM-SENet: xLSTM for Single-Channel Speech Enhancement
par: Kühne, Nikolai Lund, et autres
Publié: (2025) -
MambAttention: Mamba with Multi-Head Attention for Generalizable Single-Channel Speech Enhancement
par: Kühne, Nikolai Lund, et autres
Publié: (2025) -
Exploring Resolution-Wise Shared Attention in Hybrid Mamba-U-Nets for Improved Cross-Corpus Speech Enhancement
par: Kühne, Nikolai Lund, et autres
Publié: (2025) -
Zero-Query Adversarial Attack on Black-box Automatic Speech Recognition Systems
par: Fang, Zheng, et autres
Publié: (2024) -
The Effect of Training Dataset Size on Discriminative and Diffusion-Based Speech Enhancement Systems
par: Gonzalez, Philippe, et autres
Publié: (2024)