Quantifying Quanvolutional Neural Networks Robustness for Speech in Healthcare Applications
Fuente:
arXiv
Salvato in:
| Autori principali: | Tran, Ha, Kashyap, Bipasha, Pathirana, Pubudu N. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Geometric Analysis of Speech Representation Spaces: Topological Disentanglement and Confound Detection
di: Kashyap, Bipasha, et al.
Pubblicazione: (2026)
di: Kashyap, Bipasha, et al.
Pubblicazione: (2026)
Quantifying Dimensional Independence in Speech: An Information-Theoretic Framework for Disentangled Representation Learning
di: Kashyap, Bipasha, et al.
Pubblicazione: (2026)
di: Kashyap, Bipasha, et al.
Pubblicazione: (2026)
Quantum-Enhanced Transformers for Robust Acoustic Scene Classification in IoT Environments
di: Quan, Minh K., et al.
Pubblicazione: (2025)
di: Quan, Minh K., et al.
Pubblicazione: (2025)
Quantum-Inspired Genetic Algorithm for Robust Source Separation in Smart City Acoustics
di: Quan, Minh K., et al.
Pubblicazione: (2025)
di: Quan, Minh K., et al.
Pubblicazione: (2025)
TRNet: Two-level Refinement Network leveraging Speech Enhancement for Noise Robust Speech Emotion Recognition
di: Chen, Chengxin, et al.
Pubblicazione: (2024)
di: Chen, Chengxin, et al.
Pubblicazione: (2024)
Dynamic Gated Recurrent Neural Network for Compute-efficient Speech Enhancement
di: Cheng, Longbiao, et al.
Pubblicazione: (2024)
di: Cheng, Longbiao, et al.
Pubblicazione: (2024)
Reverse-Speech-Finder: A Neural Network Backtracking Architecture for Generating Alzheimer's Disease Speech Samples and Improving Diagnosis Performance
di: Li, Victor OK, et al.
Pubblicazione: (2025)
di: Li, Victor OK, et al.
Pubblicazione: (2025)
RobustSpeechFlow: Learning Robust Text-to-Speech Trajectories via Augmentation-based Contrastive Flow Matching
di: Yang, Jinhyeok, et al.
Pubblicazione: (2026)
di: Yang, Jinhyeok, et al.
Pubblicazione: (2026)
Neural Speech Extraction with Human Feedback
di: Itani, Malek, et al.
Pubblicazione: (2025)
di: Itani, Malek, et al.
Pubblicazione: (2025)
Over-the-air White-box Attack on the Wav2Vec Speech Recognition Neural Network
di: Alexey, Protopopov
Pubblicazione: (2026)
di: Alexey, Protopopov
Pubblicazione: (2026)
emoDARTS: Joint Optimisation of CNN & Sequential Neural Network Architectures for Superior Speech Emotion Recognition
di: Rajapakshe, Thejan, et al.
Pubblicazione: (2024)
di: Rajapakshe, Thejan, et al.
Pubblicazione: (2024)
Latent-Domain Predictive Neural Speech Coding
di: Jiang, Xue, et al.
Pubblicazione: (2022)
di: Jiang, Xue, et al.
Pubblicazione: (2022)
Are Deep Speech Denoising Models Robust to Adversarial Noise?
di: Schwarzer, Will, et al.
Pubblicazione: (2025)
di: Schwarzer, Will, et al.
Pubblicazione: (2025)
Multi-stream Convolutional Neural Network with Frequency Selection for Robust Speaker Verification
di: Yao, Wei, et al.
Pubblicazione: (2020)
di: Yao, Wei, et al.
Pubblicazione: (2020)
TF-MLPNet: Tiny Real-Time Neural Speech Separation
di: Itani, Malek, et al.
Pubblicazione: (2025)
di: Itani, Malek, et al.
Pubblicazione: (2025)
Switchboard-Affect: Emotion Perception Labels from Conversational Speech
di: Romana, Amrit, et al.
Pubblicazione: (2025)
di: Romana, Amrit, et al.
Pubblicazione: (2025)
Ultra-lightweight Neural Differential DSP Vocoder For High Quality Speech Synthesis
di: Agrawal, Prabhav, et al.
Pubblicazione: (2024)
di: Agrawal, Prabhav, et al.
Pubblicazione: (2024)
Combolutional Neural Networks
di: Churchwell, Cameron, et al.
Pubblicazione: (2025)
di: Churchwell, Cameron, et al.
Pubblicazione: (2025)
RoVo: Robust Voice Protection Against Unauthorized Speech Synthesis with Embedding-Level Perturbations
di: Kim, Seungmin, et al.
Pubblicazione: (2025)
di: Kim, Seungmin, et al.
Pubblicazione: (2025)
HiFi-Stream: Streaming Speech Enhancement with Generative Adversarial Networks
di: Dmitrieva, Ekaterina, et al.
Pubblicazione: (2025)
di: Dmitrieva, Ekaterina, et al.
Pubblicazione: (2025)
Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM
di: Sun, Zhaokai, et al.
Pubblicazione: (2025)
di: Sun, Zhaokai, et al.
Pubblicazione: (2025)
Wav2code: Restore Clean Speech Representations via Codebook Lookup for Noise-Robust ASR
di: Hu, Yuchen, et al.
Pubblicazione: (2023)
di: Hu, Yuchen, et al.
Pubblicazione: (2023)
Speech to Speech Synthesis for Voice Impersonation
di: Johnson, Bjorn, et al.
Pubblicazione: (2026)
di: Johnson, Bjorn, et al.
Pubblicazione: (2026)
Single-channel speech enhancement using learnable loss mixup
di: Chang, Oscar, et al.
Pubblicazione: (2023)
di: Chang, Oscar, et al.
Pubblicazione: (2023)
Impact of Speech Mode in Automatic Pathological Speech Detection
di: Sheikh, Shakeel A., et al.
Pubblicazione: (2024)
di: Sheikh, Shakeel A., et al.
Pubblicazione: (2024)
Diffusion Synthesizer for Efficient Multilingual Speech to Speech Translation
di: Hirschkind, Nameer, et al.
Pubblicazione: (2024)
di: Hirschkind, Nameer, et al.
Pubblicazione: (2024)
TextrolSpeech: A Text Style Control Speech Corpus With Codec Language Text-to-Speech Models
di: Ji, Shengpeng, et al.
Pubblicazione: (2023)
di: Ji, Shengpeng, et al.
Pubblicazione: (2023)
Investigating the Effects of Diffusion-based Conditional Generative Speech Models Used for Speech Enhancement on Dysarthric Speech
di: Reszka, Joanna, et al.
Pubblicazione: (2024)
di: Reszka, Joanna, et al.
Pubblicazione: (2024)
RepCodec: A Speech Representation Codec for Speech Tokenization
di: Huang, Zhichao, et al.
Pubblicazione: (2023)
di: Huang, Zhichao, et al.
Pubblicazione: (2023)
Bayesian Learning for Deep Neural Network Adaptation
di: Xie, Xurong, et al.
Pubblicazione: (2020)
di: Xie, Xurong, et al.
Pubblicazione: (2020)
BenSParX: A Robust Explainable Machine Learning Framework for Parkinson's Disease Detection from Bengali Conversational Speech
di: Hossain, Riad, et al.
Pubblicazione: (2025)
di: Hossain, Riad, et al.
Pubblicazione: (2025)
UniPET-SPK: A Unified Framework for Parameter-Efficient Tuning of Pre-trained Speech Models for Robust Speaker Verification
di: Sang, Mufan, et al.
Pubblicazione: (2025)
di: Sang, Mufan, et al.
Pubblicazione: (2025)
MiSTR: Multi-Modal iEEG-to-Speech Synthesis with Transformer-Based Prosody Prediction and Neural Phase Reconstruction
di: Al-Radhi, Mohammed Salah, et al.
Pubblicazione: (2025)
di: Al-Radhi, Mohammed Salah, et al.
Pubblicazione: (2025)
Run-Time Adaptation of Neural Beamforming for Robust Speech Dereverberation and Denoising
di: Fujita, Yoto, et al.
Pubblicazione: (2024)
di: Fujita, Yoto, et al.
Pubblicazione: (2024)
EARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dereverberation
di: Richter, Julius, et al.
Pubblicazione: (2024)
di: Richter, Julius, et al.
Pubblicazione: (2024)
Permutation Invariant Recurrent Neural Networks for Sound Source Tracking Applications
di: Diaz-Guerra, David, et al.
Pubblicazione: (2023)
di: Diaz-Guerra, David, et al.
Pubblicazione: (2023)
CogniVoice: Multimodal and Multilingual Fusion Networks for Mild Cognitive Impairment Assessment from Spontaneous Speech
di: Cheng, Jiali, et al.
Pubblicazione: (2024)
di: Cheng, Jiali, et al.
Pubblicazione: (2024)
Quantifying the Corpus Bias Problem in Automatic Music Transcription Systems
di: Marták, Lukáš Samuel, et al.
Pubblicazione: (2024)
di: Marták, Lukáš Samuel, et al.
Pubblicazione: (2024)
Speech Robust Bench: A Robustness Benchmark For Speech Recognition
di: Shah, Muhammad A., et al.
Pubblicazione: (2024)
di: Shah, Muhammad A., et al.
Pubblicazione: (2024)
RevRIR: Joint Reverberant Speech and Room Impulse Response Embedding using Contrastive Learning with Application to Room Shape Classification
di: Bitterman, Jacob, et al.
Pubblicazione: (2024)
di: Bitterman, Jacob, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Geometric Analysis of Speech Representation Spaces: Topological Disentanglement and Confound Detection
di: Kashyap, Bipasha, et al.
Pubblicazione: (2026) -
Quantifying Dimensional Independence in Speech: An Information-Theoretic Framework for Disentangled Representation Learning
di: Kashyap, Bipasha, et al.
Pubblicazione: (2026) -
Quantum-Enhanced Transformers for Robust Acoustic Scene Classification in IoT Environments
di: Quan, Minh K., et al.
Pubblicazione: (2025) -
Quantum-Inspired Genetic Algorithm for Robust Source Separation in Smart City Acoustics
di: Quan, Minh K., et al.
Pubblicazione: (2025) -
TRNet: Two-level Refinement Network leveraging Speech Enhancement for Noise Robust Speech Emotion Recognition
di: Chen, Chengxin, et al.
Pubblicazione: (2024)