Variational Autoencoder for Personalized Pathological Speech Enhancement
Fuente:
arXiv
Guardado en:
| Autores principales: | Hou, Mingchi, Kodrasi, Ina |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Data Augmentation for Pathological Speech Enhancement
por: Hou, Mingchi, et al.
Publicado: (2026)
por: Hou, Mingchi, et al.
Publicado: (2026)
Influence of Clean Speech Characteristics on Speech Enhancement Performance
por: Hou, Mingchi, et al.
Publicado: (2025)
por: Hou, Mingchi, et al.
Publicado: (2025)
Generalizability of Predictive and Generative Speech Enhancement Models to Pathological Speakers
por: Hou, Mingchi, et al.
Publicado: (2025)
por: Hou, Mingchi, et al.
Publicado: (2025)
Suppressing Noise Disparity in Training Data for Automatic Pathological Speech Detection
por: Amiri, Mahdi, et al.
Publicado: (2024)
por: Amiri, Mahdi, et al.
Publicado: (2024)
Impact of Speech Mode in Automatic Pathological Speech Detection
por: Sheikh, Shakeel A., et al.
Publicado: (2024)
por: Sheikh, Shakeel A., et al.
Publicado: (2024)
Exploring In-Context Learning Capabilities of ChatGPT for Pathological Speech Detection
por: Amiri, Mahdi, et al.
Publicado: (2025)
por: Amiri, Mahdi, et al.
Publicado: (2025)
Multiview Canonical Correlation Analysis for Automatic Pathological Speech Detection
por: Kaloga, Yacouba, et al.
Publicado: (2024)
por: Kaloga, Yacouba, et al.
Publicado: (2024)
Towards interpretable emotion recognition: Identifying key features with machine learning
por: Kaloga, Yacouba, et al.
Publicado: (2025)
por: Kaloga, Yacouba, et al.
Publicado: (2025)
CLAP-Based Automatic Word Naming Recognition in Post-Stroke Aphasia
por: Kaloga, Yacouba, et al.
Publicado: (2026)
por: Kaloga, Yacouba, et al.
Publicado: (2026)
A Differentiable Alignment Framework for Sequence-to-Sequence Modeling via Optimal Transport
por: Kaloga, Yacouba, et al.
Publicado: (2025)
por: Kaloga, Yacouba, et al.
Publicado: (2025)
Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement
por: Huang, Ziling, et al.
Publicado: (2025)
por: Huang, Ziling, et al.
Publicado: (2025)
SEF-PNet: Speaker Encoder-Free Personalized Speech Enhancement with Local and Global Contexts Aggregation
por: Huang, Ziling, et al.
Publicado: (2025)
por: Huang, Ziling, et al.
Publicado: (2025)
SNR-Progressive Model with Harmonic Compensation for Low-SNR Speech Enhancement
por: Hou, Zhongshu, et al.
Publicado: (2024)
por: Hou, Zhongshu, et al.
Publicado: (2024)
Contrastive Knowledge Distillation for Embedding Refinement in Personalized Speech Enhancement
por: Serre, Thomas, et al.
Publicado: (2026)
por: Serre, Thomas, et al.
Publicado: (2026)
Plugin Speech Enhancement: A Universal Speech Enhancement Framework Inspired by Dynamic Neural Network
por: Chen, Yanan, et al.
Publicado: (2024)
por: Chen, Yanan, et al.
Publicado: (2024)
DurIAN-E 2: Duration Informed Attention Network with Adaptive Variational Autoencoder and Adversarial Learning for Expressive Text-to-Speech Synthesis
por: Gu, Yu, et al.
Publicado: (2024)
por: Gu, Yu, et al.
Publicado: (2024)
Robust Speech Recognition with Schrödinger Bridge-Based Speech Enhancement
por: Nasretdinov, Rauf, et al.
Publicado: (2025)
por: Nasretdinov, Rauf, et al.
Publicado: (2025)
Absorbing Discrete Diffusion for Speech Enhancement
por: Gonzalez, Philippe
Publicado: (2026)
por: Gonzalez, Philippe
Publicado: (2026)
Convolutional Variational Autoencoders for Spectrogram Compression in Automatic Speech Recognition
por: Iakovenko, Olga, et al.
Publicado: (2024)
por: Iakovenko, Olga, et al.
Publicado: (2024)
Accented Text-to-Speech Synthesis with a Conditional Variational Autoencoder
por: Melechovsky, Jan, et al.
Publicado: (2022)
por: Melechovsky, Jan, et al.
Publicado: (2022)
Objective and Subjective Evaluation of Diffusion-Based Speech Enhancement for Dysarthric Speech
por: de Groot, Dimme, et al.
Publicado: (2025)
por: de Groot, Dimme, et al.
Publicado: (2025)
Advancing Electrolaryngeal Speech Enhancement Through Speech-Text Representation Learning
por: Ma, Ding, et al.
Publicado: (2026)
por: Ma, Ding, et al.
Publicado: (2026)
Personalized Neural Speech Codec
por: Jang, Inseon, et al.
Publicado: (2024)
por: Jang, Inseon, et al.
Publicado: (2024)
Towards Environmental Preference Based Speech Enhancement For Individualised Multi-Modal Hearing Aids
por: Kirton-Wingate, Jasper, et al.
Publicado: (2024)
por: Kirton-Wingate, Jasper, et al.
Publicado: (2024)
DISPATCH: Distilling Selective Patches for Speech Enhancement
por: Kim, Dohwan, et al.
Publicado: (2025)
por: Kim, Dohwan, et al.
Publicado: (2025)
Universal Speech Enhancement with Regression and Generative Mamba
por: Chao, Rong, et al.
Publicado: (2025)
por: Chao, Rong, et al.
Publicado: (2025)
ICASSP 2026 URGENT Speech Enhancement Challenge
por: Li, Chenda, et al.
Publicado: (2026)
por: Li, Chenda, et al.
Publicado: (2026)
Investigating Training Objectives for Generative Speech Enhancement
por: Richter, Julius, et al.
Publicado: (2024)
por: Richter, Julius, et al.
Publicado: (2024)
Geneses: Unified Generative Speech Enhancement and Separation
por: Asai, Kohei, et al.
Publicado: (2026)
por: Asai, Kohei, et al.
Publicado: (2026)
Using Speech Foundational Models in Loss Functions for Hearing Aid Speech Enhancement
por: Sutherland, Robert, et al.
Publicado: (2024)
por: Sutherland, Robert, et al.
Publicado: (2024)
Rethinking Speech Representation Aggregation in Speech Enhancement: A Phonetic Mutual Information Perspective
por: Han, Seungu, et al.
Publicado: (2026)
por: Han, Seungu, et al.
Publicado: (2026)
Rethinking Processing Distortions: Disentangling the Impact of Speech Enhancement Errors on Speech Recognition Performance
por: Ochiai, Tsubasa, et al.
Publicado: (2024)
por: Ochiai, Tsubasa, et al.
Publicado: (2024)
Adaptive Convolution for CNN-based Speech Enhancement Models
por: Wang, Dahan, et al.
Publicado: (2025)
por: Wang, Dahan, et al.
Publicado: (2025)
Schrödinger Bridge Consistency Trajectory Models for Speech Enhancement
por: Nishigori, Shuichiro, et al.
Publicado: (2025)
por: Nishigori, Shuichiro, et al.
Publicado: (2025)
Multi-modal Speech Enhancement with Limited Electromyography Channels
por: Feng, Fuyuan, et al.
Publicado: (2025)
por: Feng, Fuyuan, et al.
Publicado: (2025)
Reverse Attention for Lightweight Speech Enhancement on Edge Devices
por: Ojha, Shuubham, et al.
Publicado: (2025)
por: Ojha, Shuubham, et al.
Publicado: (2025)
Amplifying Artifacts with Speech Enhancement in Voice Anti-spoofing
por: Trachu, Thanapat, et al.
Publicado: (2025)
por: Trachu, Thanapat, et al.
Publicado: (2025)
Dynamic Frequency-Adaptive Knowledge Distillation for Speech Enhancement
por: Yuan, Xihao, et al.
Publicado: (2025)
por: Yuan, Xihao, et al.
Publicado: (2025)
Improving Design of Input Condition Invariant Speech Enhancement
por: Zhang, Wangyou, et al.
Publicado: (2024)
por: Zhang, Wangyou, et al.
Publicado: (2024)
Evaluating Speech Enhancement Systems Through Listening Effort
por: Gelderblom, Femke B., et al.
Publicado: (2024)
por: Gelderblom, Femke B., et al.
Publicado: (2024)
Ejemplares similares
-
Data Augmentation for Pathological Speech Enhancement
por: Hou, Mingchi, et al.
Publicado: (2026) -
Influence of Clean Speech Characteristics on Speech Enhancement Performance
por: Hou, Mingchi, et al.
Publicado: (2025) -
Generalizability of Predictive and Generative Speech Enhancement Models to Pathological Speakers
por: Hou, Mingchi, et al.
Publicado: (2025) -
Suppressing Noise Disparity in Training Data for Automatic Pathological Speech Detection
por: Amiri, Mahdi, et al.
Publicado: (2024) -
Impact of Speech Mode in Automatic Pathological Speech Detection
por: Sheikh, Shakeel A., et al.
Publicado: (2024)