The PESQetarian: On the Relevance of Goodhart's Law for Speech Enhancement
Fuente:
arXiv
Guardado en:
| Autores principales: | de Oliveira, Danilo, Welker, Simon, Richter, Julius, Gerkmann, Timo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
StoRM: A Diffusion-based Stochastic Regeneration Model for Speech Enhancement and Dereverberation
por: Lemercier, Jean-Marie, et al.
Publicado: (2022)
por: Lemercier, Jean-Marie, et al.
Publicado: (2022)
Non-intrusive Speech Quality Assessment with Diffusion Models Trained on Clean Speech
por: de Oliveira, Danilo, et al.
Publicado: (2024)
por: de Oliveira, Danilo, et al.
Publicado: (2024)
Speech Enhancement and Dereverberation with Diffusion-based Generative Models
por: Richter, Julius, et al.
Publicado: (2022)
por: Richter, Julius, et al.
Publicado: (2022)
Investigating Training Objectives for Generative Speech Enhancement
por: Richter, Julius, et al.
Publicado: (2024)
por: Richter, Julius, et al.
Publicado: (2024)
EARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dereverberation
por: Richter, Julius, et al.
Publicado: (2024)
por: Richter, Julius, et al.
Publicado: (2024)
Diffusion Buffer for Online Generative Speech Enhancement
por: Lay, Bunlong, et al.
Publicado: (2025)
por: Lay, Bunlong, et al.
Publicado: (2025)
Do We Need EMA for Diffusion-Based Speech Enhancement? Toward a Magnitude-Preserving Network Architecture
por: Richter, Julius, et al.
Publicado: (2025)
por: Richter, Julius, et al.
Publicado: (2025)
An Analysis of the Variance of Diffusion-based Speech Enhancement
por: Lay, Bunlong, et al.
Publicado: (2024)
por: Lay, Bunlong, et al.
Publicado: (2024)
Diffusion Models for Audio Restoration
por: Lemercier, Jean-Marie, et al.
Publicado: (2024)
por: Lemercier, Jean-Marie, et al.
Publicado: (2024)
Single and Few-step Diffusion for Generative Speech Enhancement
por: Lay, Bunlong, et al.
Publicado: (2023)
por: Lay, Bunlong, et al.
Publicado: (2023)
Real-Time Streaming Mel Vocoding with Generative Flow Matching
por: Welker, Simon, et al.
Publicado: (2025)
por: Welker, Simon, et al.
Publicado: (2025)
LipDiffuser: Lip-to-Speech Generation with Conditional Diffusion Models
por: Richter, Julius, et al.
Publicado: (2025)
por: Richter, Julius, et al.
Publicado: (2025)
Are Modern Speech Enhancement Systems Vulnerable to Adversarial Attacks?
por: Makarov, Rostislav, et al.
Publicado: (2025)
por: Makarov, Rostislav, et al.
Publicado: (2025)
Bone-conduction Guided Multimodal Speech Enhancement with Conditional Diffusion Models
por: Khanagha, Sina, et al.
Publicado: (2026)
por: Khanagha, Sina, et al.
Publicado: (2026)
BUDDy: Single-Channel Blind Unsupervised Dereverberation with Diffusion Models
por: Moliner, Eloi, et al.
Publicado: (2024)
por: Moliner, Eloi, et al.
Publicado: (2024)
Unsupervised Blind Joint Dereverberation and Room Acoustics Estimation with Diffusion Models
por: Lemercier, Jean-Marie, et al.
Publicado: (2024)
por: Lemercier, Jean-Marie, et al.
Publicado: (2024)
Multi-channel Speech Separation Using Spatially Selective Deep Non-linear Filters
por: Tesch, Kristina, et al.
Publicado: (2023)
por: Tesch, Kristina, et al.
Publicado: (2023)
ReverbFX: A Dataset of Room Impulse Responses Derived from Reverb Effect Plugins for Singing Voice Dereverberation
por: Richter, Julius, et al.
Publicado: (2025)
por: Richter, Julius, et al.
Publicado: (2025)
Steering Deep Non-Linear Spatially Selective Filters for Weakly Guided Extraction of Moving Speakers in Dynamic Scenarios
por: Kienegger, Jakob, et al.
Publicado: (2025)
por: Kienegger, Jakob, et al.
Publicado: (2025)
Autoregressive Guidance of Deep Spatially Selective Filters using Bayesian Tracking for Efficient Extraction of Moving Speakers
por: Kienegger, Jakob, et al.
Publicado: (2026)
por: Kienegger, Jakob, et al.
Publicado: (2026)
Adaptive Rotary Steering with Joint Autoregression for Robust Extraction of Closely Moving Speakers in Dynamic Scenarios
por: Kienegger, Jakob, et al.
Publicado: (2026)
por: Kienegger, Jakob, et al.
Publicado: (2026)
Are These Even Words? Quantifying the Gibberishness of Generative Speech Models
por: de Oliveira, Danilo, et al.
Publicado: (2025)
por: de Oliveira, Danilo, et al.
Publicado: (2025)
Mask-Weighted Spatial Likelihood Coding for Speaker-Independent Joint Localization and Mask Estimation
por: Kienegger, Jakob, et al.
Publicado: (2024)
por: Kienegger, Jakob, et al.
Publicado: (2024)
EMOCONV-DIFF: Diffusion-based Speech Emotion Conversion for Non-parallel and In-the-wild Data
por: Prabhu, Navin Raj, et al.
Publicado: (2023)
por: Prabhu, Navin Raj, et al.
Publicado: (2023)
FlowDec: A flow-based full-band general audio codec with high perceptual quality
por: Welker, Simon, et al.
Publicado: (2025)
por: Welker, Simon, et al.
Publicado: (2025)
Self-Steering Deep Non-Linear Spatially Selective Filters for Efficient Extraction of Moving Speakers under Weak Guidance
por: Kienegger, Jakob, et al.
Publicado: (2025)
por: Kienegger, Jakob, et al.
Publicado: (2025)
Wind Noise Reduction with a Diffusion-based Stochastic Regeneration Model
por: Lemercier, Jean-Marie, et al.
Publicado: (2023)
por: Lemercier, Jean-Marie, et al.
Publicado: (2023)
HRTF Estimation using a Score-based Prior
por: Thuillier, Etienne, et al.
Publicado: (2024)
por: Thuillier, Etienne, et al.
Publicado: (2024)
Diffusion Buffer: Online Diffusion-based Speech Enhancement with Sub-Second Latency
por: Lay, Bunlong, et al.
Publicado: (2025)
por: Lay, Bunlong, et al.
Publicado: (2025)
Too Good to Be True: A Study on Modern Automatic Speech Recognition for the Evaluation of Speech Enhancement
por: de Oliveira, Danilo, et al.
Publicado: (2026)
por: de Oliveira, Danilo, et al.
Publicado: (2026)
Test-Time Training for Speech Enhancement
por: Behera, Avishkar, et al.
Publicado: (2025)
por: Behera, Avishkar, et al.
Publicado: (2025)
Scalable Speech Enhancement with Dynamic Channel Pruning
por: Miccini, Riccardo, et al.
Publicado: (2024)
por: Miccini, Riccardo, et al.
Publicado: (2024)
Autoregressive Speech Enhancement via Acoustic Tokens
por: Della Libera, Luca, et al.
Publicado: (2025)
por: Della Libera, Luca, et al.
Publicado: (2025)
Adaptive Slimming for Scalable and Efficient Speech Enhancement
por: Miccini, Riccardo, et al.
Publicado: (2025)
por: Miccini, Riccardo, et al.
Publicado: (2025)
Investigating the Effects of Diffusion-based Conditional Generative Speech Models Used for Speech Enhancement on Dysarthric Speech
por: Reszka, Joanna, et al.
Publicado: (2024)
por: Reszka, Joanna, et al.
Publicado: (2024)
Investigating the Design Space of Diffusion Models for Speech Enhancement
por: Gonzalez, Philippe, et al.
Publicado: (2023)
por: Gonzalez, Philippe, et al.
Publicado: (2023)
Posterior Transition Modeling for Unsupervised Diffusion-Based Speech Enhancement
por: Sadeghi, Mostafa, et al.
Publicado: (2025)
por: Sadeghi, Mostafa, et al.
Publicado: (2025)
High-Fidelity Speech Enhancement via Discrete Audio Tokens
por: Lanzendörfer, Luca A., et al.
Publicado: (2025)
por: Lanzendörfer, Luca A., et al.
Publicado: (2025)
Noise-aware Speech Enhancement using Diffusion Probabilistic Model
por: Hu, Yuchen, et al.
Publicado: (2023)
por: Hu, Yuchen, et al.
Publicado: (2023)
TRNet: Two-level Refinement Network leveraging Speech Enhancement for Noise Robust Speech Emotion Recognition
por: Chen, Chengxin, et al.
Publicado: (2024)
por: Chen, Chengxin, et al.
Publicado: (2024)
Ejemplares similares
-
StoRM: A Diffusion-based Stochastic Regeneration Model for Speech Enhancement and Dereverberation
por: Lemercier, Jean-Marie, et al.
Publicado: (2022) -
Non-intrusive Speech Quality Assessment with Diffusion Models Trained on Clean Speech
por: de Oliveira, Danilo, et al.
Publicado: (2024) -
Speech Enhancement and Dereverberation with Diffusion-based Generative Models
por: Richter, Julius, et al.
Publicado: (2022) -
Investigating Training Objectives for Generative Speech Enhancement
por: Richter, Julius, et al.
Publicado: (2024) -
EARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dereverberation
por: Richter, Julius, et al.
Publicado: (2024)