A lightweight dual-stage framework for personalized speech enhancement based on DeepFilterNet2
Fuente:
arXiv
Guardado en:
| Autores principales: | Serre, Thomas, Fontaine, Mathieu, Benhaim, Éric, Dutour, Geoffroy, Essid, Slim |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Contrastive Knowledge Distillation for Embedding Refinement in Personalized Speech Enhancement
por: Serre, Thomas, et al.
Publicado: (2026)
por: Serre, Thomas, et al.
Publicado: (2026)
Online speaker diarization of meetings guided by speech separation
por: Gruttadauria, Elio, et al.
Publicado: (2024)
por: Gruttadauria, Elio, et al.
Publicado: (2024)
A Contrastive Self-Supervised Learning scheme for beat tracking amenable to few-shot learning
por: Gagnere, Antonin, et al.
Publicado: (2024)
por: Gagnere, Antonin, et al.
Publicado: (2024)
Controlling Contrastive Self-Supervised Learning with Knowledge-Driven Multiple Hypothesis: Application to Beat Tracking
por: Gagnere, Antonin, et al.
Publicado: (2025)
por: Gagnere, Antonin, et al.
Publicado: (2025)
Less Forgetting for Better Generalization: Exploring Continual-learning Fine-tuning Methods for Speech Self-supervised Representations
por: Zaiem, Salah, et al.
Publicado: (2024)
por: Zaiem, Salah, et al.
Publicado: (2024)
SALT: Standardized Audio event Label Taxonomy
por: Stamatiadis, Paraskevas, et al.
Publicado: (2024)
por: Stamatiadis, Paraskevas, et al.
Publicado: (2024)
A sound description: Exploring prompt templates and class descriptions to enhance zero-shot audio classification
por: Olvera, Michel, et al.
Publicado: (2024)
por: Olvera, Michel, et al.
Publicado: (2024)
IS${}^3$ : Generic Impulsive--Stationary Sound Separation in Acoustic Scenes using Deep Filtering
por: Berger, Clémentine, et al.
Publicado: (2025)
por: Berger, Clémentine, et al.
Publicado: (2025)
Perceptual Noise-Masking with Music through Deep Spectral Envelope Shaping
por: Berger, Clémentine, et al.
Publicado: (2025)
por: Berger, Clémentine, et al.
Publicado: (2025)
Inter-channel Conv-TasNet for multichannel speech enhancement
por: Lee, Dongheon, et al.
Publicado: (2021)
por: Lee, Dongheon, et al.
Publicado: (2021)
A lightweight and robust method for blind wideband-to-fullband extension of speech
por: Büthe, Jan, et al.
Publicado: (2024)
por: Büthe, Jan, et al.
Publicado: (2024)
Configurable EBEN: Extreme Bandwidth Extension Network to enhance body-conducted speech capture
por: Hauret, Julien, et al.
Publicado: (2023)
por: Hauret, Julien, et al.
Publicado: (2023)
Single-channel speech enhancement by using psychoacoustical model inspired fusion framework
por: Samui, Suman
Publicado: (2022)
por: Samui, Suman
Publicado: (2022)
RaD-Net 2: A causal two-stage repairing and denoising speech enhancement network with knowledge distillation and complex axial self-attention
por: Liu, Mingshuai, et al.
Publicado: (2024)
por: Liu, Mingshuai, et al.
Publicado: (2024)
Neural Steerer: Novel Steering Vector Synthesis with a Causal Neural Field over Frequency and Source Positions
por: Di Carlo, Diego, et al.
Publicado: (2023)
por: Di Carlo, Diego, et al.
Publicado: (2023)
KS-Net: Multi-band joint speech restoration and enhancement network for 2024 ICASSP SSI Challenge
por: Yu, Guochen, et al.
Publicado: (2024)
por: Yu, Guochen, et al.
Publicado: (2024)
Multiple Choice Learning for Efficient Speech Separation with Many Speakers
por: Perera, David, et al.
Publicado: (2024)
por: Perera, David, et al.
Publicado: (2024)
GDiffuSE: Diffusion-based speech enhancement with noise model guidance
por: Yanir, Efrayim, et al.
Publicado: (2025)
por: Yanir, Efrayim, et al.
Publicado: (2025)
Monaural speech enhancement on drone via Adapter based transfer learning
por: Chen, Xingyu, et al.
Publicado: (2024)
por: Chen, Xingyu, et al.
Publicado: (2024)
Deep low-latency joint speech transmission and enhancement over a gaussian channel
por: Bokaei, Mohammad, et al.
Publicado: (2024)
por: Bokaei, Mohammad, et al.
Publicado: (2024)
Towards noise-robust speech inversion through multi-task learning with speech enhancement
por: Tabatabaee, Saba, et al.
Publicado: (2026)
por: Tabatabaee, Saba, et al.
Publicado: (2026)
An adaptive filter bank based neural network approach for time delay estimation and speech enhancement
por: Ma, Lu
Publicado: (2025)
por: Ma, Lu
Publicado: (2025)
TTS-CtrlNet: Time varying emotion aligned text-to-speech generation with ControlNet
por: Jeong, Jaeseok, et al.
Publicado: (2025)
por: Jeong, Jaeseok, et al.
Publicado: (2025)
Unsupervised speech enhancement with spectral kurtosis and double deep priors
por: Ohnaka, Hien, et al.
Publicado: (2024)
por: Ohnaka, Hien, et al.
Publicado: (2024)
SPGM: Prioritizing Local Features for enhanced speech separation performance
por: Yip, Jia Qi, et al.
Publicado: (2023)
por: Yip, Jia Qi, et al.
Publicado: (2023)
Throat and acoustic paired speech dataset for deep learning-based speech enhancement
por: Kim, Yunsik, et al.
Publicado: (2025)
por: Kim, Yunsik, et al.
Publicado: (2025)
Modeling strategies for speech enhancement in the latent space of a neural audio codec
por: Kammoun, Sofiene, et al.
Publicado: (2025)
por: Kammoun, Sofiene, et al.
Publicado: (2025)
Using RLHF to align speech enhancement approaches to mean-opinion quality scores
por: Kumar, Anurag, et al.
Publicado: (2024)
por: Kumar, Anurag, et al.
Publicado: (2024)
EBEN: Extreme bandwidth extension network applied to speech signals captured with noise-resilient body-conduction microphones
por: Hauret, Julien, et al.
Publicado: (2022)
por: Hauret, Julien, et al.
Publicado: (2022)
PROCTER: PROnunciation-aware ConTextual adaptER for personalized speech recognition in neural transducers
por: Pandey, Rahul, et al.
Publicado: (2023)
por: Pandey, Rahul, et al.
Publicado: (2023)
The CHiME-7 UDASE task: Unsupervised domain adaptation for conversational speech enhancement
por: Leglaive, Simon, et al.
Publicado: (2023)
por: Leglaive, Simon, et al.
Publicado: (2023)
CTC-TTS: LLM-based dual-streaming text-to-speech with CTC alignment
por: Liu, Hanwen, et al.
Publicado: (2026)
por: Liu, Hanwen, et al.
Publicado: (2026)
Speech Self-Supervised Representations Benchmarking: a Case for Larger Probing Heads
por: Zaiem, Salah, et al.
Publicado: (2023)
por: Zaiem, Salah, et al.
Publicado: (2023)
DualSep: A Light-weight dual-encoder convolutional recurrent network for real-time in-car speech separation
por: Wang, Ziqian, et al.
Publicado: (2024)
por: Wang, Ziqian, et al.
Publicado: (2024)
Déréverbération non-supervisée de la parole par modèle hybride
por: Bahrman, Louis, et al.
Publicado: (2025)
por: Bahrman, Louis, et al.
Publicado: (2025)
Blind estimation of audio effects using an auto-encoder approach and differentiable digital signal processing
por: Peladeau, Côme, et al.
Publicado: (2023)
por: Peladeau, Côme, et al.
Publicado: (2023)
An automatic mixing speech enhancement system for multi-track audio
por: Liu, Xiaojing, et al.
Publicado: (2024)
por: Liu, Xiaojing, et al.
Publicado: (2024)
A two-step approach for speech enhancement in low-SNR scenarios using cyclostationary beamforming and DNNs
por: Bologni, Giovanni, et al.
Publicado: (2026)
por: Bologni, Giovanni, et al.
Publicado: (2026)
Omni-directional attention mechanism based on Mamba for speech separation
por: Xue, Ke, et al.
Publicado: (2026)
por: Xue, Ke, et al.
Publicado: (2026)
Real-time multichannel deep speech enhancement in hearing aids: Comparing monaural and binaural processing in complex acoustic scenarios
por: Westhausen, Nils L., et al.
Publicado: (2024)
por: Westhausen, Nils L., et al.
Publicado: (2024)
Ejemplares similares
-
Contrastive Knowledge Distillation for Embedding Refinement in Personalized Speech Enhancement
por: Serre, Thomas, et al.
Publicado: (2026) -
Online speaker diarization of meetings guided by speech separation
por: Gruttadauria, Elio, et al.
Publicado: (2024) -
A Contrastive Self-Supervised Learning scheme for beat tracking amenable to few-shot learning
por: Gagnere, Antonin, et al.
Publicado: (2024) -
Controlling Contrastive Self-Supervised Learning with Knowledge-Driven Multiple Hypothesis: Application to Beat Tracking
por: Gagnere, Antonin, et al.
Publicado: (2025) -
Less Forgetting for Better Generalization: Exploring Continual-learning Fine-tuning Methods for Speech Self-supervised Representations
por: Zaiem, Salah, et al.
Publicado: (2024)