Guardado en:
| Autores principales: | Joubaud, Thomas, Hauret, Julien, Zimpfer, Véronique, Bavu, Éric |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2506.04495 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EBEN: Extreme bandwidth extension network applied to speech signals captured with noise-resilient body-conduction microphones
por: Hauret, Julien, et al.
Publicado: (2022)
por: Hauret, Julien, et al.
Publicado: (2022)
Configurable EBEN: Extreme Bandwidth Extension Network to enhance body-conducted speech capture
por: Hauret, Julien, et al.
Publicado: (2023)
por: Hauret, Julien, et al.
Publicado: (2023)
Vibravox: A Dataset of French Speech Captured with Body-conduction Audio Sensors
por: Hauret, Julien, et al.
Publicado: (2024)
por: Hauret, Julien, et al.
Publicado: (2024)
Real-time speech enhancement in noise for throat microphone using neural audio codec as foundation model
por: Hauret, Julien, et al.
Publicado: (2025)
por: Hauret, Julien, et al.
Publicado: (2025)
Bringing Interpretability to Neural Audio Codecs
por: Sadok, Samir, et al.
Publicado: (2025)
por: Sadok, Samir, et al.
Publicado: (2025)
Evaluating Speech Enhancement Systems Through Listening Effort
por: Gelderblom, Femke B., et al.
Publicado: (2024)
por: Gelderblom, Femke B., et al.
Publicado: (2024)
Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition
por: Hu, Cheng-Hung, et al.
Publicado: (2025)
por: Hu, Cheng-Hung, et al.
Publicado: (2025)
Tracking Listener Attention: Gaze-Guided Audio-Visual Speech Enhancement Framework
por: Yang, Hsiang-Cheng, et al.
Publicado: (2026)
por: Yang, Hsiang-Cheng, et al.
Publicado: (2026)
Assessing the Impact of Noise and Speech Enhancement on the Intelligibility of Speech Codecs
por: Behringer, Lyonel, et al.
Publicado: (2026)
por: Behringer, Lyonel, et al.
Publicado: (2026)
Improving Speech Enhancement with Multi-Metric Supervision from Learned Quality Assessment
por: Wang, Wei, et al.
Publicado: (2025)
por: Wang, Wei, et al.
Publicado: (2025)
spINAch: A Diachronic Corpus of French Broadcast Speech Controlled for Speakers' Age and Gender
por: Devauchelle, Simon, et al.
Publicado: (2026)
por: Devauchelle, Simon, et al.
Publicado: (2026)
Multivariate Probabilistic Assessment of Speech Quality
por: Cumlin, Fredrik, et al.
Publicado: (2025)
por: Cumlin, Fredrik, et al.
Publicado: (2025)
Non-Intrusive Binaural Speech Intelligibility Prediction Using Mamba for Hearing-Impaired Listeners
por: Yamamoto, Katsuhiko, et al.
Publicado: (2025)
por: Yamamoto, Katsuhiko, et al.
Publicado: (2025)
Evaluation of an ITD-to-ILD Transformation as a Method to Restore the Spatial Benefit in Speech Intelligibility in Hearing Impaired Listeners
por: Bäumer, Timm-Jonas, et al.
Publicado: (2025)
por: Bäumer, Timm-Jonas, et al.
Publicado: (2025)
Test-Time Adaptation For Speech Enhancement Via Mask Polarization
por: Raichle, Tobias, et al.
Publicado: (2026)
por: Raichle, Tobias, et al.
Publicado: (2026)
NOMAD: Unsupervised Learning of Perceptual Embeddings for Speech Enhancement and Non-matching Reference Audio Quality Assessment
por: Ragano, Alessandro, et al.
Publicado: (2023)
por: Ragano, Alessandro, et al.
Publicado: (2023)
StuPASE: Towards Low-Hallucination Studio-Quality Generative Speech Enhancement
por: Rong, Xiaobin, et al.
Publicado: (2026)
por: Rong, Xiaobin, et al.
Publicado: (2026)
Contrastive Knowledge Distillation for Embedding Refinement in Personalized Speech Enhancement
por: Serre, Thomas, et al.
Publicado: (2026)
por: Serre, Thomas, et al.
Publicado: (2026)
Test-Time Adaptation for Speech Enhancement via Domain Invariant Embedding Transformation
por: Raichle, Tobias, et al.
Publicado: (2025)
por: Raichle, Tobias, et al.
Publicado: (2025)
Leveraging LLMs for Scalable Non-intrusive Speech Quality Assessment
por: Cumlin, Fredrik, et al.
Publicado: (2025)
por: Cumlin, Fredrik, et al.
Publicado: (2025)
Electrolaryngeal Speech Intelligibility Enhancement Through Robust Linguistic Encoders
por: Violeta, Lester Phillip, et al.
Publicado: (2023)
por: Violeta, Lester Phillip, et al.
Publicado: (2023)
Listen First, Then Answer: Timestamp-Grounded Speech Reasoning
por: Jeong, Jihoon, et al.
Publicado: (2026)
por: Jeong, Jihoon, et al.
Publicado: (2026)
Complex Recurrent Variational Autoencoder with Application to Speech Enhancement
por: Xie, Yuying, et al.
Publicado: (2022)
por: Xie, Yuying, et al.
Publicado: (2022)
Joint Minimum Processing Beamforming and Near-end Listening Enhancement
por: Fuglsig, Andreas J., et al.
Publicado: (2023)
por: Fuglsig, Andreas J., et al.
Publicado: (2023)
SCOREQ: Speech Quality Assessment with Contrastive Regression
por: Ragano, Alessandro, et al.
Publicado: (2024)
por: Ragano, Alessandro, et al.
Publicado: (2024)
A Phoneme-Scale Assessment of Multichannel Speech Enhancement Algorithms
por: Monir, Nasser-Eddine, et al.
Publicado: (2024)
por: Monir, Nasser-Eddine, et al.
Publicado: (2024)
P.808 Multilingual Speech Enhancement Testing: Approach and Results of URGENT 2025 Challenge
por: Sach, Marvin, et al.
Publicado: (2025)
por: Sach, Marvin, et al.
Publicado: (2025)
Binaural Speech Enhancement Using Deep Complex Convolutional Transformer Networks
por: Tokala, Vikas, et al.
Publicado: (2024)
por: Tokala, Vikas, et al.
Publicado: (2024)
Mel-FullSubNet: Mel-Spectrogram Enhancement for Improving Both Speech Quality and ASR
por: Zhou, Rui, et al.
Publicado: (2024)
por: Zhou, Rui, et al.
Publicado: (2024)
Direction-Preserving MIMO Speech Enhancement Using a Neural Covariance Estimator
por: Deppisch, Thomas
Publicado: (2026)
por: Deppisch, Thomas
Publicado: (2026)
FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching
por: Wang, Ziqian, et al.
Publicado: (2025)
por: Wang, Ziqian, et al.
Publicado: (2025)
Influence of Clean Speech Characteristics on Speech Enhancement Performance
por: Hou, Mingchi, et al.
Publicado: (2025)
por: Hou, Mingchi, et al.
Publicado: (2025)
Self-Supervised Speech Quality Assessment (S3QA): Leveraging Speech Foundation Models for a Scalable Speech Quality Metric
por: Ogg, Mattson, et al.
Publicado: (2025)
por: Ogg, Mattson, et al.
Publicado: (2025)
Towards General Auditory Intelligence: Large Multimodal Models for Machine Listening and Speaking
por: Wang, Siyin, et al.
Publicado: (2025)
por: Wang, Siyin, et al.
Publicado: (2025)
HighRateMOS: Sampling-Rate Aware Modeling for Speech Quality Assessment
por: Ren, Wenze, et al.
Publicado: (2025)
por: Ren, Wenze, et al.
Publicado: (2025)
A Pre-training Framework that Encodes Noise Information for Speech Quality Assessment
por: Sultana, Subrina, et al.
Publicado: (2024)
por: Sultana, Subrina, et al.
Publicado: (2024)
Benchmarking Large Pretrained Multilingual Models on Québec French Speech Recognition
por: Serrand, Coralie, et al.
Publicado: (2025)
por: Serrand, Coralie, et al.
Publicado: (2025)
Speech Quality-Based Localization of Low-Quality Speech and Text-to-Speech Synthesis Artefacts
por: Kuhlmann, Michael, et al.
Publicado: (2026)
por: Kuhlmann, Michael, et al.
Publicado: (2026)
Binaural Speech Enhancement Using Complex Convolutional Recurrent Networks
por: Tokala, Vikas, et al.
Publicado: (2025)
por: Tokala, Vikas, et al.
Publicado: (2025)
A Semi-spontaneous Dutch Speech Dataset for Speech Enhancement and Speech Recognition
por: de Groot, Dimme, et al.
Publicado: (2026)
por: de Groot, Dimme, et al.
Publicado: (2026)
Ejemplares similares
-
EBEN: Extreme bandwidth extension network applied to speech signals captured with noise-resilient body-conduction microphones
por: Hauret, Julien, et al.
Publicado: (2022) -
Configurable EBEN: Extreme Bandwidth Extension Network to enhance body-conducted speech capture
por: Hauret, Julien, et al.
Publicado: (2023) -
Vibravox: A Dataset of French Speech Captured with Body-conduction Audio Sensors
por: Hauret, Julien, et al.
Publicado: (2024) -
Real-time speech enhancement in noise for throat microphone using neural audio codec as foundation model
por: Hauret, Julien, et al.
Publicado: (2025) -
Bringing Interpretability to Neural Audio Codecs
por: Sadok, Samir, et al.
Publicado: (2025)