Enregistré dans:
| Auteurs principaux: | Joubaud, Thomas, Hauret, Julien, Zimpfer, Véronique, Bavu, Éric |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2506.04495 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EBEN: Extreme bandwidth extension network applied to speech signals captured with noise-resilient body-conduction microphones
par: Hauret, Julien, et autres
Publié: (2022)
par: Hauret, Julien, et autres
Publié: (2022)
Configurable EBEN: Extreme Bandwidth Extension Network to enhance body-conducted speech capture
par: Hauret, Julien, et autres
Publié: (2023)
par: Hauret, Julien, et autres
Publié: (2023)
Vibravox: A Dataset of French Speech Captured with Body-conduction Audio Sensors
par: Hauret, Julien, et autres
Publié: (2024)
par: Hauret, Julien, et autres
Publié: (2024)
Real-time speech enhancement in noise for throat microphone using neural audio codec as foundation model
par: Hauret, Julien, et autres
Publié: (2025)
par: Hauret, Julien, et autres
Publié: (2025)
Bringing Interpretability to Neural Audio Codecs
par: Sadok, Samir, et autres
Publié: (2025)
par: Sadok, Samir, et autres
Publié: (2025)
Evaluating Speech Enhancement Systems Through Listening Effort
par: Gelderblom, Femke B., et autres
Publié: (2024)
par: Gelderblom, Femke B., et autres
Publié: (2024)
Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition
par: Hu, Cheng-Hung, et autres
Publié: (2025)
par: Hu, Cheng-Hung, et autres
Publié: (2025)
Tracking Listener Attention: Gaze-Guided Audio-Visual Speech Enhancement Framework
par: Yang, Hsiang-Cheng, et autres
Publié: (2026)
par: Yang, Hsiang-Cheng, et autres
Publié: (2026)
Assessing the Impact of Noise and Speech Enhancement on the Intelligibility of Speech Codecs
par: Behringer, Lyonel, et autres
Publié: (2026)
par: Behringer, Lyonel, et autres
Publié: (2026)
Improving Speech Enhancement with Multi-Metric Supervision from Learned Quality Assessment
par: Wang, Wei, et autres
Publié: (2025)
par: Wang, Wei, et autres
Publié: (2025)
spINAch: A Diachronic Corpus of French Broadcast Speech Controlled for Speakers' Age and Gender
par: Devauchelle, Simon, et autres
Publié: (2026)
par: Devauchelle, Simon, et autres
Publié: (2026)
Multivariate Probabilistic Assessment of Speech Quality
par: Cumlin, Fredrik, et autres
Publié: (2025)
par: Cumlin, Fredrik, et autres
Publié: (2025)
Non-Intrusive Binaural Speech Intelligibility Prediction Using Mamba for Hearing-Impaired Listeners
par: Yamamoto, Katsuhiko, et autres
Publié: (2025)
par: Yamamoto, Katsuhiko, et autres
Publié: (2025)
Evaluation of an ITD-to-ILD Transformation as a Method to Restore the Spatial Benefit in Speech Intelligibility in Hearing Impaired Listeners
par: Bäumer, Timm-Jonas, et autres
Publié: (2025)
par: Bäumer, Timm-Jonas, et autres
Publié: (2025)
Test-Time Adaptation For Speech Enhancement Via Mask Polarization
par: Raichle, Tobias, et autres
Publié: (2026)
par: Raichle, Tobias, et autres
Publié: (2026)
NOMAD: Unsupervised Learning of Perceptual Embeddings for Speech Enhancement and Non-matching Reference Audio Quality Assessment
par: Ragano, Alessandro, et autres
Publié: (2023)
par: Ragano, Alessandro, et autres
Publié: (2023)
StuPASE: Towards Low-Hallucination Studio-Quality Generative Speech Enhancement
par: Rong, Xiaobin, et autres
Publié: (2026)
par: Rong, Xiaobin, et autres
Publié: (2026)
Contrastive Knowledge Distillation for Embedding Refinement in Personalized Speech Enhancement
par: Serre, Thomas, et autres
Publié: (2026)
par: Serre, Thomas, et autres
Publié: (2026)
Test-Time Adaptation for Speech Enhancement via Domain Invariant Embedding Transformation
par: Raichle, Tobias, et autres
Publié: (2025)
par: Raichle, Tobias, et autres
Publié: (2025)
Leveraging LLMs for Scalable Non-intrusive Speech Quality Assessment
par: Cumlin, Fredrik, et autres
Publié: (2025)
par: Cumlin, Fredrik, et autres
Publié: (2025)
Electrolaryngeal Speech Intelligibility Enhancement Through Robust Linguistic Encoders
par: Violeta, Lester Phillip, et autres
Publié: (2023)
par: Violeta, Lester Phillip, et autres
Publié: (2023)
Listen First, Then Answer: Timestamp-Grounded Speech Reasoning
par: Jeong, Jihoon, et autres
Publié: (2026)
par: Jeong, Jihoon, et autres
Publié: (2026)
Complex Recurrent Variational Autoencoder with Application to Speech Enhancement
par: Xie, Yuying, et autres
Publié: (2022)
par: Xie, Yuying, et autres
Publié: (2022)
Joint Minimum Processing Beamforming and Near-end Listening Enhancement
par: Fuglsig, Andreas J., et autres
Publié: (2023)
par: Fuglsig, Andreas J., et autres
Publié: (2023)
SCOREQ: Speech Quality Assessment with Contrastive Regression
par: Ragano, Alessandro, et autres
Publié: (2024)
par: Ragano, Alessandro, et autres
Publié: (2024)
A Phoneme-Scale Assessment of Multichannel Speech Enhancement Algorithms
par: Monir, Nasser-Eddine, et autres
Publié: (2024)
par: Monir, Nasser-Eddine, et autres
Publié: (2024)
P.808 Multilingual Speech Enhancement Testing: Approach and Results of URGENT 2025 Challenge
par: Sach, Marvin, et autres
Publié: (2025)
par: Sach, Marvin, et autres
Publié: (2025)
Binaural Speech Enhancement Using Deep Complex Convolutional Transformer Networks
par: Tokala, Vikas, et autres
Publié: (2024)
par: Tokala, Vikas, et autres
Publié: (2024)
Mel-FullSubNet: Mel-Spectrogram Enhancement for Improving Both Speech Quality and ASR
par: Zhou, Rui, et autres
Publié: (2024)
par: Zhou, Rui, et autres
Publié: (2024)
Direction-Preserving MIMO Speech Enhancement Using a Neural Covariance Estimator
par: Deppisch, Thomas
Publié: (2026)
par: Deppisch, Thomas
Publié: (2026)
FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching
par: Wang, Ziqian, et autres
Publié: (2025)
par: Wang, Ziqian, et autres
Publié: (2025)
Influence of Clean Speech Characteristics on Speech Enhancement Performance
par: Hou, Mingchi, et autres
Publié: (2025)
par: Hou, Mingchi, et autres
Publié: (2025)
Self-Supervised Speech Quality Assessment (S3QA): Leveraging Speech Foundation Models for a Scalable Speech Quality Metric
par: Ogg, Mattson, et autres
Publié: (2025)
par: Ogg, Mattson, et autres
Publié: (2025)
Towards General Auditory Intelligence: Large Multimodal Models for Machine Listening and Speaking
par: Wang, Siyin, et autres
Publié: (2025)
par: Wang, Siyin, et autres
Publié: (2025)
HighRateMOS: Sampling-Rate Aware Modeling for Speech Quality Assessment
par: Ren, Wenze, et autres
Publié: (2025)
par: Ren, Wenze, et autres
Publié: (2025)
A Pre-training Framework that Encodes Noise Information for Speech Quality Assessment
par: Sultana, Subrina, et autres
Publié: (2024)
par: Sultana, Subrina, et autres
Publié: (2024)
Benchmarking Large Pretrained Multilingual Models on Québec French Speech Recognition
par: Serrand, Coralie, et autres
Publié: (2025)
par: Serrand, Coralie, et autres
Publié: (2025)
Speech Quality-Based Localization of Low-Quality Speech and Text-to-Speech Synthesis Artefacts
par: Kuhlmann, Michael, et autres
Publié: (2026)
par: Kuhlmann, Michael, et autres
Publié: (2026)
Binaural Speech Enhancement Using Complex Convolutional Recurrent Networks
par: Tokala, Vikas, et autres
Publié: (2025)
par: Tokala, Vikas, et autres
Publié: (2025)
A Semi-spontaneous Dutch Speech Dataset for Speech Enhancement and Speech Recognition
par: de Groot, Dimme, et autres
Publié: (2026)
par: de Groot, Dimme, et autres
Publié: (2026)
Documents similaires
-
EBEN: Extreme bandwidth extension network applied to speech signals captured with noise-resilient body-conduction microphones
par: Hauret, Julien, et autres
Publié: (2022) -
Configurable EBEN: Extreme Bandwidth Extension Network to enhance body-conducted speech capture
par: Hauret, Julien, et autres
Publié: (2023) -
Vibravox: A Dataset of French Speech Captured with Body-conduction Audio Sensors
par: Hauret, Julien, et autres
Publié: (2024) -
Real-time speech enhancement in noise for throat microphone using neural audio codec as foundation model
par: Hauret, Julien, et autres
Publié: (2025) -
Bringing Interpretability to Neural Audio Codecs
par: Sadok, Samir, et autres
Publié: (2025)