Non-Intrusive Speech Intelligibility Prediction for Hearing-Impaired Users using Intermediate ASR Features and Human Memory Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mogridge, Rhiannon, Close, George, Sutherland, Robert, Hain, Thomas, Barker, Jon, Goetze, Stefan, Ragni, Anton |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Using Speech Foundational Models in Loss Functions for Hearing Aid Speech Enhancement
par: Sutherland, Robert, et autres
Publié: (2024)
par: Sutherland, Robert, et autres
Publié: (2024)
WhiSQA: Non-Intrusive Speech Quality Prediction Using Whisper Encoder Features
par: Close, George, et autres
Publié: (2025)
par: Close, George, et autres
Publié: (2025)
Hallucination in Perceptual Metric-Driven Speech Enhancement Networks
par: Close, George, et autres
Publié: (2024)
par: Close, George, et autres
Publié: (2024)
Training Data Augmentation for Dysarthric Automatic Speech Recognition by Text-to-Dysarthric-Speech Synthesis
par: Leung, Wing-Zin, et autres
Publié: (2024)
par: Leung, Wing-Zin, et autres
Publié: (2024)
Non-Intrusive Binaural Speech Intelligibility Prediction Using Mamba for Hearing-Impaired Listeners
par: Yamamoto, Katsuhiko, et autres
Publié: (2025)
par: Yamamoto, Katsuhiko, et autres
Publié: (2025)
Transcription-Free Fine-Tuning of Speech Separation Models for Noisy and Reverberant Multi-Speaker Automatic Speech Recognition
par: Ravenscroft, William, et autres
Publié: (2024)
par: Ravenscroft, William, et autres
Publié: (2024)
Leveraging Multiple Speech Enhancers for Non-Intrusive Intelligibility Prediction for Hearing-Impaired Listeners
par: Cao, Boxuan, et autres
Publié: (2025)
par: Cao, Boxuan, et autres
Publié: (2025)
Feature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
Beyond the Utterance: An Empirical Study of Very Long Context Speech Recognition
par: Flynn, Robert, et autres
Publié: (2026)
par: Flynn, Robert, et autres
Publié: (2026)
A Study on Zero-Shot Non-Intrusive Speech Intelligibility for Hearing Aids Using Large Language Models
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
Frame-Aligned Fusion of Canary and WavLM for Non-Intrusive Intelligibility Prediction of Hearing-Aid-Processed Speech
par: Nakazawa, Kazushi
Publié: (2026)
par: Nakazawa, Kazushi
Publié: (2026)
How Much Context Does My Attention-Based ASR System Need?
par: Flynn, Robert, et autres
Publié: (2023)
par: Flynn, Robert, et autres
Publié: (2023)
Non-Intrusive Speech Intelligibility Prediction for Hearing Aids using Whisper and Metadata
par: Zezario, Ryandhimas E., et autres
Publié: (2023)
par: Zezario, Ryandhimas E., et autres
Publié: (2023)
Non-Intrusive Intelligibility Prediction for Hearing Aids: Recent Advances, Trends, and Challenges
par: Zezario, Ryandhimas E.
Publié: (2025)
par: Zezario, Ryandhimas E.
Publié: (2025)
Decoding Order Matters in Autoregressive Speech Synthesis
par: Zhao, Minghui, et autres
Publié: (2026)
par: Zhao, Minghui, et autres
Publié: (2026)
Advancing Hearing Assessment: An ASR-Based Frequency-Specific Speech Test for Diagnosing Presbycusis
par: Bleeck, Stefan
Publié: (2025)
par: Bleeck, Stefan
Publié: (2025)
Unveiling the Best Practices for Applying Speech Foundation Models to Speech Intelligibility Prediction for Hearing-Impaired People
par: Zhou, Haoshuai, et autres
Publié: (2025)
par: Zhou, Haoshuai, et autres
Publié: (2025)
Score-Based Training for Energy-Based TTS Models
par: Sun, Wanli, et autres
Publié: (2025)
par: Sun, Wanli, et autres
Publié: (2025)
Position-invariant Fine-tuning of Speech Enhancement Models with Self-supervised Speech Representations
par: Meghanani, Amit, et autres
Publié: (2026)
par: Meghanani, Amit, et autres
Publié: (2026)
LIWhiz: A Non-Intrusive Lyric Intelligibility Prediction System for the Cadenza Challenge
par: Shekar, Ram C. M. C., et autres
Publié: (2025)
par: Shekar, Ram C. M. C., et autres
Publié: (2025)
Speech Emotion Recognition with ASR Integration
par: Li, Yuanchao
Publié: (2026)
par: Li, Yuanchao
Publié: (2026)
Enhancing Intelligibility for Generative Target Speech Extraction via Joint Optimization with Target Speaker ASR
par: Ma, Hao, et autres
Publié: (2025)
par: Ma, Hao, et autres
Publié: (2025)
Discrete Tokens Exhibit Interlanguage Speech Intelligibility Benefit: an Analytical Study Towards Accent-robust ASR Only with Native Speech Data
par: Onda, Kentaro, et autres
Publié: (2025)
par: Onda, Kentaro, et autres
Publié: (2025)
Face-Voice Association for Audiovisual Active Speaker Detection in Egocentric Recordings
par: Clarke, Jason, et autres
Publié: (2025)
par: Clarke, Jason, et autres
Publié: (2025)
Emphasis Sensitivity in Speech Representations
par: Cassini, Shaun, et autres
Publié: (2025)
par: Cassini, Shaun, et autres
Publié: (2025)
Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition
par: Bai, Ye, et autres
Publié: (2024)
par: Bai, Ye, et autres
Publié: (2024)
Comparative Analysis of ASR Methods for Speech Deepfake Detection
par: Salvi, Davide, et autres
Publié: (2024)
par: Salvi, Davide, et autres
Publié: (2024)
LASER: Learning by Aligning Self-supervised Representations of Speech for Improving Content-related Tasks
par: Meghanani, Amit, et autres
Publié: (2024)
par: Meghanani, Amit, et autres
Publié: (2024)
Improving Acoustic Word Embeddings through Correspondence Training of Self-supervised Speech Representations
par: Meghanani, Amit, et autres
Publié: (2024)
par: Meghanani, Amit, et autres
Publié: (2024)
Deep Learning-based Non-Intrusive Multi-Objective Speech Assessment Model with Cross-Domain Features
par: Zezario, Ryandhimas E., et autres
Publié: (2021)
par: Zezario, Ryandhimas E., et autres
Publié: (2021)
Fine-Tuning ASR for Stuttered Speech: Personalized vs. Generalized Approaches
par: Mujtaba, Dena, et autres
Publié: (2025)
par: Mujtaba, Dena, et autres
Publié: (2025)
Resource-Efficient Adaptation of Speech Foundation Models for Multi-Speaker ASR
par: Wang, Weiqing, et autres
Publié: (2024)
par: Wang, Weiqing, et autres
Publié: (2024)
Exploring SSL Discrete Speech Features for Zipformer-based Contextual ASR
par: Cui, Mingyu, et autres
Publié: (2024)
par: Cui, Mingyu, et autres
Publié: (2024)
Self-supervised ASR Models and Features For Dysarthric and Elderly Speech Recognition
par: Hu, Shujie, et autres
Publié: (2024)
par: Hu, Shujie, et autres
Publié: (2024)
Automatic Speech Recognition System-Independent Word Error Rate Estimation
par: Park, Chanho, et autres
Publié: (2024)
par: Park, Chanho, et autres
Publié: (2024)
Self-Train Before You Transcribe
par: Flynn, Robert, et autres
Publié: (2024)
par: Flynn, Robert, et autres
Publié: (2024)
Developing an AI-Guided Assistant Device for the Deaf and Hearing Impaired
par: Jiayu, et autres
Publié: (2025)
par: Jiayu, et autres
Publié: (2025)
Elevating Robust Multi-Talker ASR by Decoupling Speaker Separation and Speech Recognition
par: Yang, Yufeng, et autres
Publié: (2025)
par: Yang, Yufeng, et autres
Publié: (2025)
BrainWhisperer: Leveraging Large-Scale ASR Models for Neural Speech Decoding
par: Boccato, Tommaso, et autres
Publié: (2026)
par: Boccato, Tommaso, et autres
Publié: (2026)
Multi-Channel Differential ASR for Robust Wearer Speech Recognition on Smart Glasses
par: Yang, Yufeng, et autres
Publié: (2025)
par: Yang, Yufeng, et autres
Publié: (2025)
Documents similaires
-
Using Speech Foundational Models in Loss Functions for Hearing Aid Speech Enhancement
par: Sutherland, Robert, et autres
Publié: (2024) -
WhiSQA: Non-Intrusive Speech Quality Prediction Using Whisper Encoder Features
par: Close, George, et autres
Publié: (2025) -
Hallucination in Perceptual Metric-Driven Speech Enhancement Networks
par: Close, George, et autres
Publié: (2024) -
Training Data Augmentation for Dysarthric Automatic Speech Recognition by Text-to-Dysarthric-Speech Synthesis
par: Leung, Wing-Zin, et autres
Publié: (2024) -
Non-Intrusive Binaural Speech Intelligibility Prediction Using Mamba for Hearing-Impaired Listeners
par: Yamamoto, Katsuhiko, et autres
Publié: (2025)