Neuro-MSBG: An End-to-End Neural Model for Hearing Loss Simulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yuan, Hui-Guan, Zezario, Ryandhimas E., Ahmed, Shafique, Wang, Hsin-Min, Hua, Kai-Lung, Tsao, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
NeuroAMP: A Novel End-to-end General Purpose Deep Neural Amplifier for Personalized Hearing Aids
par: Ahmed, Shafique, et autres
Publié: (2025)
par: Ahmed, Shafique, et autres
Publié: (2025)
Non-Intrusive Intelligibility Prediction for Hearing Aids: Recent Advances, Trends, and Challenges
par: Zezario, Ryandhimas E.
Publié: (2025)
par: Zezario, Ryandhimas E.
Publié: (2025)
Feature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
A Study on Zero-Shot Non-Intrusive Speech Intelligibility for Hearing Aids Using Large Language Models
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
A Study on Speech Assessment with Visual Cues
par: Ahmed, Shafique, et autres
Publié: (2025)
par: Ahmed, Shafique, et autres
Publié: (2025)
A Study on Zero-shot Non-intrusive Speech Assessment using Large Language Models
par: Zezario, Ryandhimas E., et autres
Publié: (2024)
par: Zezario, Ryandhimas E., et autres
Publié: (2024)
Non-Intrusive Speech Intelligibility Prediction for Hearing Aids using Whisper and Metadata
par: Zezario, Ryandhimas E., et autres
Publié: (2023)
par: Zezario, Ryandhimas E., et autres
Publié: (2023)
HAAQI-Net: A Non-intrusive Neural Music Audio Quality Assessment Model for Hearing Aids
par: Wisnu, Dyah A. M. G., et autres
Publié: (2024)
par: Wisnu, Dyah A. M. G., et autres
Publié: (2024)
Speech Intelligibility Assessment with Uncertainty-Aware Whisper Embeddings and sLSTM
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
A Study on Incorporating Whisper for Robust Speech Assessment
par: Zezario, Ryandhimas E., et autres
Publié: (2023)
par: Zezario, Ryandhimas E., et autres
Publié: (2023)
STSM-FiLM: A FiLM-Conditioned Neural Architecture for Time-Scale Modification of Speech
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
Few-Shot and Pseudo-Label Guided Speech Quality Evaluation with Large Language Models
par: Zezario, Ryandhimas E., et autres
Publié: (2026)
par: Zezario, Ryandhimas E., et autres
Publié: (2026)
Multi-Task Pseudo-Label Learning for Non-Intrusive Speech Quality Assessment Model
par: Zezario, Ryandhimas E., et autres
Publié: (2023)
par: Zezario, Ryandhimas E., et autres
Publié: (2023)
The VoiceMOS Challenge 2024: Beyond Speech Quality Prediction
par: Huang, Wen-Chin, et autres
Publié: (2024)
par: Huang, Wen-Chin, et autres
Publié: (2024)
Deep Learning-based Non-Intrusive Multi-Objective Speech Assessment Model with Cross-Domain Features
par: Zezario, Ryandhimas E., et autres
Publié: (2021)
par: Zezario, Ryandhimas E., et autres
Publié: (2021)
End-to-End Multi-Task Learning for Adjustable Joint Noise Reduction and Hearing Loss Compensation
par: Gonzalez, Philippe, et autres
Publié: (2026)
par: Gonzalez, Philippe, et autres
Publié: (2026)
Towards Environmental Preference Based Speech Enhancement For Individualised Multi-Modal Hearing Aids
par: Kirton-Wingate, Jasper, et autres
Publié: (2024)
par: Kirton-Wingate, Jasper, et autres
Publié: (2024)
WMCodec: End-to-End Neural Speech Codec with Deep Watermarking for Authenticity Verification
par: Zhou, Junzuo, et autres
Publié: (2024)
par: Zhou, Junzuo, et autres
Publié: (2024)
DiaPer: End-to-End Neural Diarization with Perceiver-Based Attractors
par: Landini, Federico, et autres
Publié: (2023)
par: Landini, Federico, et autres
Publié: (2023)
Quality-Aware End-to-End Audio-Visual Neural Speaker Diarization
par: He, Mao-Kui, et autres
Publié: (2024)
par: He, Mao-Kui, et autres
Publié: (2024)
Do End-to-End Neural Diarization Attractors Need to Encode Speaker Characteristic Information?
par: Zhang, Lin, et autres
Publié: (2024)
par: Zhang, Lin, et autres
Publié: (2024)
Neural Scoring: A Refreshed End-to-End Approach for Speaker Recognition in Complex Conditions
par: Lin, Wan, et autres
Publié: (2024)
par: Lin, Wan, et autres
Publié: (2024)
LS-EEND: Long-Form Streaming End-to-End Neural Diarization with Online Attractor Extraction
par: Liang, Di, et autres
Publié: (2024)
par: Liang, Di, et autres
Publié: (2024)
Differentiable Time-Varying Linear Prediction in the Context of End-to-End Analysis-by-Synthesis
par: Yu, Chin-Yun, et autres
Publié: (2024)
par: Yu, Chin-Yun, et autres
Publié: (2024)
On Improving Error Resilience of Neural End-to-End Speech Coders
par: Gupta, Kishan, et autres
Publié: (2024)
par: Gupta, Kishan, et autres
Publié: (2024)
End-to-End Diarization utilizing Attractor Deep Clustering
par: Palzer, David, et autres
Publié: (2025)
par: Palzer, David, et autres
Publié: (2025)
Speaker Adaptation for Quantised End-to-End ASR Models
par: Zhao, Qiuming, et autres
Publié: (2024)
par: Zhao, Qiuming, et autres
Publié: (2024)
An Investigation on Speaker Augmentation for End-to-End Speaker Extraction
par: You, Zhenghai, et autres
Publié: (2025)
par: You, Zhenghai, et autres
Publié: (2025)
GESI: Gammachirp Envelope Similarity Index for Predicting Intelligibility of Simulated Hearing Loss Sounds
par: Yamamoto, Ayako, et autres
Publié: (2023)
par: Yamamoto, Ayako, et autres
Publié: (2023)
CosyEdit: Unlocking End-to-End Speech Editing Capability from Zero-Shot Text-to-Speech Models
par: Chen, Junyang, et autres
Publié: (2026)
par: Chen, Junyang, et autres
Publié: (2026)
VISinger2+: End-to-End Singing Voice Synthesis Augmented by Self-Supervised Learning Representation
par: Yu, Yifeng, et autres
Publié: (2024)
par: Yu, Yifeng, et autres
Publié: (2024)
Dissecting the Segmentation Model of End-to-End Diarization with Vector Clustering
par: Plaquet, Alexis, et autres
Publié: (2025)
par: Plaquet, Alexis, et autres
Publié: (2025)
End-to-End Zero-Shot Voice Conversion with Location-Variable Convolutions
par: Kang, Wonjune, et autres
Publié: (2022)
par: Kang, Wonjune, et autres
Publié: (2022)
Speaker-Smoothed kNN Speaker Adaptation for End-to-End ASR
par: Li, Shaojun, et autres
Publié: (2024)
par: Li, Shaojun, et autres
Publié: (2024)
End-to-end audio-visual learning for cochlear implant sound coding simulations in noisy environments
par: Lin, Meng-Ping, et autres
Publié: (2025)
par: Lin, Meng-Ping, et autres
Publié: (2025)
Continual Test-time Adaptation for End-to-end Speech Recognition on Noisy Speech
par: Lin, Guan-Ting, et autres
Publié: (2024)
par: Lin, Guan-Ting, et autres
Publié: (2024)
Central Kurdish Text-to-Speech Synthesis with Novel End-to-End Transformer Training
par: Ahmad, Hawraz A., et autres
Publié: (2024)
par: Ahmad, Hawraz A., et autres
Publié: (2024)
End-to-End Amp Modeling: From Data to Controllable Guitar Amplifier Models
par: Juvela, Lauri, et autres
Publié: (2024)
par: Juvela, Lauri, et autres
Publié: (2024)
Diff-SAGe: End-to-End Spatial Audio Generation Using Diffusion Models
par: Kushwaha, Saksham Singh, et autres
Publié: (2024)
par: Kushwaha, Saksham Singh, et autres
Publié: (2024)
Documents similaires
-
NeuroAMP: A Novel End-to-end General Purpose Deep Neural Amplifier for Personalized Hearing Aids
par: Ahmed, Shafique, et autres
Publié: (2025) -
Non-Intrusive Intelligibility Prediction for Hearing Aids: Recent Advances, Trends, and Challenges
par: Zezario, Ryandhimas E.
Publié: (2025) -
Feature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids
par: Zezario, Ryandhimas E., et autres
Publié: (2025) -
A Study on Zero-Shot Non-Intrusive Speech Intelligibility for Hearing Aids Using Large Language Models
par: Zezario, Ryandhimas E., et autres
Publié: (2025) -
A Study on Speech Assessment with Visual Cues
par: Ahmed, Shafique, et autres
Publié: (2025)