Bridging the Perceptual-Statistical Gap in Dysarthria Assessment: Why Machine Learning Still Falls Short
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Gurugubelli, Krishna |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Multi-modal Approach to Dysarthria Detection and Severity Assessment Using Speech and Text Information
par: M, Anuprabha, et autres
Publié: (2024)
par: M, Anuprabha, et autres
Publié: (2024)
Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
Dysarthria Normalization via Local Lie Group Transformations for Robust ASR
par: Osipov, Mikhail
Publié: (2025)
par: Osipov, Mikhail
Publié: (2025)
Automatic Assessment of Dysarthria Using Audio-visual Vowel Graph Attention Network
par: Liu, Xiaokang, et autres
Publié: (2024)
par: Liu, Xiaokang, et autres
Publié: (2024)
Fairness in Dysarthric Speech Synthesis: Understanding Intrinsic Bias in Dysarthric Speech Cloning using F5-TTS
par: Anuprabha, M, et autres
Publié: (2025)
par: Anuprabha, M, et autres
Publié: (2025)
Bridging the Perception Gap: A Lightweight Coarse-to-Fine Architecture for Edge Audio Systems
par: Zhang, Hengfan, et autres
Publié: (2026)
par: Zhang, Hengfan, et autres
Publié: (2026)
JSQA: Speech Quality Assessment with Perceptually-Inspired Contrastive Pretraining Based on JND Audio Pairs
par: Fan, Junyi, et autres
Publié: (2025)
par: Fan, Junyi, et autres
Publié: (2025)
SoundMorpher: Perceptually-Uniform Sound Morphing with Diffusion Model
par: Niu, Xinlei, et autres
Publié: (2024)
par: Niu, Xinlei, et autres
Publié: (2024)
Acoustic and Machine Learning Methods for Speech-Based Suicide Risk Assessment: A Systematic Review
par: Marie, Ambre, et autres
Publié: (2025)
par: Marie, Ambre, et autres
Publié: (2025)
Bridging The Multi-Modality Gaps of Audio, Visual and Linguistic for Speech Enhancement
par: Lin, Meng-Ping, et autres
Publié: (2025)
par: Lin, Meng-Ping, et autres
Publié: (2025)
CDSD: Chinese Dysarthria Speech Database
par: Wang, Yan, et autres
Publié: (2023)
par: Wang, Yan, et autres
Publié: (2023)
Perceptual implications of automatic anonymization in pathological speech
par: Arasteh, Soroosh Tayebi, et autres
Publié: (2025)
par: Arasteh, Soroosh Tayebi, et autres
Publié: (2025)
Aligning Generative Speech Enhancement with Perceptual Feedback
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
SA-SSL-MOS: Self-supervised Learning MOS Prediction with Spectral Augmentation for Generalized Multi-Rate Speech Assessment
par: Cao, Fengyuan, et autres
Publié: (2026)
par: Cao, Fengyuan, et autres
Publié: (2026)
Multimodal Dataset Normalization and Perceptual Validation for Music-Taste Correspondences
par: Spanio, Matteo, et autres
Publié: (2026)
par: Spanio, Matteo, et autres
Publié: (2026)
SCRAPL: Scattering Transform with Random Paths for Machine Learning
par: Mitcheltree, Christopher, et autres
Publié: (2026)
par: Mitcheltree, Christopher, et autres
Publié: (2026)
Comparison of Tiny Machine Learning Techniques for Embedded Acoustic Emission Analysis
par: Muthumala, Uditha, et autres
Publié: (2024)
par: Muthumala, Uditha, et autres
Publié: (2024)
Similarity-Guided Diffusion for Long-Gap Music Inpainting
par: Turland, Sean, et autres
Publié: (2025)
par: Turland, Sean, et autres
Publié: (2025)
Voice Signal Processing for Machine Learning. The Case of Speaker Isolation
par: Ganchev, Radan
Publié: (2024)
par: Ganchev, Radan
Publié: (2024)
I Guess That's Why They Call it the Blues: Causal Analysis for Audio Classifiers
par: Kelly, David A., et autres
Publié: (2026)
par: Kelly, David A., et autres
Publié: (2026)
Enhancing Lung Disease Diagnosis via Semi-Supervised Machine Learning
par: Xu, Xiaoran, et autres
Publié: (2025)
par: Xu, Xiaoran, et autres
Publié: (2025)
Multi-Task Pseudo-Label Learning for Non-Intrusive Speech Quality Assessment Model
par: Zezario, Ryandhimas E., et autres
Publié: (2023)
par: Zezario, Ryandhimas E., et autres
Publié: (2023)
Machine Learning Approaches to Vocal Register Classification in Contemporary Male Pop Music
par: Kim, Alexander, et autres
Publié: (2025)
par: Kim, Alexander, et autres
Publié: (2025)
Active Restoration of Lost Audio Signals Using Machine Learning and Latent Information
par: Cheddad, Zohra Adila, et autres
Publié: (2021)
par: Cheddad, Zohra Adila, et autres
Publié: (2021)
A2SB: Audio-to-Audio Schrodinger Bridges
par: Kong, Zhifeng, et autres
Publié: (2025)
par: Kong, Zhifeng, et autres
Publié: (2025)
WhiSQA: Non-Intrusive Speech Quality Prediction Using Whisper Encoder Features
par: Close, George, et autres
Publié: (2025)
par: Close, George, et autres
Publié: (2025)
A Closer Look at Neural Codec Resynthesis: Bridging the Gap between Codec and Waveform Generation
par: Liu, Alexander H., et autres
Publié: (2024)
par: Liu, Alexander H., et autres
Publié: (2024)
Toward Robust Real-World Audio Deepfake Detection: Closing the Explainability Gap
par: Channing, Georgia, et autres
Publié: (2024)
par: Channing, Georgia, et autres
Publié: (2024)
Schrodinger Bridges Beat Diffusion Models on Text-to-Speech Synthesis
par: Chen, Zehua, et autres
Publié: (2023)
par: Chen, Zehua, et autres
Publié: (2023)
Gaussian Flow Bridges for Audio Domain Transfer with Unpaired Data
par: Moliner, Eloi, et autres
Publié: (2024)
par: Moliner, Eloi, et autres
Publié: (2024)
Deep Learning-based Non-Intrusive Multi-Objective Speech Assessment Model with Cross-Domain Features
par: Zezario, Ryandhimas E., et autres
Publié: (2021)
par: Zezario, Ryandhimas E., et autres
Publié: (2021)
An Attention Long Short-Term Memory based system for automatic classification of speech intelligibility
par: Fernández-Díaz, Miguel, et autres
Publié: (2024)
par: Fernández-Díaz, Miguel, et autres
Publié: (2024)
Rethinking Non-Negative Matrix Factorization with Implicit Neural Representations
par: Subramani, Krishna, et autres
Publié: (2024)
par: Subramani, Krishna, et autres
Publié: (2024)
Detecting Throat Cancer from Speech Signals using Machine Learning: A Scoping Literature Review
par: Paterson, Mary, et autres
Publié: (2023)
par: Paterson, Mary, et autres
Publié: (2023)
Classification of Short Segment Pediatric Heart Sounds Based on a Transformer-Based Convolutional Neural Network
par: Hassanuzzaman, Md, et autres
Publié: (2024)
par: Hassanuzzaman, Md, et autres
Publié: (2024)
Voice-Driven Mortality Prediction in Hospitalized Heart Failure Patients: A Machine Learning Approach Enhanced with Diagnostic Biomarkers
par: Ahmadli, Nihat, et autres
Publié: (2024)
par: Ahmadli, Nihat, et autres
Publié: (2024)
Acoustic-to-articulatory inversion for dysarthric speech: Are pre-trained self-supervised representations favorable?
par: Maharana, Sarthak Kumar, et autres
Publié: (2023)
par: Maharana, Sarthak Kumar, et autres
Publié: (2023)
BenSParX: A Robust Explainable Machine Learning Framework for Parkinson's Disease Detection from Bengali Conversational Speech
par: Hossain, Riad, et autres
Publié: (2025)
par: Hossain, Riad, et autres
Publié: (2025)
A Data-Centric Framework for Machine Listening Projects: Addressing Large-Scale Data Acquisition and Labeling through Active Learning
par: Naranjo-Alcazar, Javier, et autres
Publié: (2024)
par: Naranjo-Alcazar, Javier, et autres
Publié: (2024)
Speech Understanding on Tiny Devices with A Learning Cache
par: Benazir, Afsara, et autres
Publié: (2023)
par: Benazir, Afsara, et autres
Publié: (2023)
Documents similaires
-
A Multi-modal Approach to Dysarthria Detection and Severity Assessment Using Speech and Text Information
par: M, Anuprabha, et autres
Publié: (2024) -
Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025) -
Dysarthria Normalization via Local Lie Group Transformations for Robust ASR
par: Osipov, Mikhail
Publié: (2025) -
Automatic Assessment of Dysarthria Using Audio-visual Vowel Graph Attention Network
par: Liu, Xiaokang, et autres
Publié: (2024) -
Fairness in Dysarthric Speech Synthesis: Understanding Intrinsic Bias in Dysarthric Speech Cloning using F5-TTS
par: Anuprabha, M, et autres
Publié: (2025)