Bridging the Perceptual-Statistical Gap in Dysarthria Assessment: Why Machine Learning Still Falls Short
Fuente:
arXiv
Salvato in:
| Autore principale: | Gurugubelli, Krishna |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Multi-modal Approach to Dysarthria Detection and Severity Assessment Using Speech and Text Information
di: M, Anuprabha, et al.
Pubblicazione: (2024)
di: M, Anuprabha, et al.
Pubblicazione: (2024)
Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings
di: Wisnu, Dyah A. M. G., et al.
Pubblicazione: (2025)
di: Wisnu, Dyah A. M. G., et al.
Pubblicazione: (2025)
Dysarthria Normalization via Local Lie Group Transformations for Robust ASR
di: Osipov, Mikhail
Pubblicazione: (2025)
di: Osipov, Mikhail
Pubblicazione: (2025)
Automatic Assessment of Dysarthria Using Audio-visual Vowel Graph Attention Network
di: Liu, Xiaokang, et al.
Pubblicazione: (2024)
di: Liu, Xiaokang, et al.
Pubblicazione: (2024)
Fairness in Dysarthric Speech Synthesis: Understanding Intrinsic Bias in Dysarthric Speech Cloning using F5-TTS
di: Anuprabha, M, et al.
Pubblicazione: (2025)
di: Anuprabha, M, et al.
Pubblicazione: (2025)
Bridging the Perception Gap: A Lightweight Coarse-to-Fine Architecture for Edge Audio Systems
di: Zhang, Hengfan, et al.
Pubblicazione: (2026)
di: Zhang, Hengfan, et al.
Pubblicazione: (2026)
JSQA: Speech Quality Assessment with Perceptually-Inspired Contrastive Pretraining Based on JND Audio Pairs
di: Fan, Junyi, et al.
Pubblicazione: (2025)
di: Fan, Junyi, et al.
Pubblicazione: (2025)
SoundMorpher: Perceptually-Uniform Sound Morphing with Diffusion Model
di: Niu, Xinlei, et al.
Pubblicazione: (2024)
di: Niu, Xinlei, et al.
Pubblicazione: (2024)
Acoustic and Machine Learning Methods for Speech-Based Suicide Risk Assessment: A Systematic Review
di: Marie, Ambre, et al.
Pubblicazione: (2025)
di: Marie, Ambre, et al.
Pubblicazione: (2025)
Bridging The Multi-Modality Gaps of Audio, Visual and Linguistic for Speech Enhancement
di: Lin, Meng-Ping, et al.
Pubblicazione: (2025)
di: Lin, Meng-Ping, et al.
Pubblicazione: (2025)
CDSD: Chinese Dysarthria Speech Database
di: Wang, Yan, et al.
Pubblicazione: (2023)
di: Wang, Yan, et al.
Pubblicazione: (2023)
Perceptual implications of automatic anonymization in pathological speech
di: Arasteh, Soroosh Tayebi, et al.
Pubblicazione: (2025)
di: Arasteh, Soroosh Tayebi, et al.
Pubblicazione: (2025)
Aligning Generative Speech Enhancement with Perceptual Feedback
di: Li, Haoyang, et al.
Pubblicazione: (2025)
di: Li, Haoyang, et al.
Pubblicazione: (2025)
SA-SSL-MOS: Self-supervised Learning MOS Prediction with Spectral Augmentation for Generalized Multi-Rate Speech Assessment
di: Cao, Fengyuan, et al.
Pubblicazione: (2026)
di: Cao, Fengyuan, et al.
Pubblicazione: (2026)
Multimodal Dataset Normalization and Perceptual Validation for Music-Taste Correspondences
di: Spanio, Matteo, et al.
Pubblicazione: (2026)
di: Spanio, Matteo, et al.
Pubblicazione: (2026)
SCRAPL: Scattering Transform with Random Paths for Machine Learning
di: Mitcheltree, Christopher, et al.
Pubblicazione: (2026)
di: Mitcheltree, Christopher, et al.
Pubblicazione: (2026)
Comparison of Tiny Machine Learning Techniques for Embedded Acoustic Emission Analysis
di: Muthumala, Uditha, et al.
Pubblicazione: (2024)
di: Muthumala, Uditha, et al.
Pubblicazione: (2024)
Similarity-Guided Diffusion for Long-Gap Music Inpainting
di: Turland, Sean, et al.
Pubblicazione: (2025)
di: Turland, Sean, et al.
Pubblicazione: (2025)
Voice Signal Processing for Machine Learning. The Case of Speaker Isolation
di: Ganchev, Radan
Pubblicazione: (2024)
di: Ganchev, Radan
Pubblicazione: (2024)
I Guess That's Why They Call it the Blues: Causal Analysis for Audio Classifiers
di: Kelly, David A., et al.
Pubblicazione: (2026)
di: Kelly, David A., et al.
Pubblicazione: (2026)
Enhancing Lung Disease Diagnosis via Semi-Supervised Machine Learning
di: Xu, Xiaoran, et al.
Pubblicazione: (2025)
di: Xu, Xiaoran, et al.
Pubblicazione: (2025)
Multi-Task Pseudo-Label Learning for Non-Intrusive Speech Quality Assessment Model
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2023)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2023)
Machine Learning Approaches to Vocal Register Classification in Contemporary Male Pop Music
di: Kim, Alexander, et al.
Pubblicazione: (2025)
di: Kim, Alexander, et al.
Pubblicazione: (2025)
Active Restoration of Lost Audio Signals Using Machine Learning and Latent Information
di: Cheddad, Zohra Adila, et al.
Pubblicazione: (2021)
di: Cheddad, Zohra Adila, et al.
Pubblicazione: (2021)
A2SB: Audio-to-Audio Schrodinger Bridges
di: Kong, Zhifeng, et al.
Pubblicazione: (2025)
di: Kong, Zhifeng, et al.
Pubblicazione: (2025)
WhiSQA: Non-Intrusive Speech Quality Prediction Using Whisper Encoder Features
di: Close, George, et al.
Pubblicazione: (2025)
di: Close, George, et al.
Pubblicazione: (2025)
A Closer Look at Neural Codec Resynthesis: Bridging the Gap between Codec and Waveform Generation
di: Liu, Alexander H., et al.
Pubblicazione: (2024)
di: Liu, Alexander H., et al.
Pubblicazione: (2024)
Toward Robust Real-World Audio Deepfake Detection: Closing the Explainability Gap
di: Channing, Georgia, et al.
Pubblicazione: (2024)
di: Channing, Georgia, et al.
Pubblicazione: (2024)
Schrodinger Bridges Beat Diffusion Models on Text-to-Speech Synthesis
di: Chen, Zehua, et al.
Pubblicazione: (2023)
di: Chen, Zehua, et al.
Pubblicazione: (2023)
Gaussian Flow Bridges for Audio Domain Transfer with Unpaired Data
di: Moliner, Eloi, et al.
Pubblicazione: (2024)
di: Moliner, Eloi, et al.
Pubblicazione: (2024)
Deep Learning-based Non-Intrusive Multi-Objective Speech Assessment Model with Cross-Domain Features
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2021)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2021)
An Attention Long Short-Term Memory based system for automatic classification of speech intelligibility
di: Fernández-Díaz, Miguel, et al.
Pubblicazione: (2024)
di: Fernández-Díaz, Miguel, et al.
Pubblicazione: (2024)
Rethinking Non-Negative Matrix Factorization with Implicit Neural Representations
di: Subramani, Krishna, et al.
Pubblicazione: (2024)
di: Subramani, Krishna, et al.
Pubblicazione: (2024)
Detecting Throat Cancer from Speech Signals using Machine Learning: A Scoping Literature Review
di: Paterson, Mary, et al.
Pubblicazione: (2023)
di: Paterson, Mary, et al.
Pubblicazione: (2023)
Classification of Short Segment Pediatric Heart Sounds Based on a Transformer-Based Convolutional Neural Network
di: Hassanuzzaman, Md, et al.
Pubblicazione: (2024)
di: Hassanuzzaman, Md, et al.
Pubblicazione: (2024)
Voice-Driven Mortality Prediction in Hospitalized Heart Failure Patients: A Machine Learning Approach Enhanced with Diagnostic Biomarkers
di: Ahmadli, Nihat, et al.
Pubblicazione: (2024)
di: Ahmadli, Nihat, et al.
Pubblicazione: (2024)
Acoustic-to-articulatory inversion for dysarthric speech: Are pre-trained self-supervised representations favorable?
di: Maharana, Sarthak Kumar, et al.
Pubblicazione: (2023)
di: Maharana, Sarthak Kumar, et al.
Pubblicazione: (2023)
BenSParX: A Robust Explainable Machine Learning Framework for Parkinson's Disease Detection from Bengali Conversational Speech
di: Hossain, Riad, et al.
Pubblicazione: (2025)
di: Hossain, Riad, et al.
Pubblicazione: (2025)
A Data-Centric Framework for Machine Listening Projects: Addressing Large-Scale Data Acquisition and Labeling through Active Learning
di: Naranjo-Alcazar, Javier, et al.
Pubblicazione: (2024)
di: Naranjo-Alcazar, Javier, et al.
Pubblicazione: (2024)
Speech Understanding on Tiny Devices with A Learning Cache
di: Benazir, Afsara, et al.
Pubblicazione: (2023)
di: Benazir, Afsara, et al.
Pubblicazione: (2023)
Documenti analoghi
-
A Multi-modal Approach to Dysarthria Detection and Severity Assessment Using Speech and Text Information
di: M, Anuprabha, et al.
Pubblicazione: (2024) -
Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings
di: Wisnu, Dyah A. M. G., et al.
Pubblicazione: (2025) -
Dysarthria Normalization via Local Lie Group Transformations for Robust ASR
di: Osipov, Mikhail
Pubblicazione: (2025) -
Automatic Assessment of Dysarthria Using Audio-visual Vowel Graph Attention Network
di: Liu, Xiaokang, et al.
Pubblicazione: (2024) -
Fairness in Dysarthric Speech Synthesis: Understanding Intrinsic Bias in Dysarthric Speech Cloning using F5-TTS
di: Anuprabha, M, et al.
Pubblicazione: (2025)