Cross-Learning Fine-Tuning Strategy for Dysarthric Speech Recognition Via CDSD database
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiao, Qing, Peng, Yingshan, Zhang, PeiPei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Robust Cross-Etiology and Speaker-Independent Dysarthric Speech Recognition
par: Singh, Satwinder, et autres
Publié: (2025)
par: Singh, Satwinder, et autres
Publié: (2025)
Speech Recognition-based Feature Extraction for Enhanced Automatic Severity Classification in Dysarthric Speech
par: Choi, Yerin, et autres
Publié: (2024)
par: Choi, Yerin, et autres
Publié: (2024)
Self-supervised ASR Models and Features For Dysarthric and Elderly Speech Recognition
par: Hu, Shujie, et autres
Publié: (2024)
par: Hu, Shujie, et autres
Publié: (2024)
Regularized Federated Learning for Privacy-Preserving Dysarthric and Elderly Speech Recognition
par: Zhong, Tao, et autres
Publié: (2025)
par: Zhong, Tao, et autres
Publié: (2025)
Bridging ASR and LLMs for Dysarthric Speech Recognition: Benchmarking Self-Supervised and Generative Approaches
par: Aboeitta, Ahmed, et autres
Publié: (2025)
par: Aboeitta, Ahmed, et autres
Publié: (2025)
Persian Speech Emotion Recognition by Fine-Tuning Transformers
par: Shayaninasab, Minoo, et autres
Publié: (2024)
par: Shayaninasab, Minoo, et autres
Publié: (2024)
Improved Intelligibility of Dysarthric Speech using Conditional Flow Matching
par: Das, Shoutrik, et autres
Publié: (2025)
par: Das, Shoutrik, et autres
Publié: (2025)
Speech-FT: Merging Pre-trained And Fine-Tuned Speech Representation Models For Cross-Task Generalization
par: Lin, Tzu-Quan, et autres
Publié: (2025)
par: Lin, Tzu-Quan, et autres
Publié: (2025)
Voice Cloning for Dysarthric Speech Synthesis: Addressing Data Scarcity in Speech-Language Pathology
par: Moell, Birger, et autres
Publié: (2025)
par: Moell, Birger, et autres
Publié: (2025)
CDSD: Chinese Dysarthria Speech Database
par: Wang, Yan, et autres
Publié: (2023)
par: Wang, Yan, et autres
Publié: (2023)
PTS-SNN: A Prompt-Tuned Temporal Shift Spiking Neural Networks for Efficient Speech Emotion Recognition
par: Su, Xun, et autres
Publié: (2026)
par: Su, Xun, et autres
Publié: (2026)
MF-Speech: Achieving Fine-Grained and Compositional Control in Speech Generation via Factor Disentanglement
par: Yu, Xinyue, et autres
Publié: (2025)
par: Yu, Xinyue, et autres
Publié: (2025)
Unsupervised Rhythm and Voice Conversion to Improve ASR on Dysarthric Speech
par: Hajal, Karl El, et autres
Publié: (2025)
par: Hajal, Karl El, et autres
Publié: (2025)
Unsupervised Rhythm and Voice Conversion of Dysarthric to Healthy Speech for ASR
par: Hajal, Karl El, et autres
Publié: (2025)
par: Hajal, Karl El, et autres
Publié: (2025)
Personalized Fine-Tuning with Controllable Synthetic Speech from LLM-Generated Transcripts for Dysarthric Speech Recognition
par: Wagner, Dominik, et autres
Publié: (2025)
par: Wagner, Dominik, et autres
Publié: (2025)
RAS: a Reliability Oriented Metric for Automatic Speech Recognition
par: Huang, Wenbin, et autres
Publié: (2026)
par: Huang, Wenbin, et autres
Publié: (2026)
Bangla-WhisperDiar: Fine-Tuning Whisper and PyAnnote for Bangla Long-Form Speech Recognition and Speaker Diarization
par: Bhuiyan, Mohammed Aman, et autres
Publié: (2026)
par: Bhuiyan, Mohammed Aman, et autres
Publié: (2026)
Multistage Fine-tuning Strategies for Automatic Speech Recognition in Low-resource Languages
par: Pillai, Leena G, et autres
Publié: (2024)
par: Pillai, Leena G, et autres
Publié: (2024)
Fine-Tuning Text-to-Speech Diffusion Models Using Reinforcement Learning with Human Feedback
par: Chen, Jingyi, et autres
Publié: (2025)
par: Chen, Jingyi, et autres
Publié: (2025)
MFHCA: Enhancing Speech Emotion Recognition Via Multi-Spatial Fusion and Hierarchical Cooperative Attention
par: Jiao, Xinxin, et autres
Publié: (2024)
par: Jiao, Xinxin, et autres
Publié: (2024)
ROSE: A Recognition-Oriented Speech Enhancement Framework in Air Traffic Control Using Multi-Objective Learning
par: Yu, Xincheng, et autres
Publié: (2023)
par: Yu, Xincheng, et autres
Publié: (2023)
Enabling Automatic Disordered Speech Recognition: An Impaired Speech Dataset in the Akan Language
par: Wiafe, Isaac, et autres
Publié: (2026)
par: Wiafe, Isaac, et autres
Publié: (2026)
Deep Learning for Speech Emotion Recognition: A CNN Approach Utilizing Mel Spectrograms
par: Penumajji, Niketa
Publié: (2025)
par: Penumajji, Niketa
Publié: (2025)
Jointly Fine-Tuning "BERT-like" Self Supervised Models to Improve Multimodal Speech Emotion Recognition
par: Siriwardhana, Shamane, et autres
Publié: (2020)
par: Siriwardhana, Shamane, et autres
Publié: (2020)
StyleSpeech: Parameter-efficient Fine Tuning for Pre-trained Controllable Text-to-Speech
par: Lou, Haowei, et autres
Publié: (2024)
par: Lou, Haowei, et autres
Publié: (2024)
Speech Emotion Recognition via Entropy-Aware Score Selection
par: Chua, ChenYi, et autres
Publié: (2025)
par: Chua, ChenYi, et autres
Publié: (2025)
Training Data Augmentation for Dysarthric Automatic Speech Recognition by Text-to-Dysarthric-Speech Synthesis
par: Leung, Wing-Zin, et autres
Publié: (2024)
par: Leung, Wing-Zin, et autres
Publié: (2024)
Adapting Whisper for Parameter-efficient Code-Switching Speech Recognition via Soft Prompt Tuning
par: Yang, Hongli, et autres
Publié: (2025)
par: Yang, Hongli, et autres
Publié: (2025)
MERaLiON-SER: Robust Speech Emotion Recognition Model for English and SEA Languages
par: Sailor, Hardik B., et autres
Publié: (2025)
par: Sailor, Hardik B., et autres
Publié: (2025)
HNote: Extending YNote with Hexadecimal Encoding for Fine-Tuning LLMs in Music Modeling
par: Chu, Hung-Ying, et autres
Publié: (2025)
par: Chu, Hung-Ying, et autres
Publié: (2025)
SloPal: A 60-Million-Word Slovak Parliamentary Corpus with Aligned Speech and Fine-Tuned ASR Models
par: Božík, Erik, et autres
Publié: (2025)
par: Božík, Erik, et autres
Publié: (2025)
Learning Physiology-Informed Vocal Spectrotemporal Representations for Speech Emotion Recognition
par: Zhang, Xu, et autres
Publié: (2026)
par: Zhang, Xu, et autres
Publié: (2026)
GSRM: Generative Speech Reward Model for Speech RLHF
par: Shen, Maohao, et autres
Publié: (2026)
par: Shen, Maohao, et autres
Publié: (2026)
Evolution Strategy-Based Calibration for Low-Bit Quantization of Speech Models
par: Rakotoarivony, Lucas
Publié: (2026)
par: Rakotoarivony, Lucas
Publié: (2026)
VQ-CTAP: Cross-Modal Fine-Grained Sequence Representation Learning for Speech Processing
par: Qiang, Chunyu, et autres
Publié: (2024)
par: Qiang, Chunyu, et autres
Publié: (2024)
Unifying EEG and Speech for Emotion Recognition: A Two-Step Joint Learning Framework for Handling Missing EEG Data During Inference
par: Tiwari, Upasana, et autres
Publié: (2025)
par: Tiwari, Upasana, et autres
Publié: (2025)
Active Learning with Task Adaptation Pre-training for Speech Emotion Recognition
par: Li, Dongyuan, et autres
Publié: (2024)
par: Li, Dongyuan, et autres
Publié: (2024)
Clustering and Mining Accented Speech for Inclusive and Fair Speech Recognition
par: Kim, Jaeyoung, et autres
Publié: (2024)
par: Kim, Jaeyoung, et autres
Publié: (2024)
EMO-TTA: Improving Test-Time Adaptation of Audio-Language Models for Speech Emotion Recognition
par: Shi, Jiacheng, et autres
Publié: (2025)
par: Shi, Jiacheng, et autres
Publié: (2025)
Chord Recognition with Deep Learning
par: Mackenzie, Pierre
Publié: (2025)
par: Mackenzie, Pierre
Publié: (2025)
Documents similaires
-
Robust Cross-Etiology and Speaker-Independent Dysarthric Speech Recognition
par: Singh, Satwinder, et autres
Publié: (2025) -
Speech Recognition-based Feature Extraction for Enhanced Automatic Severity Classification in Dysarthric Speech
par: Choi, Yerin, et autres
Publié: (2024) -
Self-supervised ASR Models and Features For Dysarthric and Elderly Speech Recognition
par: Hu, Shujie, et autres
Publié: (2024) -
Regularized Federated Learning for Privacy-Preserving Dysarthric and Elderly Speech Recognition
par: Zhong, Tao, et autres
Publié: (2025) -
Bridging ASR and LLMs for Dysarthric Speech Recognition: Benchmarking Self-Supervised and Generative Approaches
par: Aboeitta, Ahmed, et autres
Publié: (2025)