Towards Robust Speech Recognition for Jamaican Patois Music Transcription
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Madden, Jordan, Stone, Matthew, Johnson, Dimitri, Geddez, Daniel |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LipGER: Visually-Conditioned Generative Error Correction for Robust Automatic Speech Recognition
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
StutterZero and StutterFormer: End-to-End Speech Conversion for Stuttering Transcription and Correction
par: Xu, Qianheng
Publié: (2025)
par: Xu, Qianheng
Publié: (2025)
Speech Retrieval-Augmented Generation without Automatic Speech Recognition
par: Min, Do June, et autres
Publié: (2024)
par: Min, Do June, et autres
Publié: (2024)
Toward Automated Clinical Transcriptions
par: Klusty, Mitchell A., et autres
Publié: (2024)
par: Klusty, Mitchell A., et autres
Publié: (2024)
Handling Numeric Expressions in Automatic Speech Recognition
par: Huber, Christian, et autres
Publié: (2024)
par: Huber, Christian, et autres
Publié: (2024)
Towards Robust Speech Representation Learning for Thousands of Languages
par: Chen, William, et autres
Publié: (2024)
par: Chen, William, et autres
Publié: (2024)
Benchmarking Rotary Position Embeddings for Automatic Speech Recognition
par: Zhang, Shucong, et autres
Publié: (2025)
par: Zhang, Shucong, et autres
Publié: (2025)
Channel-Aware Domain-Adaptive Generative Adversarial Network for Robust Speech Recognition
par: Wang, Chien-Chun, et autres
Publié: (2024)
par: Wang, Chien-Chun, et autres
Publié: (2024)
Conversational Speech Reveals Structural Robustness Failures in SpeechLLM Backbones
par: Teleki, Maria, et autres
Publié: (2025)
par: Teleki, Maria, et autres
Publié: (2025)
TICL+: A Case Study On Speech In-Context Learning for Children's Speech Recognition
par: Zheng, Haolong, et autres
Publié: (2025)
par: Zheng, Haolong, et autres
Publié: (2025)
Amplifying Emotional Signals: Data-Efficient Deep Learning for Robust Speech Emotion Recognition
par: Vu, Tai
Publié: (2025)
par: Vu, Tai
Publié: (2025)
Transsion Multilingual Speech Recognition System for MLC-SLM 2025 Challenge
par: Li, Xiaoxiao, et autres
Publié: (2025)
par: Li, Xiaoxiao, et autres
Publié: (2025)
Toward Conversational Hungarian Speech Recognition: Introducing the BEA-Large and BEA-Dialogue Datasets
par: Gedeon, Máté, et autres
Publié: (2025)
par: Gedeon, Máté, et autres
Publié: (2025)
WavLLM: Towards Robust and Adaptive Speech Large Language Model
par: Hu, Shujie, et autres
Publié: (2024)
par: Hu, Shujie, et autres
Publié: (2024)
MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond
par: Huzaifah, Muhammad, et autres
Publié: (2024)
par: Huzaifah, Muhammad, et autres
Publié: (2024)
Open ASR Leaderboard: Towards Reproducible and Transparent Multilingual and Long-Form Speech Recognition Evaluation
par: Srivastav, Vaibhav, et autres
Publié: (2025)
par: Srivastav, Vaibhav, et autres
Publié: (2025)
Efficient Streaming LLM for Speech Recognition
par: Jia, Junteng, et autres
Publié: (2024)
par: Jia, Junteng, et autres
Publié: (2024)
When Audio-Language Models Fail to Leverage Multimodal Context for Dysarthric Speech Recognition
par: Moure, Pehuén, et autres
Publié: (2026)
par: Moure, Pehuén, et autres
Publié: (2026)
VietMed: A Dataset and Benchmark for Automatic Speech Recognition of Vietnamese in the Medical Domain
par: Le-Duc, Khai
Publié: (2024)
par: Le-Duc, Khai
Publié: (2024)
A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations
par: Saengthong, Phurich, et autres
Publié: (2025)
par: Saengthong, Phurich, et autres
Publié: (2025)
ARTI-6: Towards Six-dimensional Articulatory Speech Encoding
par: Lee, Jihwan, et autres
Publié: (2025)
par: Lee, Jihwan, et autres
Publié: (2025)
Explainable Speech Emotion Recognition: Weighted Attribute Fairness to Model Demographic Contributions to Social Bias
par: Ogunnubi, Tomisin, et autres
Publié: (2026)
par: Ogunnubi, Tomisin, et autres
Publié: (2026)
Leveraging Speech PTM, Text LLM, and Emotional TTS for Speech Emotion Recognition
par: Ma, Ziyang, et autres
Publié: (2023)
par: Ma, Ziyang, et autres
Publié: (2023)
Luganda Speech Intent Recognition for IoT Applications
par: Katumba, Andrew, et autres
Publié: (2024)
par: Katumba, Andrew, et autres
Publié: (2024)
Improved Contextual Recognition In Automatic Speech Recognition Systems By Semantic Lattice Rescoring
par: Sudarshan, Ankitha, et autres
Publié: (2023)
par: Sudarshan, Ankitha, et autres
Publié: (2023)
Gated Low-rank Adaptation for personalized Code-Switching Automatic Speech Recognition on the low-spec devices
par: Kim, Gwantae, et autres
Publié: (2024)
par: Kim, Gwantae, et autres
Publié: (2024)
Style-Talker: Finetuning Audio Language Model and Style-Based Text-to-Speech Model for Fast Spoken Dialogue Generation
par: Li, Yinghao Aaron, et autres
Publié: (2024)
par: Li, Yinghao Aaron, et autres
Publié: (2024)
Adapting Foundation Speech Recognition Models to Impaired Speech: A Semantic Re-chaining Approach for Personalization of German Speech
par: Pokel, Niclas, et autres
Publié: (2025)
par: Pokel, Niclas, et autres
Publié: (2025)
Towards End-to-End Training of Automatic Speech Recognition for Nigerian Pidgin
par: Rufai, Amina Mardiyyah, et autres
Publié: (2020)
par: Rufai, Amina Mardiyyah, et autres
Publié: (2020)
Speech ReaLLM -- Real-time Streaming Speech Recognition with Multimodal LLMs by Teaching the Flow of Time
par: Seide, Frank, et autres
Publié: (2024)
par: Seide, Frank, et autres
Publié: (2024)
Cross-Speaker Encoding Network for Multi-Talker Speech Recognition
par: Kang, Jiawen, et autres
Publié: (2024)
par: Kang, Jiawen, et autres
Publié: (2024)
Benchmarking Automatic Speech Recognition for Indian Languages in Agricultural Contexts
par: S, Chandrashekar M, et autres
Publié: (2026)
par: S, Chandrashekar M, et autres
Publié: (2026)
Continued Pretraining for Domain Adaptation of Wav2vec2.0 in Automatic Speech Recognition for Elementary Math Classroom Settings
par: Attia, Ahmed Adel, et autres
Publié: (2024)
par: Attia, Ahmed Adel, et autres
Publié: (2024)
UniSonate: A Unified Model for Speech, Music, and Sound Effect Generation with Text Instructions
par: Qiang, Chunyu, et autres
Publié: (2026)
par: Qiang, Chunyu, et autres
Publié: (2026)
Audio Flamingo Next: Next-Generation Open Audio-Language Models for Speech, Sound, and Music
par: Ghosh, Sreyan, et autres
Publié: (2026)
par: Ghosh, Sreyan, et autres
Publié: (2026)
Analyzing and Fine-Tuning Whisper Models for Multilingual Pilot Speech Transcription in the Cockpit
par: Nareddy, Kartheek Kumar Reddy, et autres
Publié: (2025)
par: Nareddy, Kartheek Kumar Reddy, et autres
Publié: (2025)
Improving Child Speech Recognition and Reading Mistake Detection by Using Prompts
par: Gao, Lingyun, et autres
Publié: (2025)
par: Gao, Lingyun, et autres
Publié: (2025)
Regularized Federated Learning for Privacy-Preserving Dysarthric and Elderly Speech Recognition
par: Zhong, Tao, et autres
Publié: (2025)
par: Zhong, Tao, et autres
Publié: (2025)
An Effective Context-Balanced Adaptation Approach for Long-Tailed Speech Recognition
par: Wang, Yi-Cheng, et autres
Publié: (2024)
par: Wang, Yi-Cheng, et autres
Publié: (2024)
SimClass: A Classroom Speech Dataset Generated via Game Engine Simulation For Automatic Speech Recognition Research
par: Attia, Ahmed Adel, et autres
Publié: (2025)
par: Attia, Ahmed Adel, et autres
Publié: (2025)
Documents similaires
-
LipGER: Visually-Conditioned Generative Error Correction for Robust Automatic Speech Recognition
par: Ghosh, Sreyan, et autres
Publié: (2024) -
StutterZero and StutterFormer: End-to-End Speech Conversion for Stuttering Transcription and Correction
par: Xu, Qianheng
Publié: (2025) -
Speech Retrieval-Augmented Generation without Automatic Speech Recognition
par: Min, Do June, et autres
Publié: (2024) -
Toward Automated Clinical Transcriptions
par: Klusty, Mitchell A., et autres
Publié: (2024) -
Handling Numeric Expressions in Automatic Speech Recognition
par: Huber, Christian, et autres
Publié: (2024)