Efficient ASR for Low-Resource Languages: Leveraging Cross-Lingual Unlabeled Data
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bandarupalli, Srihari, Akkiraju, Bhavana, Devarakonda, Charan, Narsinga, Vamsiraghusimha, Vuppala, Anil Kumar |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
End-to-End Speech Translation for Low-Resource Languages Using Weakly Labeled Data
par: Pothula, Aishwarya, et autres
Publié: (2025)
par: Pothula, Aishwarya, et autres
Publié: (2025)
TeluguST-46: A Benchmark Corpus and Comprehensive Evaluation for Telugu-English Speech Translation
par: Akkiraju, Bhavana, et autres
Publié: (2025)
par: Akkiraju, Bhavana, et autres
Publié: (2025)
IIITH-BUT system for IWSLT 2025 low-resource Bhojpuri to Hindi speech translation
par: Akkiraju, Bhavana, et autres
Publié: (2025)
par: Akkiraju, Bhavana, et autres
Publié: (2025)
Enhancing ASR Performance in the Medical Domain for Dravidian Languages
par: Devarakonda, Sri Charan, et autres
Publié: (2026)
par: Devarakonda, Sri Charan, et autres
Publié: (2026)
Empowering Low-Resource Language ASR via Large-Scale Pseudo Labeling
par: Bhogale, Kaushal Santosh, et autres
Publié: (2024)
par: Bhogale, Kaushal Santosh, et autres
Publié: (2024)
A Preliminary Analysis of Automatic Word and Syllable Prominence Detection in Non-Native Speech With Text-to-Speech Prosody Embeddings
par: Mondal, Anindita, et autres
Publié: (2024)
par: Mondal, Anindita, et autres
Publié: (2024)
Attempt Towards Stress Transfer in Speech-to-Speech Machine Translation
par: Akarsh, Sai, et autres
Publié: (2024)
par: Akarsh, Sai, et autres
Publié: (2024)
Unsupervised ASR via Cross-Lingual Pseudo-Labeling
par: Likhomanenko, Tatiana, et autres
Publié: (2023)
par: Likhomanenko, Tatiana, et autres
Publié: (2023)
Towards Inclusive ASR: Investigating Voice Conversion for Dysarthric Speech Recognition in Low-Resource Languages
par: Li, Chin-Jou, et autres
Publié: (2025)
par: Li, Chin-Jou, et autres
Publié: (2025)
Speech-to-Text Translation with Phoneme-Augmented CoT: Enhancing Cross-Lingual Transfer in Low-Resource Scenarios
par: Gállego, Gerard I., et autres
Publié: (2025)
par: Gállego, Gerard I., et autres
Publié: (2025)
A Practitioner's Guide to Building ASR Models for Low-Resource Languages: A Case Study on Scottish Gaelic
par: Klejch, Ondřej, et autres
Publié: (2025)
par: Klejch, Ondřej, et autres
Publié: (2025)
Exploring the Impact of Data Quantity on ASR in Extremely Low-resource Languages
par: Cheng, Yao-Fei, et autres
Publié: (2024)
par: Cheng, Yao-Fei, et autres
Publié: (2024)
Breaking the Transcription Bottleneck: Fine-tuning ASR Models for Extremely Low-Resource Fieldwork Languages
par: Liang, Siyu, et autres
Publié: (2025)
par: Liang, Siyu, et autres
Publié: (2025)
Leveraging Parameter-Efficient Transfer Learning for Multi-Lingual Text-to-Speech Adaptation
par: Li, Yingting, et autres
Publié: (2024)
par: Li, Yingting, et autres
Publié: (2024)
Fairness in Dysarthric Speech Synthesis: Understanding Intrinsic Bias in Dysarthric Speech Cloning using F5-TTS
par: Anuprabha, M, et autres
Publié: (2025)
par: Anuprabha, M, et autres
Publié: (2025)
Enhancing Low-Resource ASR through Versatile TTS: Bridging the Data Gap
par: Yang, Guanrou, et autres
Publié: (2024)
par: Yang, Guanrou, et autres
Publié: (2024)
Open vocabulary keyword spotting through transfer learning from speech synthesis
par: V, Kesavaraj, et autres
Publié: (2024)
par: V, Kesavaraj, et autres
Publié: (2024)
Dual-Pipeline with Low-Rank Adaptation for New Language Integration in Multilingual ASR
par: Khassanov, Yerbolat, et autres
Publié: (2024)
par: Khassanov, Yerbolat, et autres
Publié: (2024)
Quantifying Cross-Lingual Transfer in Paralinguistic Speech Tasks
par: Buitrago, Pol, et autres
Publié: (2026)
par: Buitrago, Pol, et autres
Publié: (2026)
Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages
par: Anidjar, Or Haim, et autres
Publié: (2024)
par: Anidjar, Or Haim, et autres
Publié: (2024)
Performance Analysis of Speech Encoders for Low-Resource SLU and ASR in Tunisian Dialect
par: Mdhaffar, Salima, et autres
Publié: (2024)
par: Mdhaffar, Salima, et autres
Publié: (2024)
Leveraging Synthetic Audio Data for End-to-End Low-Resource Speech Translation
par: Moslem, Yasmin
Publié: (2024)
par: Moslem, Yasmin
Publié: (2024)
Enabling ASR for Low-Resource Languages: A Comprehensive Dataset Creation Approach
par: Yeroyan, Ara, et autres
Publié: (2024)
par: Yeroyan, Ara, et autres
Publié: (2024)
Initial Decoding with Minimally Augmented Language Model for Improved Lattice Rescoring in Low Resource ASR
par: Murthy, Savitha, et autres
Publié: (2024)
par: Murthy, Savitha, et autres
Publié: (2024)
End-to-End User-Defined Keyword Spotting using Shifted Delta Coefficients
par: V, Kesavaraj, et autres
Publié: (2024)
par: V, Kesavaraj, et autres
Publié: (2024)
Weighted Cross-entropy for Low-Resource Languages in Multilingual Speech Recognition
par: Piñeiro-Martín, Andrés, et autres
Publié: (2024)
par: Piñeiro-Martín, Andrés, et autres
Publié: (2024)
GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement
par: Yang, Yifan, et autres
Publié: (2024)
par: Yang, Yifan, et autres
Publié: (2024)
RefXVC: Cross-Lingual Voice Conversion with Enhanced Reference Leveraging
par: Zhang, Mingyang, et autres
Publié: (2024)
par: Zhang, Mingyang, et autres
Publié: (2024)
One Voice, Many Tongues: Cross-Lingual Voice Cloning for Scientific Speech
par: Abebe, Amanuel Gizachew, et autres
Publié: (2026)
par: Abebe, Amanuel Gizachew, et autres
Publié: (2026)
Effects of Speaker Count, Duration, and Accent Diversity on Zero-Shot Accent Robustness in Low-Resource ASR
par: Yong, Zheng-Xin, et autres
Publié: (2025)
par: Yong, Zheng-Xin, et autres
Publié: (2025)
MSA-ASR: Efficient Multilingual Speaker Attribution with frozen ASR Models
par: Nguyen, Thai-Binh, et autres
Publié: (2024)
par: Nguyen, Thai-Binh, et autres
Publié: (2024)
A Multi-modal Approach to Dysarthria Detection and Severity Assessment Using Speech and Text Information
par: M, Anuprabha, et autres
Publié: (2024)
par: M, Anuprabha, et autres
Publié: (2024)
Robust ASR Error Correction with Conservative Data Filtering
par: Udagawa, Takuma, et autres
Publié: (2024)
par: Udagawa, Takuma, et autres
Publié: (2024)
Efficient Multilingual ASR Finetuning via LoRA Language Experts
par: Li, Jiahong, et autres
Publié: (2025)
par: Li, Jiahong, et autres
Publié: (2025)
Efficient Data Selection for Domain Adaptation of ASR Using Pseudo-Labels and Multi-Stage Filtering
par: Rangappa, Pradeep, et autres
Publié: (2025)
par: Rangappa, Pradeep, et autres
Publié: (2025)
Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling
par: Huang, Shao-Syuan, et autres
Publié: (2024)
par: Huang, Shao-Syuan, et autres
Publié: (2024)
Typical vs. Atypical Disfluency Classification: Introducing the IIITH-TISA Corpus and Temporal Context-Based Feature Representations
par: Kommagouni, Priyanka, et autres
Publié: (2024)
par: Kommagouni, Priyanka, et autres
Publié: (2024)
An Exhaustive Evaluation of TTS- and VC-based Data Augmentation for ASR
par: Ogun, Sewade, et autres
Publié: (2025)
par: Ogun, Sewade, et autres
Publié: (2025)
Building English ASR model with regional language support
par: Agrawal, Purvi, et autres
Publié: (2025)
par: Agrawal, Purvi, et autres
Publié: (2025)
A Parameter-efficient Language Extension Framework for Multilingual ASR
par: Liu, Wei, et autres
Publié: (2024)
par: Liu, Wei, et autres
Publié: (2024)
Documents similaires
-
End-to-End Speech Translation for Low-Resource Languages Using Weakly Labeled Data
par: Pothula, Aishwarya, et autres
Publié: (2025) -
TeluguST-46: A Benchmark Corpus and Comprehensive Evaluation for Telugu-English Speech Translation
par: Akkiraju, Bhavana, et autres
Publié: (2025) -
IIITH-BUT system for IWSLT 2025 low-resource Bhojpuri to Hindi speech translation
par: Akkiraju, Bhavana, et autres
Publié: (2025) -
Enhancing ASR Performance in the Medical Domain for Dravidian Languages
par: Devarakonda, Sri Charan, et autres
Publié: (2026) -
Empowering Low-Resource Language ASR via Large-Scale Pseudo Labeling
par: Bhogale, Kaushal Santosh, et autres
Publié: (2024)