NaijaS2ST: A Multi-Accent Benchmark for Speech-to-Speech Translation in Low-Resource Nigerian Languages
Fuente:
arXiv
Saved in:
| Main Authors: | Maltais, Marie, Jeon, Yejin, Ma, Min, Muhammad, Shamsuddeen Hassan, Abdulmumin, Idris, Mukhtar, Maryam Ibrahim, Abolade, Daud, Okepefi, Joel, Sewedo, Johnson, Adelani, David Ifeoluwa |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
NaijaRC: A Multi-choice Reading Comprehension Dataset for Nigerian Languages
by: Aremu, Anuoluwapo, et al.
Published: (2023)
by: Aremu, Anuoluwapo, et al.
Published: (2023)
Quantity vs. Quality of Monolingual Source Data in Automatic Text Translation: Can It Be Too Little If It Is Too Good?
by: Abdulmumin, Idris, et al.
Published: (2024)
by: Abdulmumin, Idris, et al.
Published: (2024)
NaijaHate: Evaluating Hate Speech Detection on Nigerian Twitter Using Representative Data
by: Tonneau, Manuel, et al.
Published: (2024)
by: Tonneau, Manuel, et al.
Published: (2024)
AfroXLMR-Social: Adapting Pre-trained Language Models for African Languages Social Media Text
by: Belay, Tadesse Destaw, et al.
Published: (2025)
by: Belay, Tadesse Destaw, et al.
Published: (2025)
The NaijaVoices Dataset: Cultivating Large-Scale, High-Quality, Culturally-Rich Speech Data for African Languages
by: Emezue, Chris, et al.
Published: (2025)
by: Emezue, Chris, et al.
Published: (2025)
AfriScience-MT: Towards Decolonizing Science in Africa through Text Translation
by: Abdulmumin, Idris, et al.
Published: (2026)
by: Abdulmumin, Idris, et al.
Published: (2026)
ÌròyìnSpeech: A multi-purpose Yorùbá Speech Corpus
by: Ogunremi, Tolulope, et al.
Published: (2023)
by: Ogunremi, Tolulope, et al.
Published: (2023)
Automatic Speech Recognition for African Low-Resource Languages: Challenges and Future Directions
by: Imam, Sukairaj Hafiz, et al.
Published: (2025)
by: Imam, Sukairaj Hafiz, et al.
Published: (2025)
Voices Unheard: NLP Resources and Models for Yorùbá Regional Dialects
by: Ahia, Orevaoghene, et al.
Published: (2024)
by: Ahia, Orevaoghene, et al.
Published: (2024)
MacST: Multi-Accent Speech Synthesis via Text Transliteration for Accent Conversion
by: Inoue, Sho, et al.
Published: (2024)
by: Inoue, Sho, et al.
Published: (2024)
EkoHate: Abusive Language and Hate Speech Detection for Code-switched Political Discussions on Nigerian Twitter
by: Ilevbare, Comfort Eseohen, et al.
Published: (2024)
by: Ilevbare, Comfort Eseohen, et al.
Published: (2024)
Natural language processing for African languages
by: Adelani, David Ifeoluwa
Published: (2025)
by: Adelani, David Ifeoluwa
Published: (2025)
Analyzing COVID-19 Vaccination Sentiments in Nigerian Cyberspace: Insights from a Manually Annotated Twitter Dataset
by: Ahmad, Ibrahim Said, et al.
Published: (2024)
by: Ahmad, Ibrahim Said, et al.
Published: (2024)
Does Generative AI speak Nigerian-Pidgin?: Issues about Representativeness and Bias for Multilingualism in LLMs
by: Adelani, David Ifeoluwa, et al.
Published: (2024)
by: Adelani, David Ifeoluwa, et al.
Published: (2024)
Automatic Speech Recognition (ASR) for African Low-Resource Languages: A Systematic Literature Review
by: Imam, Sukairaj Hafiz, et al.
Published: (2025)
by: Imam, Sukairaj Hafiz, et al.
Published: (2025)
NaijaNLP: A Survey of Nigerian Low-Resource Languages
by: Inuwa-Dutse, Isa
Published: (2025)
by: Inuwa-Dutse, Isa
Published: (2025)
Exploring Cultural Nuances in Emotion Perception Across 15 African Languages
by: Ahmad, Ibrahim Said, et al.
Published: (2025)
by: Ahmad, Ibrahim Said, et al.
Published: (2025)
Probabilistic Frequency Hazard Analysis: Adapting the Seismic Hazard Framework to Power System Frequency Exceedance Risk
by: Todowede, Sewedo
Published: (2026)
by: Todowede, Sewedo
Published: (2026)
SpeechAccentLLM: A Unified Framework for Foreign Accent Conversion and Text to Speech
by: Cheng, Zhuangfei, et al.
Published: (2025)
by: Cheng, Zhuangfei, et al.
Published: (2025)
HausaNLP at SemEval-2025 Task 2: Entity-Aware Fine-tuning vs. Prompt Engineering in Entity-Aware Machine Translation
by: Abubakar, Abdulhamid, et al.
Published: (2025)
by: Abubakar, Abdulhamid, et al.
Published: (2025)
Dub-S2ST: Textless Speech-to-Speech Translation for Seamless Dubbing
by: Choi, Jeongsoo, et al.
Published: (2025)
by: Choi, Jeongsoo, et al.
Published: (2025)
Who Wrote This? Identifying Machine vs Human-Generated Text in Hausa
by: Sani, Babangida, et al.
Published: (2025)
by: Sani, Babangida, et al.
Published: (2025)
HausaNLP at SemEval-2025 Task 3: Towards a Fine-Grained Model-Aware Hallucination Detection
by: Bala, Maryam, et al.
Published: (2025)
by: Bala, Maryam, et al.
Published: (2025)
Clustering and Mining Accented Speech for Inclusive and Fair Speech Recognition
by: Kim, Jaeyoung, et al.
Published: (2024)
by: Kim, Jaeyoung, et al.
Published: (2024)
ANGOFA: Leveraging OFA Embedding Initialization and Synthetic Data for Angolan Language Model
by: Quinjica, Osvaldo Luamba, et al.
Published: (2024)
by: Quinjica, Osvaldo Luamba, et al.
Published: (2024)
S2ST-Omni: Hierarchical Language-Aware SpeechLLM Adaptation for Multilingual Speech-to-Speech Translation
by: Pan, Yu, et al.
Published: (2025)
by: Pan, Yu, et al.
Published: (2025)
DiariST: Streaming Speech Translation with Speaker Diarization
by: Yang, Mu, et al.
Published: (2023)
by: Yang, Mu, et al.
Published: (2023)
MELD-ST: An Emotion-aware Speech Translation Dataset
by: Chen, Sirou, et al.
Published: (2024)
by: Chen, Sirou, et al.
Published: (2024)
LID Models are Actually Accent Classifiers: Implications and Solutions for LID on Accented Speech
by: Bafna, Niyati, et al.
Published: (2025)
by: Bafna, Niyati, et al.
Published: (2025)
Pairwise Evaluation of Accent Similarity in Speech Synthesis
by: Zhong, Jinzuomu, et al.
Published: (2025)
by: Zhong, Jinzuomu, et al.
Published: (2025)
Optimizing Multilingual Text-To-Speech with Accents & Emotions
by: Pawar, Pranav, et al.
Published: (2025)
by: Pawar, Pranav, et al.
Published: (2025)
An Empirical Study of Many-Shot In-Context Learning for Machine Translation of Low-Resource Languages
by: Lu, Yinhan, et al.
Published: (2026)
by: Lu, Yinhan, et al.
Published: (2026)
AfriHate: A Multilingual Collection of Hate Speech and Abusive Language Datasets for African Languages
by: Muhammad, Shamsuddeen Hassan, et al.
Published: (2025)
by: Muhammad, Shamsuddeen Hassan, et al.
Published: (2025)
Correcting FLORES Evaluation Dataset for Four African Languages
by: Abdulmumin, Idris, et al.
Published: (2024)
by: Abdulmumin, Idris, et al.
Published: (2024)
mSTEB: Massively Multilingual Evaluation of LLMs on Speech and Text Tasks
by: Beyene, Luel Hagos, et al.
Published: (2025)
by: Beyene, Luel Hagos, et al.
Published: (2025)
EmoAra: Emotion-Preserving English Speech Transcription and Cross-Lingual Translation with Arabic Text-to-Speech
by: Hassan, Besher, et al.
Published: (2026)
by: Hassan, Besher, et al.
Published: (2026)
DIVERS-Bench: Evaluating Language Identification Across Domain Shifts and Code-Switching
by: Ojo, Jessica, et al.
Published: (2025)
by: Ojo, Jessica, et al.
Published: (2025)
AfriMTEB and AfriE5: Benchmarking and Adapting Text Embedding Models for African Languages
by: Uemura, Kosei, et al.
Published: (2025)
by: Uemura, Kosei, et al.
Published: (2025)
MSLM-S2ST: A Multitask Speech Language Model for Textless Speech-to-Speech Translation with Speaker Style Preservation
by: Peng, Yifan, et al.
Published: (2024)
by: Peng, Yifan, et al.
Published: (2024)
Zero Shot Text to Speech Augmentation for Automatic Speech Recognition on Low-Resource Accented Speech Corpora
by: Nespoli, Francesco, et al.
Published: (2024)
by: Nespoli, Francesco, et al.
Published: (2024)
Similar Items
-
NaijaRC: A Multi-choice Reading Comprehension Dataset for Nigerian Languages
by: Aremu, Anuoluwapo, et al.
Published: (2023) -
Quantity vs. Quality of Monolingual Source Data in Automatic Text Translation: Can It Be Too Little If It Is Too Good?
by: Abdulmumin, Idris, et al.
Published: (2024) -
NaijaHate: Evaluating Hate Speech Detection on Nigerian Twitter Using Representative Data
by: Tonneau, Manuel, et al.
Published: (2024) -
AfroXLMR-Social: Adapting Pre-trained Language Models for African Languages Social Media Text
by: Belay, Tadesse Destaw, et al.
Published: (2025) -
The NaijaVoices Dataset: Cultivating Large-Scale, High-Quality, Culturally-Rich Speech Data for African Languages
by: Emezue, Chris, et al.
Published: (2025)