Uhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African Languages
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bayes, Edward, Azime, Israel Abebe, Alabi, Jesujoba O., Kgomo, Jonas, Eloundou, Tyna, Proehl, Elizabeth, Chen, Kai, Khadir, Imaan, Etori, Naome A., Muhammad, Shamsuddeen Hassan, Mpanza, Choice, Thete, Igneciah Pocia, Klakow, Dietrich, Adelani, David Ifeoluwa |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Charting the Landscape of African NLP: Mapping Progress and Shaping the Road Ahead
par: Alabi, Jesujoba O., et autres
Publié: (2025)
par: Alabi, Jesujoba O., et autres
Publié: (2025)
NaijaRC: A Multi-choice Reading Comprehension Dataset for Nigerian Languages
par: Aremu, Anuoluwapo, et autres
Publié: (2023)
par: Aremu, Anuoluwapo, et autres
Publié: (2023)
AFRIDOC-MT: Document-level MT Corpus for African Languages
par: Alabi, Jesujoba O., et autres
Publié: (2025)
par: Alabi, Jesujoba O., et autres
Publié: (2025)
YoNER: A New Yorùbá Multi-domain Named Entity Recognition Dataset
par: Falola, Peace Busola, et autres
Publié: (2026)
par: Falola, Peace Busola, et autres
Publié: (2026)
AfroXLMR-Social: Adapting Pre-trained Language Models for African Languages Social Media Text
par: Belay, Tadesse Destaw, et autres
Publié: (2025)
par: Belay, Tadesse Destaw, et autres
Publié: (2025)
Saar-Voice: A Multi-Speaker Saarbrücken Dialect Speech Corpus
par: Oberkircher, Lena S., et autres
Publié: (2026)
par: Oberkircher, Lena S., et autres
Publié: (2026)
AfriHuBERT: A self-supervised speech representation model for African languages
par: Alabi, Jesujoba O., et autres
Publié: (2024)
par: Alabi, Jesujoba O., et autres
Publié: (2024)
AAdaM at SemEval-2024 Task 1: Augmentation and Adaptation for Multilingual Semantic Textual Relatedness
par: Zhang, Miaoran, et autres
Publié: (2024)
par: Zhang, Miaoran, et autres
Publié: (2024)
Bridging the Culture Gap: A Framework for LLM-Driven Socio-Cultural Localization of Math Word Problems in Low-Resource Languages
par: Azime, Israel Abebe, et autres
Publié: (2025)
par: Azime, Israel Abebe, et autres
Publié: (2025)
MERLIN: Multi-Stage Curriculum Alignment for Multilingual Encoder-LLM Integration in Cross-Lingual Reasoning
par: Uemura, Kosei, et autres
Publié: (2025)
par: Uemura, Kosei, et autres
Publié: (2025)
Afri-MCQA: Multimodal Cultural Question Answering for African Languages
par: Tonja, Atnafu Lambebo, et autres
Publié: (2026)
par: Tonja, Atnafu Lambebo, et autres
Publié: (2026)
Natural language processing for African languages
par: Adelani, David Ifeoluwa
Publié: (2025)
par: Adelani, David Ifeoluwa
Publié: (2025)
RideKE: Leveraging Low-Resource, User-Generated Twitter Content for Sentiment and Emotion Detection in Kenyan Code-Switched Dataset
par: Etori, Naome A., et autres
Publié: (2025)
par: Etori, Naome A., et autres
Publié: (2025)
SEAL: Systematic Error Analysis for Value ALignment
par: Revel, Manon, et autres
Publié: (2024)
par: Revel, Manon, et autres
Publié: (2024)
The Hidden Space of Transformer Language Adapters
par: Alabi, Jesujoba O., et autres
Publié: (2024)
par: Alabi, Jesujoba O., et autres
Publié: (2024)
EkoHate: Abusive Language and Hate Speech Detection for Code-switched Political Discussions on Nigerian Twitter
par: Ilevbare, Comfort Eseohen, et autres
Publié: (2024)
par: Ilevbare, Comfort Eseohen, et autres
Publié: (2024)
AfrIFact: Cultural Information Retrieval, Evidence Extraction and Fact Checking for African Languages
par: Azime, Israel Abebe, et autres
Publié: (2026)
par: Azime, Israel Abebe, et autres
Publié: (2026)
mSTEB: Massively Multilingual Evaluation of LLMs on Speech and Text Tasks
par: Beyene, Luel Hagos, et autres
Publié: (2025)
par: Beyene, Luel Hagos, et autres
Publié: (2025)
YAD: Leveraging T5 for Improved Automatic Diacritization of Yorùbá Text
par: Olawole, Akindele Michael, et autres
Publié: (2024)
par: Olawole, Akindele Michael, et autres
Publié: (2024)
SIB-200: A Simple, Inclusive, and Big Evaluation Dataset for Topic Classification in 200+ Languages and Dialects
par: Adelani, David Ifeoluwa, et autres
Publié: (2023)
par: Adelani, David Ifeoluwa, et autres
Publié: (2023)
Accept or Deny? Evaluating LLM Fairness and Performance in Loan Approval across Table-to-Text Serialization Approaches
par: Azime, Israel Abebe, et autres
Publié: (2025)
par: Azime, Israel Abebe, et autres
Publié: (2025)
INJONGO: A Multicultural Intent Detection and Slot-filling Dataset for 16 African Languages
par: Yu, Hao, et autres
Publié: (2025)
par: Yu, Hao, et autres
Publié: (2025)
LAG-MMLU: Benchmarking Frontier LLM Understanding in Latvian and Giriama
par: Etori, Naome A., et autres
Publié: (2025)
par: Etori, Naome A., et autres
Publié: (2025)
The Impact of Demonstrations on Multilingual In-Context Learning: A Multidimensional Analysis
par: Zhang, Miaoran, et autres
Publié: (2024)
par: Zhang, Miaoran, et autres
Publié: (2024)
Evaluation Sheet for Deep Research: A Use Case for Academic Survey Writing
par: Azime, Israel Abebe, et autres
Publié: (2025)
par: Azime, Israel Abebe, et autres
Publié: (2025)
ANGOFA: Leveraging OFA Embedding Initialization and Synthetic Data for Angolan Language Model
par: Quinjica, Osvaldo Luamba, et autres
Publié: (2024)
par: Quinjica, Osvaldo Luamba, et autres
Publié: (2024)
AmharicStoryQA: A Multicultural Story Question Answering Benchmark in Amharic
par: Azime, Israel Abebe, et autres
Publié: (2026)
par: Azime, Israel Abebe, et autres
Publié: (2026)
DIVERS-Bench: Evaluating Language Identification Across Domain Shifts and Code-Switching
par: Ojo, Jessica, et autres
Publié: (2025)
par: Ojo, Jessica, et autres
Publié: (2025)
AfriMTEB and AfriE5: Benchmarking and Adapting Text Embedding Models for African Languages
par: Uemura, Kosei, et autres
Publié: (2025)
par: Uemura, Kosei, et autres
Publié: (2025)
Evaluating the Capabilities of Large Language Models for Multi-label Emotion Understanding
par: Belay, Tadesse Destaw, et autres
Publié: (2024)
par: Belay, Tadesse Destaw, et autres
Publié: (2024)
TEXT2TASTE: A Versatile Egocentric Vision System for Intelligent Reading Assistance Using Large Language Model
par: Mucha, Wiktor, et autres
Publié: (2024)
par: Mucha, Wiktor, et autres
Publié: (2024)
MINERS: Multilingual Language Models as Semantic Retrievers
par: Winata, Genta Indra, et autres
Publié: (2024)
par: Winata, Genta Indra, et autres
Publié: (2024)
IrokoBench: A New Benchmark for African Languages in the Age of Large Language Models
par: Adelani, David Ifeoluwa, et autres
Publié: (2024)
par: Adelani, David Ifeoluwa, et autres
Publié: (2024)
UNIQORN: Unified Question Answering over RDF Knowledge Graphs and Natural Language Text
par: Pramanik, Soumajit, et autres
Publié: (2021)
par: Pramanik, Soumajit, et autres
Publié: (2021)
AFRILANGTUTOR: Advancing Language Tutoring and Culture Education in Low-Resource Languages with Large Language Models
par: Belay, Tadesse Destaw, et autres
Publié: (2026)
par: Belay, Tadesse Destaw, et autres
Publié: (2026)
Performant ASR Models for Medical Entities in Accented Speech
par: Afonja, Tejumade, et autres
Publié: (2024)
par: Afonja, Tejumade, et autres
Publié: (2024)
Lugha-Llama: Adapting Large Language Models for African Languages
par: Buzaaba, Happy, et autres
Publié: (2025)
par: Buzaaba, Happy, et autres
Publié: (2025)
Ethio-ASR: Joint Multilingual Speech Recognition and Language Identification for Ethiopian Languages
par: Abdullah, Badr M., et autres
Publié: (2026)
par: Abdullah, Badr M., et autres
Publié: (2026)
51%: Una agenda para la igualdad (2018)
par: GIRE – Information Group on Reproductive Choice
Publié: (2018)
par: GIRE – Information Group on Reproductive Choice
Publié: (2018)
Enfermería de urgencias: técnicas y procedimientos / Jean A. Proehl; revisor, Carmen Vila Gimeno
par: Proehl, Jean A
Publié: (2005)
par: Proehl, Jean A
Publié: (2005)
Documents similaires
-
Charting the Landscape of African NLP: Mapping Progress and Shaping the Road Ahead
par: Alabi, Jesujoba O., et autres
Publié: (2025) -
NaijaRC: A Multi-choice Reading Comprehension Dataset for Nigerian Languages
par: Aremu, Anuoluwapo, et autres
Publié: (2023) -
AFRIDOC-MT: Document-level MT Corpus for African Languages
par: Alabi, Jesujoba O., et autres
Publié: (2025) -
YoNER: A New Yorùbá Multi-domain Named Entity Recognition Dataset
par: Falola, Peace Busola, et autres
Publié: (2026) -
AfroXLMR-Social: Adapting Pre-trained Language Models for African Languages Social Media Text
par: Belay, Tadesse Destaw, et autres
Publié: (2025)