Jawaher: A Multidialectal Dataset of Arabic Proverbs for LLM Benchmarking
Fuente:
arXiv
Guardado en:
| Autores principales: | Magdy, Samar M., Kwon, Sang Yun, Alwajih, Fakhraddin, Abdelfadil, Safaa, Shehata, Shady, Abdul-Mageed, Muhammad |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Gazelle: An Instruction Dataset for Arabic Writing Assistance
por: Magdy, Samar M., et al.
Publicado: (2024)
por: Magdy, Samar M., et al.
Publicado: (2024)
Dallah: A Dialect-Aware Multimodal Large Language Model for Arabic
por: Alwajih, Fakhraddin, et al.
Publicado: (2024)
por: Alwajih, Fakhraddin, et al.
Publicado: (2024)
Arabic Automatic Story Generation with Large Language Models
por: El-Shangiti, Ahmed Oumar, et al.
Publicado: (2024)
por: El-Shangiti, Ahmed Oumar, et al.
Publicado: (2024)
LQM: Linguistically Motivated Multidimensional Quality Metrics for Machine Translation
por: Magdy, Samar M., et al.
Publicado: (2026)
por: Magdy, Samar M., et al.
Publicado: (2026)
Peacock: A Family of Arabic Multimodal Large Language Models and Benchmarks
por: Alwajih, Fakhraddin, et al.
Publicado: (2024)
por: Alwajih, Fakhraddin, et al.
Publicado: (2024)
Qalam : A Multimodal LLM for Arabic Optical Character and Handwriting Recognition
por: Bhatia, Gagan, et al.
Publicado: (2024)
por: Bhatia, Gagan, et al.
Publicado: (2024)
Casablanca: Data and Models for Multidialectal Arabic Speech Recognition
por: Talafha, Bashar, et al.
Publicado: (2024)
por: Talafha, Bashar, et al.
Publicado: (2024)
Swan and ArabicMTEB: Dialect-Aware, Arabic-Centric, Cross-Lingual, and Cross-Cultural Embedding Models and Benchmarks
por: Bhatia, Gagan, et al.
Publicado: (2024)
por: Bhatia, Gagan, et al.
Publicado: (2024)
PalmX 2025: The First Shared Task on Benchmarking LLMs on Arabic and Islamic Culture
por: Alwajih, Fakhraddin, et al.
Publicado: (2025)
por: Alwajih, Fakhraddin, et al.
Publicado: (2025)
Palm: A Culturally Inclusive and Linguistically Diverse Dataset for Arabic LLMs
por: Alwajih, Fakhraddin, et al.
Publicado: (2025)
por: Alwajih, Fakhraddin, et al.
Publicado: (2025)
What Does it Take to Generalize SER Model Across Datasets? A Comprehensive Benchmark
por: Ibrahim, Adham, et al.
Publicado: (2024)
por: Ibrahim, Adham, et al.
Publicado: (2024)
NADI 2024: The Fifth Nuanced Arabic Dialect Identification Shared Task
por: Abdul-Mageed, Muhammad, et al.
Publicado: (2024)
por: Abdul-Mageed, Muhammad, et al.
Publicado: (2024)
Are LLMs Good Text Diacritizers? An Arabic and Yoruba Case Study
por: Toyin, Hawau Olamide, et al.
Publicado: (2025)
por: Toyin, Hawau Olamide, et al.
Publicado: (2025)
ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis
por: Toyin, Hawau Olamide, et al.
Publicado: (2025)
por: Toyin, Hawau Olamide, et al.
Publicado: (2025)
EduAdapt: A Question Answer Benchmark Dataset for Evaluating Grade-Level Adaptability in LLMs
por: Naeem, Numaan, et al.
Publicado: (2025)
por: Naeem, Numaan, et al.
Publicado: (2025)
Detecting Propaganda Techniques in Code-Switched Social Media Text
por: Salman, Muhammad Umar, et al.
Publicado: (2023)
por: Salman, Muhammad Umar, et al.
Publicado: (2023)
WojoodNER 2024: The Second Arabic Named Entity Recognition Shared Task
por: Jarrar, Mustafa, et al.
Publicado: (2024)
por: Jarrar, Mustafa, et al.
Publicado: (2024)
Estimating the Level of Dialectness Predicts Interannotator Agreement in Multi-dialect Arabic Datasets
por: Keleg, Amr, et al.
Publicado: (2024)
por: Keleg, Amr, et al.
Publicado: (2024)
Pearl: A Multimodal Culturally-Aware Arabic Instruction Dataset
por: Alwajih, Fakhraddin, et al.
Publicado: (2025)
por: Alwajih, Fakhraddin, et al.
Publicado: (2025)
NADI 2025: The First Multidialectal Arabic Speech Processing Shared Task
por: Talafha, Bashar, et al.
Publicado: (2025)
por: Talafha, Bashar, et al.
Publicado: (2025)
Munsit at NADI 2025 Shared Task 2: Pushing the Boundaries of Multidialectal Arabic ASR with Weakly Supervised Pretraining and Continual Supervised Fine-tuning
por: Salhab, Mahmoud, et al.
Publicado: (2025)
por: Salhab, Mahmoud, et al.
Publicado: (2025)
On Barriers to Archival Audio Processing
por: Sullivan, Peter, et al.
Publicado: (2025)
por: Sullivan, Peter, et al.
Publicado: (2025)
Autoregressive + Chain of Thought = Recurrent: Recurrence's Role in Language Models' Computability and a Revisit of Recurrent Transformer
por: Zhang, Xiang, et al.
Publicado: (2024)
por: Zhang, Xiang, et al.
Publicado: (2024)
Interplay of Machine Translation, Diacritics, and Diacritization
por: Chen, Wei-Rui, et al.
Publicado: (2024)
por: Chen, Wei-Rui, et al.
Publicado: (2024)
BALSAM: A Platform for Benchmarking Arabic Large Language Models
por: Al-Matham, Rawan, et al.
Publicado: (2025)
por: Al-Matham, Rawan, et al.
Publicado: (2025)
NileChat: Towards Linguistically Diverse and Culturally Aware LLMs for Local Communities
por: Mekki, Abdellah El, et al.
Publicado: (2025)
por: Mekki, Abdellah El, et al.
Publicado: (2025)
FinTral: A Family of GPT-4 Level Multimodal Financial Large Language Models
por: Bhatia, Gagan, et al.
Publicado: (2024)
por: Bhatia, Gagan, et al.
Publicado: (2024)
ALHD: A Large-Scale and Multigenre Benchmark Dataset for Arabic LLM-Generated Text Detection
por: Khairallah, Ali, et al.
Publicado: (2025)
por: Khairallah, Ali, et al.
Publicado: (2025)
AfroScope: A Framework for Studying the Linguistic Landscape of Africa
por: Kwon, Sang Yun, et al.
Publicado: (2026)
por: Kwon, Sang Yun, et al.
Publicado: (2026)
CamelEval: Advancing Culturally Aligned Arabic Language Models and Benchmarks
por: Qian, Zhaozhi, et al.
Publicado: (2024)
por: Qian, Zhaozhi, et al.
Publicado: (2024)
Desert Camels and Oil Sheikhs: Arab-Centric Red Teaming of Frontier LLMs
por: Saeed, Muhammed, et al.
Publicado: (2024)
por: Saeed, Muhammed, et al.
Publicado: (2024)
Beyond Content: How Grammatical Gender Shapes Visual Representation in Text-to-Image Models
por: Saeed, Muhammed, et al.
Publicado: (2025)
por: Saeed, Muhammed, et al.
Publicado: (2025)
From Multiple-Choice to Extractive QA: A Case Study for English and Arabic
por: Lynn, Teresa, et al.
Publicado: (2024)
por: Lynn, Teresa, et al.
Publicado: (2024)
Advancing Arabic Reverse Dictionary Systems: A Transformer-Based Approach with Dataset Construction Guidelines
por: Sibaee, Serry, et al.
Publicado: (2025)
por: Sibaee, Serry, et al.
Publicado: (2025)
Distilling the Essence: Efficient Reasoning Distillation via Sequence Truncation
por: Chen, Wei-Rui, et al.
Publicado: (2025)
por: Chen, Wei-Rui, et al.
Publicado: (2025)
Distilling Text Style Transfer With Self-Explanation From LLMs
por: Zhang, Chiyu, et al.
Publicado: (2024)
por: Zhang, Chiyu, et al.
Publicado: (2024)
From Words to Proverbs: Evaluating LLMs Linguistic and Cultural Competence in Saudi Dialects with Absher
por: Al-Monef, Renad, et al.
Publicado: (2025)
por: Al-Monef, Renad, et al.
Publicado: (2025)
DialectalArabicMMLU: Benchmarking Dialectal Capabilities in Arabic and Multilingual Language Models
por: Altakrori, Malik H., et al.
Publicado: (2025)
por: Altakrori, Malik H., et al.
Publicado: (2025)
ArabicNumBench: Evaluating Arabic Number Reading in Large Language Models
por: Alhumud, Anas, et al.
Publicado: (2026)
por: Alhumud, Anas, et al.
Publicado: (2026)
ArFake: A Multi-Dialect Benchmark and Baselines for Arabic Spoof-Speech Detection
por: Maged, Mohamed, et al.
Publicado: (2025)
por: Maged, Mohamed, et al.
Publicado: (2025)
Ejemplares similares
-
Gazelle: An Instruction Dataset for Arabic Writing Assistance
por: Magdy, Samar M., et al.
Publicado: (2024) -
Dallah: A Dialect-Aware Multimodal Large Language Model for Arabic
por: Alwajih, Fakhraddin, et al.
Publicado: (2024) -
Arabic Automatic Story Generation with Large Language Models
por: El-Shangiti, Ahmed Oumar, et al.
Publicado: (2024) -
LQM: Linguistically Motivated Multidimensional Quality Metrics for Machine Translation
por: Magdy, Samar M., et al.
Publicado: (2026) -
Peacock: A Family of Arabic Multimodal Large Language Models and Benchmarks
por: Alwajih, Fakhraddin, et al.
Publicado: (2024)