AraDiCE: Benchmarks for Dialectal and Cultural Capabilities in LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Mousi, Basel, Durrani, Nadir, Ahmad, Fatema, Hasan, Md. Arid, Hasanain, Maram, Kabbani, Tameem, Dalvi, Fahim, Chowdhury, Shammur Absar, Alam, Firoj |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LLMeBench: A Flexible Framework for Accelerating LLMs Benchmarking
di: Dalvi, Fahim, et al.
Pubblicazione: (2023)
di: Dalvi, Fahim, et al.
Pubblicazione: (2023)
Once Correct, Still Wrong: Counterfactual Hallucination in Multilingual Vision-Language Models
di: Mousi, Basel, et al.
Pubblicazione: (2026)
di: Mousi, Basel, et al.
Pubblicazione: (2026)
OASIS: A Multilingual and Multimodal Dataset for Culturally Grounded Spoken Visual QA
di: Alam, Firoj, et al.
Pubblicazione: (2025)
di: Alam, Firoj, et al.
Pubblicazione: (2025)
SpokenNativQA: Multilingual Everyday Spoken Queries for LLMs
di: Alam, Firoj, et al.
Pubblicazione: (2025)
di: Alam, Firoj, et al.
Pubblicazione: (2025)
Large Language Models for Propaganda Span Annotation
di: Hasanain, Maram, et al.
Pubblicazione: (2023)
di: Hasanain, Maram, et al.
Pubblicazione: (2023)
NativQA: Multilingual Culturally-Aligned Natural Query for LLMs
di: Hasan, Md. Arid, et al.
Pubblicazione: (2024)
di: Hasan, Md. Arid, et al.
Pubblicazione: (2024)
From Words to Waves: Analyzing Concept Formation in Speech and Text-Based Foundation Models
di: Ersoy, Asım, et al.
Pubblicazione: (2025)
di: Ersoy, Asım, et al.
Pubblicazione: (2025)
LAraBench: Benchmarking Arabic AI with Large Language Models
di: Abdelali, Ahmed, et al.
Pubblicazione: (2023)
di: Abdelali, Ahmed, et al.
Pubblicazione: (2023)
ArMeme: Propagandistic Content in Arabic Memes
di: Alam, Firoj, et al.
Pubblicazione: (2024)
di: Alam, Firoj, et al.
Pubblicazione: (2024)
Multilingual and Multimodal LLMs in the Wild: Building for Low-Resource Languages
di: Alam, Firoj, et al.
Pubblicazione: (2026)
di: Alam, Firoj, et al.
Pubblicazione: (2026)
NativQA Framework: Enabling LLMs and VLMs with Native, Local, and Everyday Knowledge
di: Alam, Firoj, et al.
Pubblicazione: (2025)
di: Alam, Firoj, et al.
Pubblicazione: (2025)
ArAIEval Shared Task: Propagandistic Techniques Detection in Unimodal and Multimodal Arabic Content
di: Hasanain, Maram, et al.
Pubblicazione: (2024)
di: Hasanain, Maram, et al.
Pubblicazione: (2024)
Editing Across Languages: A Survey of Multilingual Knowledge Editing
di: Durrani, Nadir, et al.
Pubblicazione: (2025)
di: Durrani, Nadir, et al.
Pubblicazione: (2025)
An Exploration of Knowledge Editing for Arabic
di: Mousi, Basel, et al.
Pubblicazione: (2025)
di: Mousi, Basel, et al.
Pubblicazione: (2025)
Multi-Task Instruction Tuning via Data Scheduling for Low-Resource Arabic AudioLLMs
di: Bhatti, Hunzalah Hassan, et al.
Pubblicazione: (2026)
di: Bhatti, Hunzalah Hassan, et al.
Pubblicazione: (2026)
ThatiAR: Subjectivity Detection in Arabic News Sentences
di: Suwaileh, Reem, et al.
Pubblicazione: (2024)
di: Suwaileh, Reem, et al.
Pubblicazione: (2024)
PropXplain: Can LLMs Enable Explainable Propaganda Detection?
di: Hasanain, Maram, et al.
Pubblicazione: (2025)
di: Hasanain, Maram, et al.
Pubblicazione: (2025)
GenAI Content Detection Task 2: AI vs. Human -- Academic Essay Authenticity Challenge
di: Chowdhury, Shammur Absar, et al.
Pubblicazione: (2024)
di: Chowdhury, Shammur Absar, et al.
Pubblicazione: (2024)
MENASpeechBank: A Reference Voice Bank with Persona-Conditioned Multi-Turn Conversations for AudioLLMs
di: Ali, Zien Sheikh, et al.
Pubblicazione: (2026)
di: Ali, Zien Sheikh, et al.
Pubblicazione: (2026)
Exploring Alignment in Shared Cross-lingual Spaces
di: Mousi, Basel, et al.
Pubblicazione: (2024)
di: Mousi, Basel, et al.
Pubblicazione: (2024)
CultranAI at PalmX 2025: Data Augmentation for Cultural Knowledge Representation
di: Bhatti, Hunzalah Hassan, et al.
Pubblicazione: (2025)
di: Bhatti, Hunzalah Hassan, et al.
Pubblicazione: (2025)
Native vs Non-Native Language Prompting: A Comparative Analysis
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2024)
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2024)
Can GPT-4 Identify Propaganda? Annotation and Detection of Propaganda Spans in News Articles
di: Hasanain, Maram, et al.
Pubblicazione: (2024)
di: Hasanain, Maram, et al.
Pubblicazione: (2024)
LlamaLens: Specialized Multilingual LLM for Analyzing News and Social Media Content
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2024)
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2024)
Beyond MCQ: An Open-Ended Arabic Cultural QA Benchmark with Dialect Variants
di: Bhatti, Hunzalah Hassan, et al.
Pubblicazione: (2025)
di: Bhatti, Hunzalah Hassan, et al.
Pubblicazione: (2025)
LLM-Based Multi-Task Bangla Hate Speech Detection: Type, Severity, and Target
di: Hasan, Md Arid, et al.
Pubblicazione: (2025)
di: Hasan, Md Arid, et al.
Pubblicazione: (2025)
WASIL: In-the-Wild Arabic Spoken Interactions with LLMs
di: Ali, Zien Sheikh, et al.
Pubblicazione: (2026)
di: Ali, Zien Sheikh, et al.
Pubblicazione: (2026)
BLP-2023 Task 2: Sentiment Analysis
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
Fanar: An Arabic-Centric Multimodal Generative AI Platform
di: Fanar Team, et al.
Pubblicazione: (2025)
di: Fanar Team, et al.
Pubblicazione: (2025)
Ensemble Language Models for Multilingual Sentiment Analysis
di: Hasan, Md Arid
Pubblicazione: (2024)
di: Hasan, Md Arid
Pubblicazione: (2024)
MemeIntel: Explainable Detection of Propagandistic and Hateful Memes
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2025)
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2025)
Scaling up Discovery of Latent Concepts in Deep NLP Models
di: Hawasly, Majd, et al.
Pubblicazione: (2023)
di: Hawasly, Majd, et al.
Pubblicazione: (2023)
Discovering Salient Neurons in Deep NLP Models
di: Durrani, Nadir, et al.
Pubblicazione: (2022)
di: Durrani, Nadir, et al.
Pubblicazione: (2022)
Beyond LLM-as-a-Judge: Deterministic Metrics for Multilingual Generative Text Evaluation
di: Alam, Firoj, et al.
Pubblicazione: (2026)
di: Alam, Firoj, et al.
Pubblicazione: (2026)
Do Large Language Models Speak All Languages Equally? A Comparative Study in Low-Resource Settings
di: Hasan, Md. Arid, et al.
Pubblicazione: (2024)
di: Hasan, Md. Arid, et al.
Pubblicazione: (2024)
Zero- and Few-Shot Prompting with LLMs: A Comparative Study with Fine-tuned Models for Bangla Sentiment Analysis
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
Semantic Risk-Aware Heuristic Planning for Robotic Navigation in Dynamic Environments: An LLM-Inspired Approach
di: Durrani, Hamza Ahmed, et al.
Pubblicazione: (2026)
di: Durrani, Hamza Ahmed, et al.
Pubblicazione: (2026)
Depthwise Separable Convolutions with Deep Residual Convolutions
di: Hasan, Md Arid, et al.
Pubblicazione: (2024)
di: Hasan, Md Arid, et al.
Pubblicazione: (2024)
Lifelong Learning in Vision-Language Models: Enhanced EWC with Cross-Modal Knowledge Retention
di: Durrani, Hamza Ahmed, et al.
Pubblicazione: (2026)
di: Durrani, Hamza Ahmed, et al.
Pubblicazione: (2026)
Propaganda to Hate: A Multimodal Analysis of Arabic Memes with Multi-Agent LLMs
di: Alam, Firoj, et al.
Pubblicazione: (2024)
di: Alam, Firoj, et al.
Pubblicazione: (2024)
Documenti analoghi
-
LLMeBench: A Flexible Framework for Accelerating LLMs Benchmarking
di: Dalvi, Fahim, et al.
Pubblicazione: (2023) -
Once Correct, Still Wrong: Counterfactual Hallucination in Multilingual Vision-Language Models
di: Mousi, Basel, et al.
Pubblicazione: (2026) -
OASIS: A Multilingual and Multimodal Dataset for Culturally Grounded Spoken Visual QA
di: Alam, Firoj, et al.
Pubblicazione: (2025) -
SpokenNativQA: Multilingual Everyday Spoken Queries for LLMs
di: Alam, Firoj, et al.
Pubblicazione: (2025) -
Large Language Models for Propaganda Span Annotation
di: Hasanain, Maram, et al.
Pubblicazione: (2023)