Curriculum Learning and Pseudo-Labeling Improve the Generalization of Multi-Label Arabic Dialect Identification Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mekky, Ali, Zeftawy, Mohamed El, Hassan, Lara, Keleg, Amr, Nakov, Preslav |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Revisiting Common Assumptions about Arabic Dialects in NLP
par: Keleg, Amr, et autres
Publié: (2025)
par: Keleg, Amr, et autres
Publié: (2025)
Nile-Chat: Egyptian Language Models for Arabic and Latin Scripts
par: Shang, Guokan, et autres
Publié: (2025)
par: Shang, Guokan, et autres
Publié: (2025)
Estimating the Level of Dialectness Predicts Interannotator Agreement in Multi-dialect Arabic Datasets
par: Keleg, Amr, et autres
Publié: (2024)
par: Keleg, Amr, et autres
Publié: (2024)
Saudi-Dialect-ALLaM: LoRA Fine-Tuning for Dialectal Arabic Generation
par: Barmandah, Hassan
Publié: (2025)
par: Barmandah, Hassan
Publié: (2025)
ArFake: A Multi-Dialect Benchmark and Baselines for Arabic Spoof-Speech Detection
par: Maged, Mohamed, et autres
Publié: (2025)
par: Maged, Mohamed, et autres
Publié: (2025)
MuDRiC: Multi-Dialect Reasoning for Arabic Commonsense Validation
par: Elozeiri, Kareem, et autres
Publié: (2025)
par: Elozeiri, Kareem, et autres
Publié: (2025)
Adaptive Conformal Prediction for Improving Factuality of Generations by Large Language Models
par: Rubashevskii, Aleksandr, et autres
Publié: (2026)
par: Rubashevskii, Aleksandr, et autres
Publié: (2026)
HALF: Harm-Aware LLM Fairness Evaluation Aligned with Deployment
par: Mekky, Ali, et autres
Publié: (2025)
par: Mekky, Ali, et autres
Publié: (2025)
Cultural Benchmarking of LLMs in Standard and Dialectal Arabic Dialogues
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2026)
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2026)
Instruction-Guided Poetry Generation in Arabic and Its Dialects
par: Sadallah, Abdelrahman, et autres
Publié: (2026)
par: Sadallah, Abdelrahman, et autres
Publié: (2026)
NADI 2024: The Fifth Nuanced Arabic Dialect Identification Shared Task
par: Abdul-Mageed, Muhammad, et autres
Publié: (2024)
par: Abdul-Mageed, Muhammad, et autres
Publié: (2024)
On a Novel Application of Wasserstein-Procrustes for Unsupervised Cross-Lingual Learning
par: Ramírez, Guillem, et autres
Publié: (2020)
par: Ramírez, Guillem, et autres
Publié: (2020)
A Novel Dialect-Aware Framework for the Classification of Arabic Dialects and Emotions
par: Alsadhan, Nasser A
Publié: (2025)
par: Alsadhan, Nasser A
Publié: (2025)
Atlas-Chat: Adapting Large Language Models for Low-Resource Moroccan Arabic Dialect
par: Shang, Guokan, et autres
Publié: (2024)
par: Shang, Guokan, et autres
Publié: (2024)
DialectalArabicMMLU: Benchmarking Dialectal Capabilities in Arabic and Multilingual Language Models
par: Altakrori, Malik H., et autres
Publié: (2025)
par: Altakrori, Malik H., et autres
Publié: (2025)
To Label or Not to Label: Hybrid Active Learning for Neural Machine Translation
par: Azeemi, Abdul Hameed, et autres
Publié: (2024)
par: Azeemi, Abdul Hameed, et autres
Publié: (2024)
Pseudo-Label Calibration Semi-supervised Multi-Modal Entity Alignment
par: Wang, Luyao, et autres
Publié: (2024)
par: Wang, Luyao, et autres
Publié: (2024)
LLM Alignment for the Arabs: A Homogenous Culture or Diverse Ones?
par: Keleg, Amr
Publié: (2025)
par: Keleg, Amr
Publié: (2025)
DP-Fusion: Token-Level Differentially Private Inference for Large Language Models
par: Thareja, Rushil, et autres
Publié: (2025)
par: Thareja, Rushil, et autres
Publié: (2025)
PTCL: Pseudo-Label Temporal Curriculum Learning for Label-Limited Dynamic Graph
par: Zhang, Shengtao, et autres
Publié: (2025)
par: Zhang, Shengtao, et autres
Publié: (2025)
Leveraging Label Semantics and Meta-Label Refinement for Multi-Label Question Classification
par: Dong, Shi, et autres
Publié: (2024)
par: Dong, Shi, et autres
Publié: (2024)
Con Instruction: Universal Jailbreaking of Multimodal Large Language Models via Non-Textual Modalities
par: Geng, Jiahui, et autres
Publié: (2025)
par: Geng, Jiahui, et autres
Publié: (2025)
JEEM: Vision-Language Understanding in Four Arabic Dialects
par: Kadaoui, Karima, et autres
Publié: (2025)
par: Kadaoui, Karima, et autres
Publié: (2025)
Computational Linguistics Meets Libyan Dialect: A Study on Dialect Identification
par: Essgaer, Mansour, et autres
Publié: (2025)
par: Essgaer, Mansour, et autres
Publié: (2025)
Label-Efficient Model Selection for Text Generation
par: Ashury-Tahan, Shir, et autres
Publié: (2024)
par: Ashury-Tahan, Shir, et autres
Publié: (2024)
Don't Throw Away Your Beams: Improving Consistency-based Uncertainties in LLMs via Beam Search
par: Fadeeva, Ekaterina, et autres
Publié: (2025)
par: Fadeeva, Ekaterina, et autres
Publié: (2025)
Calibrate to Discriminate: Improve In-Context Learning with Label-Free Comparative Inference
par: Cheng, Wei, et autres
Publié: (2024)
par: Cheng, Wei, et autres
Publié: (2024)
Unsupervised ASR via Cross-Lingual Pseudo-Labeling
par: Likhomanenko, Tatiana, et autres
Publié: (2023)
par: Likhomanenko, Tatiana, et autres
Publié: (2023)
Profiling News Media for Factuality and Bias Using LLMs and the Fact-Checking Methodology of Human Experts
par: Mujahid, Zain Muhammad, et autres
Publié: (2025)
par: Mujahid, Zain Muhammad, et autres
Publié: (2025)
DialectGen: Benchmarking and Improving Dialect Robustness in Multimodal Generation
par: Zhou, Yu, et autres
Publié: (2025)
par: Zhou, Yu, et autres
Publié: (2025)
Can VLM Pseudo-Labels Train a Time-Series QA Model That Outperforms the VLM?
par: Fujimura, Takuya, et autres
Publié: (2025)
par: Fujimura, Takuya, et autres
Publié: (2025)
Label Smoothing Improves Gradient Ascent in LLM Unlearning
par: Pang, Zirui, et autres
Publié: (2025)
par: Pang, Zirui, et autres
Publié: (2025)
Combating Confirmation Bias: A Unified Pseudo-Labeling Framework for Entity Alignment
par: Ding, Qijie, et autres
Publié: (2023)
par: Ding, Qijie, et autres
Publié: (2023)
Sentiment Classification of Gaza War Headlines: A Comparative Analysis of Large Language Models and Arabic Fine-Tuned BERT Models
par: Eleraqi, Amr, et autres
Publié: (2026)
par: Eleraqi, Amr, et autres
Publié: (2026)
Instances and Labels: Hierarchy-aware Joint Supervised Contrastive Learning for Hierarchical Multi-Label Text Classification
par: Yu, Simon, et autres
Publié: (2023)
par: Yu, Simon, et autres
Publié: (2023)
SAHM: A Benchmark for Arabic Financial and Shari'ah-Compliant Reasoning
par: Elbadry, Rania, et autres
Publié: (2026)
par: Elbadry, Rania, et autres
Publié: (2026)
MGM: Global Understanding of Audience Overlap Graphs for Predicting the Factuality and the Bias of News Media
par: Manzoor, Muhammad Arslan, et autres
Publié: (2024)
par: Manzoor, Muhammad Arslan, et autres
Publié: (2024)
ICXML: An In-Context Learning Framework for Zero-Shot Extreme Multi-Label Classification
par: Zhu, Yaxin, et autres
Publié: (2023)
par: Zhu, Yaxin, et autres
Publié: (2023)
An Approach for Auto Generation of Labeling Functions for Software Engineering Chatbots
par: Alor, Ebube, et autres
Publié: (2024)
par: Alor, Ebube, et autres
Publié: (2024)
GenAI Content Detection Task 3: Cross-Domain Machine-Generated Text Detection Challenge
par: Dugan, Liam, et autres
Publié: (2025)
par: Dugan, Liam, et autres
Publié: (2025)
Documents similaires
-
Revisiting Common Assumptions about Arabic Dialects in NLP
par: Keleg, Amr, et autres
Publié: (2025) -
Nile-Chat: Egyptian Language Models for Arabic and Latin Scripts
par: Shang, Guokan, et autres
Publié: (2025) -
Estimating the Level of Dialectness Predicts Interannotator Agreement in Multi-dialect Arabic Datasets
par: Keleg, Amr, et autres
Publié: (2024) -
Saudi-Dialect-ALLaM: LoRA Fine-Tuning for Dialectal Arabic Generation
par: Barmandah, Hassan
Publié: (2025) -
ArFake: A Multi-Dialect Benchmark and Baselines for Arabic Spoof-Speech Detection
par: Maged, Mohamed, et autres
Publié: (2025)