Nile-Chat: Egyptian Language Models for Arabic and Latin Scripts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shang, Guokan, Abdine, Hadi, Chamma, Ahmad, Mohamed, Amr, Anwar, Mohamed, Bounhar, Abdelaziz, Herraoui, Omar El, Nakov, Preslav, Vazirgiannis, Michalis, Xing, Eric |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Shorter but not Worse: Frugal Reasoning via Easy Samples as Length Regularizers in Math RLVR
par: Bounhar, Abdelaziz, et autres
Publié: (2025)
par: Bounhar, Abdelaziz, et autres
Publié: (2025)
YaPO: Learnable Sparse Activation Steering Vectors for Domain Adaptation
par: Bounhar, Abdelaziz, et autres
Publié: (2026)
par: Bounhar, Abdelaziz, et autres
Publié: (2026)
Beyond Random Sampling: Efficient Language Model Pretraining via Curriculum Learning
par: Zhang, Yang, et autres
Publié: (2025)
par: Zhang, Yang, et autres
Publié: (2025)
Atlas-Chat: Adapting Large Language Models for Low-Resource Moroccan Arabic Dialect
par: Shang, Guokan, et autres
Publié: (2024)
par: Shang, Guokan, et autres
Publié: (2024)
MixtureKit: A General Framework for Composing, Training, and Visualizing Mixture-of-Experts Models
par: Chamma, Ahmad, et autres
Publié: (2025)
par: Chamma, Ahmad, et autres
Publié: (2025)
LLM as a Broken Telephone: Iterative Generation Distorts Information
par: Mohamed, Amr, et autres
Publié: (2025)
par: Mohamed, Amr, et autres
Publié: (2025)
Fast-Decoding Diffusion Language Models via Progress-Aware Confidence Schedules
par: Mohamed, Amr, et autres
Publié: (2025)
par: Mohamed, Amr, et autres
Publié: (2025)
Lost in the Mix: Evaluating LLM Understanding of Code-Switched Text
par: Mohamed, Amr, et autres
Publié: (2025)
par: Mohamed, Amr, et autres
Publié: (2025)
Markovian Generation Chains in Large Language Models
par: Geng, Mingmeng, et autres
Publié: (2026)
par: Geng, Mingmeng, et autres
Publié: (2026)
HALF: Harm-Aware LLM Fairness Evaluation Aligned with Deployment
par: Mekky, Ali, et autres
Publié: (2025)
par: Mekky, Ali, et autres
Publié: (2025)
Prot2Text: Multimodal Protein's Function Generation with GNNs and Transformers
par: Abdine, Hadi, et autres
Publié: (2023)
par: Abdine, Hadi, et autres
Publié: (2023)
Curriculum Learning and Pseudo-Labeling Improve the Generalization of Multi-Label Arabic Dialect Identification Models
par: Mekky, Ali, et autres
Publié: (2026)
par: Mekky, Ali, et autres
Publié: (2026)
Word Sense Induction with Hierarchical Clustering and Mutual Information Maximization
par: Abdine, Hadi, et autres
Publié: (2022)
par: Abdine, Hadi, et autres
Publié: (2022)
Graph Linearization Methods for Reasoning on Graphs with Large Language Models
par: Xypolopoulos, Christos, et autres
Publié: (2024)
par: Xypolopoulos, Christos, et autres
Publié: (2024)
The Curious Decline of Linguistic Diversity: Training Language Models on Synthetic Text
par: Guo, Yanzhu, et autres
Publié: (2023)
par: Guo, Yanzhu, et autres
Publié: (2023)
Leveraging Discourse Structure for Extractive Meeting Summarization
par: Rennard, Virgile, et autres
Publié: (2024)
par: Rennard, Virgile, et autres
Publié: (2024)
Cultural Benchmarking of LLMs in Standard and Dialectal Arabic Dialogues
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2026)
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2026)
Neural Graph Generator: Feature-Conditioned Graph Generation using Latent Diffusion Models
par: Evdaimon, Iakovos, et autres
Publié: (2024)
par: Evdaimon, Iakovos, et autres
Publié: (2024)
Prot2Text-V2: Protein Function Prediction with Multimodal Contrastive Alignment
par: Fei, Xiao, et autres
Publié: (2025)
par: Fei, Xiao, et autres
Publié: (2025)
Instruction-Guided Poetry Generation in Arabic and Its Dialects
par: Sadallah, Abdelrahman, et autres
Publié: (2026)
par: Sadallah, Abdelrahman, et autres
Publié: (2026)
Explaining Predictions by Characteristic Rules
par: Alkhatib, Amr, et autres
Publié: (2024)
par: Alkhatib, Amr, et autres
Publié: (2024)
Interpretable Graph Neural Networks for Tabular Data
par: Alkhatib, Amr, et autres
Publié: (2023)
par: Alkhatib, Amr, et autres
Publié: (2023)
Prediction via Shapley Value Regression
par: Alkhatib, Amr, et autres
Publié: (2025)
par: Alkhatib, Amr, et autres
Publié: (2025)
MuDRiC: Multi-Dialect Reasoning for Arabic Commonsense Validation
par: Elozeiri, Kareem, et autres
Publié: (2025)
par: Elozeiri, Kareem, et autres
Publié: (2025)
Arabic Dataset for LLM Safeguard Evaluation
par: Ashraf, Yasser, et autres
Publié: (2024)
par: Ashraf, Yasser, et autres
Publié: (2024)
Unveiling Covert Semantics: Joint Source-Channel Coding Under a Covertness Constraint
par: Bounhar, Abdelaziz, et autres
Publié: (2024)
par: Bounhar, Abdelaziz, et autres
Publié: (2024)
Covert Multi-Access Communication with a Non-Covert User
par: Bounhar, Abdelaziz, et autres
Publié: (2024)
par: Bounhar, Abdelaziz, et autres
Publié: (2024)
Whispering Secrets in a Crowd: Leveraging Non-Covert Users for Covert Communications
par: Bounhar, Abdelaziz, et autres
Publié: (2024)
par: Bounhar, Abdelaziz, et autres
Publié: (2024)
Distributed Detection under Stringent Resource Constraints
par: Bounhar, Abdelaziz, et autres
Publié: (2026)
par: Bounhar, Abdelaziz, et autres
Publié: (2026)
Beyond Traditional Single Object Tracking: A Survey
par: Abdelaziz, Omar, et autres
Publié: (2024)
par: Abdelaziz, Omar, et autres
Publié: (2024)
Bitcoin Research with a Transaction Graph Dataset
par: Schnoering, Hugo, et autres
Publié: (2024)
par: Schnoering, Hugo, et autres
Publié: (2024)
GreekMMLU: A Native-Sourced Multitask Benchmark for Evaluating Language Models in Greek
par: Zhang, Yang, et autres
Publié: (2026)
par: Zhang, Yang, et autres
Publié: (2026)
Outcomes and Survival of Egyptian Patients With Hepatitis B–Related Hepatocellular Carcinoma: A Multicentre Retrospective Study
par: Eman M. F. Barakat, et autres
Publié: (2026)
par: Eman M. F. Barakat, et autres
Publié: (2026)
A Novel Bounding Box Regression Method for Single Object Tracking
par: Abdelaziz, Omar, et autres
Publié: (2024)
par: Abdelaziz, Omar, et autres
Publié: (2024)
Enhancing Medical Support in the Arabic Language Through Personalized ChatGPT Assistance
par: Issa, Mohamed, et autres
Publié: (2024)
par: Issa, Mohamed, et autres
Publié: (2024)
The Animated Advertisement for Sports Electronic Games
par: Abdelaziz, Mohamed
Publié: (2015)
par: Abdelaziz, Mohamed
Publié: (2015)
What Do GNNs Actually Learn? Towards Understanding their Representations
par: Nikolentzos, Giannis, et autres
Publié: (2023)
par: Nikolentzos, Giannis, et autres
Publié: (2023)
Bias in the Mirror: Are LLMs opinions robust to their own adversarial attacks ?
par: Rennard, Virgile, et autres
Publié: (2024)
par: Rennard, Virgile, et autres
Publié: (2024)
Assessing the Efficacy of Heuristic-Based Address Clustering for Bitcoin
par: Schnoering, Hugo, et autres
Publié: (2024)
par: Schnoering, Hugo, et autres
Publié: (2024)
Graph Reasoning with Large Language Models via Pseudo-code Prompting
par: Skianis, Konstantinos, et autres
Publié: (2024)
par: Skianis, Konstantinos, et autres
Publié: (2024)
Documents similaires
-
Shorter but not Worse: Frugal Reasoning via Easy Samples as Length Regularizers in Math RLVR
par: Bounhar, Abdelaziz, et autres
Publié: (2025) -
YaPO: Learnable Sparse Activation Steering Vectors for Domain Adaptation
par: Bounhar, Abdelaziz, et autres
Publié: (2026) -
Beyond Random Sampling: Efficient Language Model Pretraining via Curriculum Learning
par: Zhang, Yang, et autres
Publié: (2025) -
Atlas-Chat: Adapting Large Language Models for Low-Resource Moroccan Arabic Dialect
par: Shang, Guokan, et autres
Publié: (2024) -
MixtureKit: A General Framework for Composing, Training, and Visualizing Mixture-of-Experts Models
par: Chamma, Ahmad, et autres
Publié: (2025)