LLM Probe: Evaluating LLMs for Low-Resource Languages
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Teklehaymanot, Hailay Kidu, Gebremariam, Gebrearegawi, Nejdl, Wolfgang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Low-Resource English-Tigrinya MT: Leveraging Multilingual Models, Custom Tokenizers, and Clean Evaluation Benchmarks
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025)
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025)
Tokenization Disparities as Infrastructure Bias: How Subword Systems Create Inequities in LLM Access and Efficiency
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025)
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025)
Morphological Synthesizer for Ge'ez Language: Addressing Morphological Complexity and Resource Limitations
par: Gebremariam, Gebrearegawi, et autres
Publié: (2025)
par: Gebremariam, Gebrearegawi, et autres
Publié: (2025)
MoVoC: Morphology-Aware Subword Construction for Geez Script Languages
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025)
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025)
LGSE: Lexically Grounded Subword Embedding Initialization for Low-Resource Language Adaptation
par: Teklehaymanot, Hailay, et autres
Publié: (2026)
par: Teklehaymanot, Hailay, et autres
Publié: (2026)
TIGQA:An Expert Annotated Question Answering Dataset in Tigrinya
par: Teklehaymanot, Hailay, et autres
Publié: (2024)
par: Teklehaymanot, Hailay, et autres
Publié: (2024)
Training-Induced Bias Toward LLM-Generated Content in Dense Retrieval
par: Xion, William, et autres
Publié: (2026)
par: Xion, William, et autres
Publié: (2026)
Towards Transparent Stance Detection: A Zero-Shot Approach Using Implicit and Explicit Interpretability
par: Upadhyaya, Apoorva, et autres
Publié: (2025)
par: Upadhyaya, Apoorva, et autres
Publié: (2025)
A Rigorous Evaluation of LLM Data Generation Strategies for Low-Resource Languages
par: Anikina, Tatiana, et autres
Publié: (2025)
par: Anikina, Tatiana, et autres
Publié: (2025)
Cross-Modal Rationale Transfer for Explainable Humanitarian Classification on Social Media
par: Nguyen, Thi Huyen, et autres
Publié: (2026)
par: Nguyen, Thi Huyen, et autres
Publié: (2026)
A Trio Neural Model for Dynamic Entity Relatedness Ranking
par: Nguyen, Tu, et autres
Publié: (2018)
par: Nguyen, Tu, et autres
Publié: (2018)
LLMs for Extremely Low-Resource Finno-Ugric Languages
par: Purason, Taido, et autres
Publié: (2024)
par: Purason, Taido, et autres
Publié: (2024)
Mind the Language Gap: Automated and Augmented Evaluation of Bias in LLMs for High- and Low-Resource Languages
par: Buscemi, Alessio, et autres
Publié: (2025)
par: Buscemi, Alessio, et autres
Publié: (2025)
RAGtifier: Evaluating RAG Generation Approaches of State-of-the-Art RAG Systems for the SIGIR LiveRAG Competition
par: Cofala, Tim, et autres
Publié: (2025)
par: Cofala, Tim, et autres
Publié: (2025)
Moral Reasoning Across Languages: The Critical Role of Low-Resource Languages in LLMs
par: Zhou, Huichi, et autres
Publié: (2025)
par: Zhou, Huichi, et autres
Publié: (2025)
Do LLMs Know What Luxembourgish Borrows? Probing Lexical Neology in Low-Resource Multilingual Models
par: Hosseini-Kivanani, Nina
Publié: (2026)
par: Hosseini-Kivanani, Nina
Publié: (2026)
On Limitations of LLM as Annotator for Low Resource Languages
par: Jadhav, Suramya, et autres
Publié: (2024)
par: Jadhav, Suramya, et autres
Publié: (2024)
CliniBench: A Clinical Outcome Prediction Benchmark for Generative and Encoder-Based Language Models
par: Grundmann, Paul, et autres
Publié: (2025)
par: Grundmann, Paul, et autres
Publié: (2025)
Better To Ask in English? Evaluating Factual Accuracy of Multilingual LLMs in English and Low-Resource Languages
par: Rohera, Pritika, et autres
Publié: (2025)
par: Rohera, Pritika, et autres
Publié: (2025)
Evaluating LLMs Robustness in Less Resourced Languages with Proxy Models
par: Chrabąszcz, Maciej, et autres
Publié: (2025)
par: Chrabąszcz, Maciej, et autres
Publié: (2025)
Mixture of Experts for Low-Resource LLMs
par: Joseph, Ori Bar, et autres
Publié: (2026)
par: Joseph, Ori Bar, et autres
Publié: (2026)
Transcending Language Boundaries: Harnessing LLMs for Low-Resource Language Translation
par: Shu, Peng, et autres
Publié: (2024)
par: Shu, Peng, et autres
Publié: (2024)
LLM-Assisted Rule Based Machine Translation for Low/No-Resource Languages
par: Coleman, Jared, et autres
Publié: (2024)
par: Coleman, Jared, et autres
Publié: (2024)
It's All About In-Context Learning! Teaching Extremely Low-Resource Languages to LLMs
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
Amharic LLaMA and LLaVA: Multimodal LLMs for Low Resource Languages
par: Andersland, Michael
Publié: (2024)
par: Andersland, Michael
Publié: (2024)
LLMs Are Few-Shot In-Context Low-Resource Language Learners
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
Toward Robust Multilingual Adaptation of LLMs for Low-Resource Languages
par: Li, Haolin, et autres
Publié: (2025)
par: Li, Haolin, et autres
Publié: (2025)
Konkani LLM: Multi-Script Instruction Tuning and Evaluation for a Low-Resource Indian Language
par: Fernandes, Reuben Chagas, et autres
Publié: (2026)
par: Fernandes, Reuben Chagas, et autres
Publié: (2026)
Testing Low-Resource Language Support in LLMs Using Language Proficiency Exams: the Case of Luxembourgish
par: Lothritz, Cedric, et autres
Publié: (2025)
par: Lothritz, Cedric, et autres
Publié: (2025)
How Good are LLMs at Relation Extraction under Low-Resource Scenario? Comprehensive Evaluation
par: Jinensibieke, Dawulie, et autres
Publié: (2024)
par: Jinensibieke, Dawulie, et autres
Publié: (2024)
Evaluating and Adapting Large Language Models to Represent Folktales in Low-Resource Languages
par: Meaney, JA, et autres
Publié: (2024)
par: Meaney, JA, et autres
Publié: (2024)
Typologically-Informed Candidate Reranking for LLM-based Translation into Low-Resource Languages
par: Abeykoon, Nipuna, et autres
Publié: (2026)
par: Abeykoon, Nipuna, et autres
Publié: (2026)
Toxicity Red-Teaming: Benchmarking LLM Safety in Singapore's Low-Resource Languages
par: Hu, Yujia, et autres
Publié: (2025)
par: Hu, Yujia, et autres
Publié: (2025)
Cost-Performance Optimization for Processing Low-Resource Language Tasks Using Commercial LLMs
par: Nag, Arijit, et autres
Publié: (2024)
par: Nag, Arijit, et autres
Publié: (2024)
From Scarcity to Capability: Empowering Fake News Detection in Low-Resource Languages with LLMs
par: Shibu, Hrithik Majumdar, et autres
Publié: (2025)
par: Shibu, Hrithik Majumdar, et autres
Publié: (2025)
Bridge-Coder: Unlocking LLMs' Potential to Overcome Language Gaps in Low-Resource Code
par: Zhang, Jipeng, et autres
Publié: (2024)
par: Zhang, Jipeng, et autres
Publié: (2024)
Evaluating LLM-Based Translation of a Low-Resource Technical Language: The Medical and Philosophical Greek of Galen
par: Zainaldin, James L., et autres
Publié: (2026)
par: Zainaldin, James L., et autres
Publié: (2026)
Beyond Accuracy: Investigating Error Types in GPT-4 Responses to USMLE Questions
par: Roy, Soumyadeep, et autres
Publié: (2024)
par: Roy, Soumyadeep, et autres
Publié: (2024)
LLM-Based Data Generation and Clinical Skills Evaluation for Low-Resource French OSCEs
par: Huang, Tian, et autres
Publié: (2026)
par: Huang, Tian, et autres
Publié: (2026)
LLMs for Translation: Historical, Low-Resourced Languages and Contemporary AI Models
par: Tekgurler, Merve
Publié: (2025)
par: Tekgurler, Merve
Publié: (2025)
Documents similaires
-
Low-Resource English-Tigrinya MT: Leveraging Multilingual Models, Custom Tokenizers, and Clean Evaluation Benchmarks
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025) -
Tokenization Disparities as Infrastructure Bias: How Subword Systems Create Inequities in LLM Access and Efficiency
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025) -
Morphological Synthesizer for Ge'ez Language: Addressing Morphological Complexity and Resource Limitations
par: Gebremariam, Gebrearegawi, et autres
Publié: (2025) -
MoVoC: Morphology-Aware Subword Construction for Geez Script Languages
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025) -
LGSE: Lexically Grounded Subword Embedding Initialization for Low-Resource Language Adaptation
par: Teklehaymanot, Hailay, et autres
Publié: (2026)