Multilingual European Language Models: Benchmarking Approaches and Challenges
Fuente:
arXiv
Salvato in:
| Autori principali: | Barth, Fabio, Rehm, Georg |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Are Multilingual Language Models an Off-ramp for Under-resourced Languages? Will we arrive at Digital Language Equality in Europe in 2030?
di: Rehm, Georg, et al.
Pubblicazione: (2025)
di: Rehm, Georg, et al.
Pubblicazione: (2025)
PISA-Bench: The PISA Index as a Multilingual and Multimodal Metric for the Evaluation of Vision-Language Models
di: Haller, Patrick, et al.
Pubblicazione: (2025)
di: Haller, Patrick, et al.
Pubblicazione: (2025)
Investigating Gender Bias in Turkish Language Models
di: Caglidil, Orhun Mersin, et al.
Pubblicazione: (2024)
di: Caglidil, Orhun Mersin, et al.
Pubblicazione: (2024)
Reward Modeling with Weak Supervision for Language Models
di: Hauptvogel, Ben, et al.
Pubblicazione: (2024)
di: Hauptvogel, Ben, et al.
Pubblicazione: (2024)
Towards Multilingual LLM Evaluation for European Languages
di: Thellmann, Klaudia, et al.
Pubblicazione: (2024)
di: Thellmann, Klaudia, et al.
Pubblicazione: (2024)
Symmetric Dot-Product Attention for Efficient Training of BERT Language Models
di: Courtois, Martin, et al.
Pubblicazione: (2024)
di: Courtois, Martin, et al.
Pubblicazione: (2024)
SciLaD: A Large-Scale, Transparent, Reproducible Dataset for Natural Scientific Language Processing
di: Foppiano, Luca, et al.
Pubblicazione: (2025)
di: Foppiano, Luca, et al.
Pubblicazione: (2025)
Table Understanding and (Multimodal) LLMs: A Cross-Domain Case Study on Scientific vs. Non-Scientific Data
di: Borisova, Ekaterina, et al.
Pubblicazione: (2025)
di: Borisova, Ekaterina, et al.
Pubblicazione: (2025)
HiStruct+: Improving Extractive Text Summarization with Hierarchical Structure Information
di: Ruan, Qian, et al.
Pubblicazione: (2022)
di: Ruan, Qian, et al.
Pubblicazione: (2022)
Weighted Cross-entropy for Low-Resource Languages in Multilingual Speech Recognition
di: Piñeiro-Martín, Andrés, et al.
Pubblicazione: (2024)
di: Piñeiro-Martín, Andrés, et al.
Pubblicazione: (2024)
Multilingual Jailbreak Challenges in Large Language Models
di: Deng, Yue, et al.
Pubblicazione: (2023)
di: Deng, Yue, et al.
Pubblicazione: (2023)
MastermindEval: A Simple But Scalable Reasoning Benchmark
di: Golde, Jonas, et al.
Pubblicazione: (2025)
di: Golde, Jonas, et al.
Pubblicazione: (2025)
CEAID: Benchmark of Multilingual Machine-Generated Text Detection Methods for Central European Languages
di: Macko, Dominik, et al.
Pubblicazione: (2025)
di: Macko, Dominik, et al.
Pubblicazione: (2025)
Entity Linking using LLMs for Automated Product Carbon Footprint Estimation
di: Castle, Steffen, et al.
Pubblicazione: (2025)
di: Castle, Steffen, et al.
Pubblicazione: (2025)
OMGEval: An Open Multilingual Generative Evaluation Benchmark for Large Language Models
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024)
di: Wei, Zihao, et al.
Pubblicazione: (2024)
How desirable is alignment between LLMs and linguistically diverse human users?
di: Knoeferle, Pia, et al.
Pubblicazione: (2025)
di: Knoeferle, Pia, et al.
Pubblicazione: (2025)
EuroBERT: Scaling Multilingual Encoders for European Languages
di: Boizard, Nicolas, et al.
Pubblicazione: (2025)
di: Boizard, Nicolas, et al.
Pubblicazione: (2025)
Challenging Multilingual LLMs: A New Taxonomy and Benchmark for Unraveling Hallucination in Translation
di: Wu, Xinwei, et al.
Pubblicazione: (2025)
di: Wu, Xinwei, et al.
Pubblicazione: (2025)
Multilingual Large Language Models and Curse of Multilinguality
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
An Efficient Approach for Studying Cross-Lingual Transfer in Multilingual Language Models
di: Faisal, Fahim, et al.
Pubblicazione: (2024)
di: Faisal, Fahim, et al.
Pubblicazione: (2024)
MultiFinBen: Benchmarking Large Language Models for Multilingual and Multimodal Financial Application
di: Peng, Xueqing, et al.
Pubblicazione: (2025)
di: Peng, Xueqing, et al.
Pubblicazione: (2025)
MMLU-ProX: A Multilingual Benchmark for Advanced Large Language Model Evaluation
di: Xuan, Weihao, et al.
Pubblicazione: (2025)
di: Xuan, Weihao, et al.
Pubblicazione: (2025)
MedExpQA: Multilingual Benchmarking of Large Language Models for Medical Question Answering
di: Alonso, Iñigo, et al.
Pubblicazione: (2024)
di: Alonso, Iñigo, et al.
Pubblicazione: (2024)
Multilingual Tokenization through the Lens of Indian Languages: Challenges and Insights
di: Karthika, N J, et al.
Pubblicazione: (2025)
di: Karthika, N J, et al.
Pubblicazione: (2025)
Pruning Multilingual Large Language Models for Multilingual Inference
di: Kim, Hwichan, et al.
Pubblicazione: (2024)
di: Kim, Hwichan, et al.
Pubblicazione: (2024)
ClimateCheck 2026: Scientific Fact-Checking and Disinformation Narrative Classification of Climate-related Claims
di: Ahmad, Raia Abu, et al.
Pubblicazione: (2026)
di: Ahmad, Raia Abu, et al.
Pubblicazione: (2026)
Improving Multilingual Retrieval-Augmented Language Models through Dialectic Reasoning Argumentations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
Poly-FEVER: A Multilingual Fact Verification Benchmark for Hallucination Detection in Large Language Models
di: Zhang, Hanzhi, et al.
Pubblicazione: (2025)
di: Zhang, Hanzhi, et al.
Pubblicazione: (2025)
Filipino Benchmarks for Measuring Sexist and Homophobic Bias in Multilingual Language Models from Southeast Asia
di: Gamboa, Lance Calvin Lim, et al.
Pubblicazione: (2024)
di: Gamboa, Lance Calvin Lim, et al.
Pubblicazione: (2024)
mHumanEval -- A Multilingual Benchmark to Evaluate Large Language Models for Code Generation
di: Raihan, Nishat, et al.
Pubblicazione: (2024)
di: Raihan, Nishat, et al.
Pubblicazione: (2024)
DRISHTIKON: A Multimodal Multilingual Benchmark for Testing Language Models' Understanding on Indian Culture
di: Maji, Arijit, et al.
Pubblicazione: (2025)
di: Maji, Arijit, et al.
Pubblicazione: (2025)
The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks
di: Pomerenke, David, et al.
Pubblicazione: (2025)
di: Pomerenke, David, et al.
Pubblicazione: (2025)
Contamination Report for Multilingual Benchmarks
di: Ahuja, Sanchit, et al.
Pubblicazione: (2024)
di: Ahuja, Sanchit, et al.
Pubblicazione: (2024)
Distilling Multilingual Vision-Language Models: When Smaller Models Stay Multilingual
di: Sriratanawilai, Sukrit, et al.
Pubblicazione: (2025)
di: Sriratanawilai, Sukrit, et al.
Pubblicazione: (2025)
DialectalArabicMMLU: Benchmarking Dialectal Capabilities in Arabic and Multilingual Language Models
di: Altakrori, Malik H., et al.
Pubblicazione: (2025)
di: Altakrori, Malik H., et al.
Pubblicazione: (2025)
LinguaSafe: A Comprehensive Multilingual Safety Benchmark for Large Language Models
di: Ning, Zhiyuan, et al.
Pubblicazione: (2025)
di: Ning, Zhiyuan, et al.
Pubblicazione: (2025)
META-NET Strategic Research Agenda for Multilingual Europe 2020
di: Georg Rehm
di: Georg Rehm
Language Surgery in Multilingual Large Language Models
di: Lopo, Joanito Agili, et al.
Pubblicazione: (2025)
di: Lopo, Joanito Agili, et al.
Pubblicazione: (2025)
Bielik 11B v3: Multilingual Large Language Model for European Languages
di: Ociepa, Krzysztof, et al.
Pubblicazione: (2025)
di: Ociepa, Krzysztof, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Are Multilingual Language Models an Off-ramp for Under-resourced Languages? Will we arrive at Digital Language Equality in Europe in 2030?
di: Rehm, Georg, et al.
Pubblicazione: (2025) -
PISA-Bench: The PISA Index as a Multilingual and Multimodal Metric for the Evaluation of Vision-Language Models
di: Haller, Patrick, et al.
Pubblicazione: (2025) -
Investigating Gender Bias in Turkish Language Models
di: Caglidil, Orhun Mersin, et al.
Pubblicazione: (2024) -
Reward Modeling with Weak Supervision for Language Models
di: Hauptvogel, Ben, et al.
Pubblicazione: (2024) -
Towards Multilingual LLM Evaluation for European Languages
di: Thellmann, Klaudia, et al.
Pubblicazione: (2024)