TurkishMMLU: Measuring Massive Multitask Language Understanding in Turkish
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yüksel, Arda, Köksal, Abdullatif, Şenel, Lütfi Kerem, Korhonen, Anna, Schütze, Hinrich |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LongForm: Effective Instruction Tuning with Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2023)
par: Köksal, Abdullatif, et autres
Publié: (2023)
How far can bias go? Tracing bias from pretraining data to alignment
par: Thaler, Marion, et autres
Publié: (2024)
par: Thaler, Marion, et autres
Publié: (2024)
Consistent Document-Level Relation Extraction via Counterfactuals
par: Modarressi, Ali, et autres
Publié: (2024)
par: Modarressi, Ali, et autres
Publié: (2024)
Hybrid Human-LLM Corpus Construction and LLM Evaluation for Rare Linguistic Phenomena
par: Weissweiler, Leonie, et autres
Publié: (2024)
par: Weissweiler, Leonie, et autres
Publié: (2024)
MURI: High-Quality Instruction Tuning Datasets for Low-Resource Languages via Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2024)
par: Köksal, Abdullatif, et autres
Publié: (2024)
SYNTHEVAL: Hybrid Behavioral Testing of NLP Models with Synthetic CheckLists
par: Zhao, Raoyuan, et autres
Publié: (2024)
par: Zhao, Raoyuan, et autres
Publié: (2024)
BnMMLU: Measuring Massive Multitask Language Understanding in Bengali
par: Joy, Saman Sarker, et autres
Publié: (2025)
par: Joy, Saman Sarker, et autres
Publié: (2025)
ArabicMMLU: Assessing Massive Multitask Language Understanding in Arabic
par: Koto, Fajri, et autres
Publié: (2024)
par: Koto, Fajri, et autres
Publié: (2024)
CRAFT Your Dataset: Task-Specific Synthetic Dataset Generation Through Corpus Retrieval and Augmentation
par: Ziegler, Ingo, et autres
Publié: (2024)
par: Ziegler, Ingo, et autres
Publié: (2024)
Setting Standards in Turkish NLP: TR-MMLU for Large Language Model Evaluation
par: Bayram, M. Ali, et autres
Publié: (2024)
par: Bayram, M. Ali, et autres
Publié: (2024)
MemLLM: Finetuning LLMs to Use An Explicit Read-Write Memory
par: Modarressi, Ali, et autres
Publié: (2024)
par: Modarressi, Ali, et autres
Publié: (2024)
Do We Know What LLMs Don't Know? A Study of Consistency in Knowledge Probing
par: Zhao, Raoyuan, et autres
Publié: (2025)
par: Zhao, Raoyuan, et autres
Publié: (2025)
Benchmarking Procedural Language Understanding for Low-Resource Languages: A Case Study on Turkish
par: Uzunoglu, Arda, et autres
Publié: (2023)
par: Uzunoglu, Arda, et autres
Publié: (2023)
Turkronicles: Diachronic Resources for the Fast Evolving Turkish Language
par: Yazar, Togay, et autres
Publié: (2024)
par: Yazar, Togay, et autres
Publié: (2024)
SinhalaMMLU: A Comprehensive Benchmark for Evaluating Multitask Language Understanding in Sinhala
par: Pramodya, Ashmari, et autres
Publié: (2025)
par: Pramodya, Ashmari, et autres
Publié: (2025)
KMMLU: Measuring Massive Multitask Language Understanding in Korean
par: Son, Guijin, et autres
Publié: (2024)
par: Son, Guijin, et autres
Publié: (2024)
Turkish Delights: a Dataset on Turkish Euphemisms
par: Biyik, Hasan Can, et autres
Publié: (2024)
par: Biyik, Hasan Can, et autres
Publié: (2024)
A Comprehensive Analysis of Static Word Embeddings for Turkish
par: Sarıtaş, Karahan, et autres
Publié: (2024)
par: Sarıtaş, Karahan, et autres
Publié: (2024)
Mechanistic Understanding and Mitigation of Language Confusion in English-Centric Large Language Models
par: Nie, Ercong, et autres
Publié: (2025)
par: Nie, Ercong, et autres
Publié: (2025)
GKnow: Measuring the Entanglement of Gender Bias and Factual Gender
par: Veloso, Leonor, et autres
Publié: (2026)
par: Veloso, Leonor, et autres
Publié: (2026)
Measuring Massive Multitask Chinese Understanding
par: Zeng, Hui
Publié: (2023)
par: Zeng, Hui
Publié: (2023)
Understanding Gated Neurons in Transformers from Their Input-Output Functionality
par: Gerstner, Sebastian, et autres
Publié: (2025)
par: Gerstner, Sebastian, et autres
Publié: (2025)
GreekMMLU: A Native-Sourced Multitask Benchmark for Evaluating Language Models in Greek
par: Zhang, Yang, et autres
Publié: (2026)
par: Zhang, Yang, et autres
Publié: (2026)
MaLA-500: Massive Language Adaptation of Large Language Models
par: Lin, Peiqin, et autres
Publié: (2024)
par: Lin, Peiqin, et autres
Publié: (2024)
GLUScope: A Tool for Analyzing GLU Neurons in Transformer Language Models
par: Gerstner, Sebastian, et autres
Publié: (2026)
par: Gerstner, Sebastian, et autres
Publié: (2026)
Fine-tuning Transformer-based Encoder for Turkish Language Understanding Tasks
par: Yildirim, Savas
Publié: (2024)
par: Yildirim, Savas
Publié: (2024)
Investigating Gender Bias in Turkish Language Models
par: Caglidil, Orhun Mersin, et autres
Publié: (2024)
par: Caglidil, Orhun Mersin, et autres
Publié: (2024)
Turkish Native Language Identification V2
par: Uluslu, Ahmet Yavuz, et autres
Publié: (2023)
par: Uluslu, Ahmet Yavuz, et autres
Publié: (2023)
Evaluating Contextually Mediated Factual Recall in Multilingual Large Language Models
par: Liu, Yihong, et autres
Publié: (2026)
par: Liu, Yihong, et autres
Publié: (2026)
Understanding In-Context Machine Translation for Low-Resource Languages: A Case Study on Manchu
par: Pei, Renhao, et autres
Publié: (2025)
par: Pei, Renhao, et autres
Publié: (2025)
Breaking the Script Barrier in Multilingual Pre-Trained Language Models with Transliteration-Based Post-Training Alignment
par: Xhelili, Orgest, et autres
Publié: (2024)
par: Xhelili, Orgest, et autres
Publié: (2024)
Automatic Lexical Simplification for Turkish
par: Uluslu, Ahmet Yavuz
Publié: (2022)
par: Uluslu, Ahmet Yavuz
Publié: (2022)
Mobile-MMLU: A Mobile Intelligence Language Understanding Benchmark
par: Bsharat, Sondos Mahmoud, et autres
Publié: (2025)
par: Bsharat, Sondos Mahmoud, et autres
Publié: (2025)
MaskLID: Code-Switching Language Identification through Iterative Masking
par: Kargaran, Amir Hossein, et autres
Publié: (2024)
par: Kargaran, Amir Hossein, et autres
Publié: (2024)
A Recipe of Parallel Corpora Exploitation for Multilingual Large Language Models
par: Lin, Peiqin, et autres
Publié: (2024)
par: Lin, Peiqin, et autres
Publié: (2024)
Your Pretrained Model Tells the Difficulty Itself: A Self-Adaptive Curriculum Learning Paradigm for Natural Language Understanding
par: Feng, Qi, et autres
Publié: (2025)
par: Feng, Qi, et autres
Publié: (2025)
Generative Explore-Exploit: Training-free Optimization of Generative Recommender Systems using LLM Optimizers
par: Senel, Lütfi Kerem, et autres
Publié: (2024)
par: Senel, Lütfi Kerem, et autres
Publié: (2024)
TURNA: A Turkish Encoder-Decoder Language Model for Enhanced Understanding and Generation
par: Uludoğan, Gökçe, et autres
Publié: (2024)
par: Uludoğan, Gökçe, et autres
Publié: (2024)
Leveraging LLMs For Turkish Skill Extraction
par: İltüzer, Ezgi Arslan, et autres
Publié: (2026)
par: İltüzer, Ezgi Arslan, et autres
Publié: (2026)
SLAyiNG: Towards Queer Language Processing
par: Veloso, Leonor, et autres
Publié: (2025)
par: Veloso, Leonor, et autres
Publié: (2025)
Documents similaires
-
LongForm: Effective Instruction Tuning with Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2023) -
How far can bias go? Tracing bias from pretraining data to alignment
par: Thaler, Marion, et autres
Publié: (2024) -
Consistent Document-Level Relation Extraction via Counterfactuals
par: Modarressi, Ali, et autres
Publié: (2024) -
Hybrid Human-LLM Corpus Construction and LLM Evaluation for Rare Linguistic Phenomena
par: Weissweiler, Leonie, et autres
Publié: (2024) -
MURI: High-Quality Instruction Tuning Datasets for Low-Resource Languages via Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2024)