SinhalaMMLU: A Comprehensive Benchmark for Evaluating Multitask Language Understanding in Sinhala
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pramodya, Ashmari, Nelki, Nirasha, Shalinda, Heshan, Liyanage, Chamila, Sakai, Yusuke, Pushpananda, Randil, Weerasinghe, Ruvan, Kamigaito, Hidetaka, Watanabe, Taro |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Script Sensitivity: Benchmarking Language Models on Unicode, Romanized and Mixed-Script Sinhala
par: Rajapakse, Minuri, et autres
Publié: (2026)
par: Rajapakse, Minuri, et autres
Publié: (2026)
SinFoS: A Parallel Dataset for Translating Sinhala Figures of Speech
par: Sofalas, Johan, et autres
Publié: (2026)
par: Sofalas, Johan, et autres
Publié: (2026)
Swa-bhasha Resource Hub: Romanized Sinhala to Sinhala Transliteration Systems and Data Resources
par: Sumanathilaka, Deshan, et autres
Publié: (2025)
par: Sumanathilaka, Deshan, et autres
Publié: (2025)
Revisiting Compositional Generalization Capability of Large Language Models Considering Instruction Following Ability
par: Sakai, Yusuke, et autres
Publié: (2025)
par: Sakai, Yusuke, et autres
Publié: (2025)
HalluCitation Matters: Revealing the Impact of Hallucinated References with 300 Hallucinated Papers in ACL Conferences
par: Sakai, Yusuke, et autres
Publié: (2026)
par: Sakai, Yusuke, et autres
Publié: (2026)
HalluCiteChecker: A Lightweight Toolkit for Hallucinated Citation Detection and Verification in the Era of AI Scientists
par: Sakai, Yusuke, et autres
Publié: (2026)
par: Sakai, Yusuke, et autres
Publié: (2026)
mCSQA: Multilingual Commonsense Reasoning Dataset with Unified Creation Strategy by Language Models and Humans
par: Sakai, Yusuke, et autres
Publié: (2024)
par: Sakai, Yusuke, et autres
Publié: (2024)
Tonguescape: Exploring Language Models Understanding of Vowel Articulation
par: Sakajo, Haruki, et autres
Publié: (2025)
par: Sakajo, Haruki, et autres
Publié: (2025)
Does Pre-trained Language Model Actually Infer Unseen Links in Knowledge Graph Completion?
par: Sakai, Yusuke, et autres
Publié: (2023)
par: Sakai, Yusuke, et autres
Publié: (2023)
Multilinguality of Large Language Models From a Structural Perspective
par: Sakajo, Haruki, et autres
Publié: (2026)
par: Sakajo, Haruki, et autres
Publié: (2026)
Simultaneous Interpretation Corpus Construction by Large Language Models in Distant Language Pair
par: Sakai, Yusuke, et autres
Publié: (2024)
par: Sakai, Yusuke, et autres
Publié: (2024)
mbrs: A Library for Minimum Bayes Risk Decoding
par: Deguchi, Hiroyuki, et autres
Publié: (2024)
par: Deguchi, Hiroyuki, et autres
Publié: (2024)
Diagnosing Vision Language Models' Perception by Leveraging Human Methods for Color Vision Deficiencies
par: Hayashi, Kazuki, et autres
Publié: (2025)
par: Hayashi, Kazuki, et autres
Publié: (2025)
Agreement-Constrained Probabilistic Minimum Bayes Risk Decoding
par: Natsumi, Koki, et autres
Publié: (2025)
par: Natsumi, Koki, et autres
Publié: (2025)
Toward the Evaluation of Large Language Models Considering Score Variance across Instruction Templates
par: Sakai, Yusuke, et autres
Publié: (2024)
par: Sakai, Yusuke, et autres
Publié: (2024)
Diversity Explains Inference Scaling Laws: Through a Case Study of Minimum Bayes Risk Decoding
par: Kamigaito, Hidetaka, et autres
Publié: (2024)
par: Kamigaito, Hidetaka, et autres
Publié: (2024)
Towards Artwork Explanation in Large-scale Vision Language Models
par: Hayashi, Kazuki, et autres
Publié: (2024)
par: Hayashi, Kazuki, et autres
Publié: (2024)
StructLens: A Structural Lens for Language Models via Maximum Spanning Trees
par: Sakajo, Haruki, et autres
Publié: (2026)
par: Sakajo, Haruki, et autres
Publié: (2026)
Subasa - Adapting Language Models for Low-resourced Offensive Language Detection in Sinhala
par: Haturusinghe, Shanilka, et autres
Publié: (2025)
par: Haturusinghe, Shanilka, et autres
Publié: (2025)
Linguistic Analysis of Sinhala YouTube Comments on Sinhala Music Videos: A Dataset Study
par: De Mel, W. M. Yomal, et autres
Publié: (2025)
par: De Mel, W. M. Yomal, et autres
Publié: (2025)
BQA: Body Language Question Answering Dataset for Video Large Language Models
par: Ozaki, Shintaro, et autres
Publié: (2024)
par: Ozaki, Shintaro, et autres
Publié: (2024)
Towards Cross-Lingual Explanation of Artwork in Large-scale Vision Language Models
par: Ozaki, Shintaro, et autres
Publié: (2024)
par: Ozaki, Shintaro, et autres
Publié: (2024)
Centroid-Based Efficient Minimum Bayes Risk Decoding
par: Deguchi, Hiroyuki, et autres
Publié: (2024)
par: Deguchi, Hiroyuki, et autres
Publié: (2024)
Are Data Augmentation Methods in Named Entity Recognition Applicable for Uncertainty Estimation?
par: Hashimoto, Wataru, et autres
Publié: (2024)
par: Hashimoto, Wataru, et autres
Publié: (2024)
Do LLMs Implicitly Determine the Suitable Text Difficulty for Users?
par: Gobara, Seiji, et autres
Publié: (2024)
par: Gobara, Seiji, et autres
Publié: (2024)
Efficient Nearest Neighbor based Uncertainty Estimation for Natural Language Processing Tasks
par: Hashimoto, Wataru, et autres
Publié: (2024)
par: Hashimoto, Wataru, et autres
Publié: (2024)
Decoding Uncertainty: The Impact of Decoding Strategies for Uncertainty Estimation in Large Language Models
par: Hashimoto, Wataru, et autres
Publié: (2025)
par: Hashimoto, Wataru, et autres
Publié: (2025)
Attention Score is not All You Need for Token Importance Indicator in KV Cache Reduction: Value Also Matters
par: Guo, Zhiyu, et autres
Publié: (2024)
par: Guo, Zhiyu, et autres
Publié: (2024)
sEMG of Sinhala handwritten characters
par: Seneviratne, Bathiya, et autres
Publié: (2026)
par: Seneviratne, Bathiya, et autres
Publié: (2026)
SOLD: Sinhala Offensive Language Dataset
par: Ranasinghe, Tharindu, et autres
Publié: (2022)
par: Ranasinghe, Tharindu, et autres
Publié: (2022)
NSINA: A News Corpus for Sinhala
par: Hettiarachchi, Hansi, et autres
Publié: (2024)
par: Hettiarachchi, Hansi, et autres
Publié: (2024)
How to Make the Most of LLMs' Grammatical Knowledge for Acceptability Judgments
par: Ide, Yusuke, et autres
Publié: (2024)
par: Ide, Yusuke, et autres
Publié: (2024)
Dictionaries to the Rescue: Cross-Lingual Vocabulary Transfer for Low-Resource Languages Using Bilingual Dictionaries
par: Sakajo, Haruki, et autres
Publié: (2025)
par: Sakajo, Haruki, et autres
Publié: (2025)
CArtBench: Evaluating Vision-Language Models on Chinese Art Understanding, Interpretation, and Authenticity
par: Wei, Xuefeng, et autres
Publié: (2026)
par: Wei, Xuefeng, et autres
Publié: (2026)
Enhancing Factuality through Consensus and Consistency in Summarization Using Minimum Bayes Risk Decoding
par: Soetedjo, Riza Setiawan, et autres
Publié: (2026)
par: Soetedjo, Riza Setiawan, et autres
Publié: (2026)
A Hybrid Architecture with Efficient Fine Tuning for Abstractive Patent Document Summarization
par: Jayatilleke, Nevidu, et autres
Publié: (2025)
par: Jayatilleke, Nevidu, et autres
Publié: (2025)
SiDiaC: Sinhala Diachronic Corpus
par: Jayatilleke, Nevidu, et autres
Publié: (2025)
par: Jayatilleke, Nevidu, et autres
Publié: (2025)
Context-Aware Machine Translation with Source Coreference Explanation
par: Vu, Huy Hien, et autres
Publié: (2024)
par: Vu, Huy Hien, et autres
Publié: (2024)
SinLlama -- A Large Language Model for Sinhala
par: Aravinda, H. W. K., et autres
Publié: (2025)
par: Aravinda, H. W. K., et autres
Publié: (2025)
Swa Bhasha: Message-Based Singlish to Sinhala Transliteration
par: Athukorala, Maneesha U., et autres
Publié: (2024)
par: Athukorala, Maneesha U., et autres
Publié: (2024)
Documents similaires
-
Script Sensitivity: Benchmarking Language Models on Unicode, Romanized and Mixed-Script Sinhala
par: Rajapakse, Minuri, et autres
Publié: (2026) -
SinFoS: A Parallel Dataset for Translating Sinhala Figures of Speech
par: Sofalas, Johan, et autres
Publié: (2026) -
Swa-bhasha Resource Hub: Romanized Sinhala to Sinhala Transliteration Systems and Data Resources
par: Sumanathilaka, Deshan, et autres
Publié: (2025) -
Revisiting Compositional Generalization Capability of Large Language Models Considering Instruction Following Ability
par: Sakai, Yusuke, et autres
Publié: (2025) -
HalluCitation Matters: Revealing the Impact of Hallucinated References with 300 Hallucinated Papers in ACL Conferences
par: Sakai, Yusuke, et autres
Publié: (2026)