Sinhala Physical Common Sense Reasoning Dataset for Global PIQA
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | de Silva, Nisansa, Ranathunga, Surangika |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sinhala Transliteration: A Comparative Analysis Between Rule-based and Seq2Seq Approaches
par: De Mel, Yomal, et autres
Publié: (2024)
par: De Mel, Yomal, et autres
Publié: (2024)
SinLlama -- A Large Language Model for Sinhala
par: Aravinda, H. W. K., et autres
Publié: (2025)
par: Aravinda, H. W. K., et autres
Publié: (2025)
SiTSE: Sinhala Text Simplification Dataset and Evaluation
par: Ranathunga, Surangika, et autres
Publié: (2024)
par: Ranathunga, Surangika, et autres
Publié: (2024)
Shoulders of Giants: A Look at the Degree and Utility of Openness in NLP Research
par: Ranathunga, Surangika, et autres
Publié: (2024)
par: Ranathunga, Surangika, et autres
Publié: (2024)
Linguistic Analysis of Sinhala YouTube Comments on Sinhala Music Videos: A Dataset Study
par: De Mel, W. M. Yomal, et autres
Publié: (2025)
par: De Mel, W. M. Yomal, et autres
Publié: (2025)
Utilizing Multilingual Encoders to Improve Large Language Models for Low-Resource Languages
par: Puranegedara, Imalsha, et autres
Publié: (2025)
par: Puranegedara, Imalsha, et autres
Publié: (2025)
Survey on Publicly Available Sinhala Natural Language Processing Tools and Research
par: de Silva, Nisansa
Publié: (2019)
par: de Silva, Nisansa
Publié: (2019)
Sinhala-English Word Embedding Alignment: Introducing Datasets and Benchmark for a Low Resource Language
par: Wickramasinghe, Kasun, et autres
Publié: (2023)
par: Wickramasinghe, Kasun, et autres
Publié: (2023)
Improving the quality of Web-mined Parallel Corpora of Low-Resource Languages using Debiasing Heuristics
par: Fernando, Aloka, et autres
Publié: (2025)
par: Fernando, Aloka, et autres
Publié: (2025)
LMSpell: Neural Spell Checking for Low-Resource Languages
par: Gunathilake, Akesh, et autres
Publié: (2025)
par: Gunathilake, Akesh, et autres
Publié: (2025)
Quality Does Matter: A Detailed Look at the Quality and Utility of Web-Mined Parallel Corpora
par: Ranathunga, Surangika, et autres
Publié: (2024)
par: Ranathunga, Surangika, et autres
Publié: (2024)
SiDiaC: Sinhala Diachronic Corpus
par: Jayatilleke, Nevidu, et autres
Publié: (2025)
par: Jayatilleke, Nevidu, et autres
Publié: (2025)
A Multi-way Parallel Named Entity Annotated Corpus for English, Tamil and Sinhala
par: Ranathunga, Surangika, et autres
Publié: (2024)
par: Ranathunga, Surangika, et autres
Publié: (2024)
Zero-shot OCR Accuracy of Low-Resourced Languages: A Comparative Analysis on Sinhala and Tamil
par: Jayatilleke, Nevidu, et autres
Publié: (2025)
par: Jayatilleke, Nevidu, et autres
Publié: (2025)
Linguistic Entity Masking to Improve Cross-Lingual Representation of Multilingual Language Models for Low-Resource Languages
par: Fernando, Aloka, et autres
Publié: (2025)
par: Fernando, Aloka, et autres
Publié: (2025)
GeeSanBhava: Sentiment Tagged Sinhala Music Video Comment Data Set
par: De Mel, Yomal, et autres
Publié: (2025)
par: De Mel, Yomal, et autres
Publié: (2025)
Ko-PIQA: A Korean Physical Commonsense Reasoning Dataset with Cultural Context
par: Choi, Dasol, et autres
Publié: (2025)
par: Choi, Dasol, et autres
Publié: (2025)
Global PIQA: Evaluating Commonsense Reasoning Across 100+ Languages and Cultures
par: Chang, Tyler A., et autres
Publié: (2025)
par: Chang, Tyler A., et autres
Publié: (2025)
SiDiaC-v.2.0: Sinhala Diachronic Corpus Version 2.0
par: Jayatilleke, Nevidu, et autres
Publié: (2026)
par: Jayatilleke, Nevidu, et autres
Publié: (2026)
Large Language Models for Ingredient Substitution in Food Recipes using Supervised Fine-tuning and Direct Preference Optimization
par: Senath, Thevin, et autres
Publié: (2024)
par: Senath, Thevin, et autres
Publié: (2024)
Selecting Seed Words for Wordle using Character Statistics
par: de Silva, Nisansa
Publié: (2022)
par: de Silva, Nisansa
Publié: (2022)
Unsupervised Bilingual Lexicon Induction for Low Resource Languages
par: Rathnayake, Charitha, et autres
Publié: (2024)
par: Rathnayake, Charitha, et autres
Publié: (2024)
M2DS: Multilingual Dataset for Multi-document Summarisation
par: Hewapathirana, Kushan, et autres
Publié: (2024)
par: Hewapathirana, Kushan, et autres
Publié: (2024)
Beyond Vanilla Fine-Tuning: Leveraging Multistage, Multilingual, and Domain-Specific Methods for Low-Resource Machine Translation
par: Thillainathan, Sarubi, et autres
Publié: (2025)
par: Thillainathan, Sarubi, et autres
Publié: (2025)
SOLD: Sinhala Offensive Language Dataset
par: Ranasinghe, Tharindu, et autres
Publié: (2022)
par: Ranasinghe, Tharindu, et autres
Publié: (2022)
How Good is BLI as an Alignment Measure: A Study in Word Embedding Paradigm
par: Wickramasinghe, Kasun, et autres
Publié: (2025)
par: Wickramasinghe, Kasun, et autres
Publié: (2025)
Fine Tuning Named Entity Extraction Models for the Fantasy Domain
par: Sivaganeshan, Aravinth, et autres
Publié: (2024)
par: Sivaganeshan, Aravinth, et autres
Publié: (2024)
Extracting Disaster Impacts and Impact Related Locations in Social Media Posts Using Large Language Models
par: Hameed, Sameeah Noreen, et autres
Publié: (2025)
par: Hameed, Sameeah Noreen, et autres
Publié: (2025)
Unlocking Parameter-Efficient Fine-Tuning for Low-Resource Language Translation
par: Su, Tong, et autres
Publié: (2024)
par: Su, Tong, et autres
Publié: (2024)
SinhalaMMLU: A Comprehensive Benchmark for Evaluating Multitask Language Understanding in Sinhala
par: Pramodya, Ashmari, et autres
Publié: (2025)
par: Pramodya, Ashmari, et autres
Publié: (2025)
SinFoS: A Parallel Dataset for Translating Sinhala Figures of Speech
par: Sofalas, Johan, et autres
Publié: (2026)
par: Sofalas, Johan, et autres
Publié: (2026)
SHADE: Semantic Hypernym Annotator for Domain-specific Entities -- DnD Domain Use Case
par: Peiris, Akila, et autres
Publié: (2024)
par: Peiris, Akila, et autres
Publié: (2024)
Swa-bhasha Resource Hub: Romanized Sinhala to Sinhala Transliteration Systems and Data Resources
par: Sumanathilaka, Deshan, et autres
Publié: (2025)
par: Sumanathilaka, Deshan, et autres
Publié: (2025)
DESS: DeBERTa Enhanced Syntactic-Semantic Aspect Sentiment Triplet Extraction
par: Thenuwara, Vishal, et autres
Publié: (2025)
par: Thenuwara, Vishal, et autres
Publié: (2025)
A Framework to Assess Multilingual Vulnerabilities of LLMs
par: Tang, Likai, et autres
Publié: (2025)
par: Tang, Likai, et autres
Publié: (2025)
OasisSimp: An Open-source Asian-English Sentence Simplification Dataset
par: Liu, Hannah, et autres
Publié: (2026)
par: Liu, Hannah, et autres
Publié: (2026)
Common Sense Reasoning for Deepfake Detection
par: Zhang, Yue, et autres
Publié: (2024)
par: Zhang, Yue, et autres
Publié: (2024)
Swa Bhasha: Message-Based Singlish to Sinhala Transliteration
par: Athukorala, Maneesha U., et autres
Publié: (2024)
par: Athukorala, Maneesha U., et autres
Publié: (2024)
What the HellaSwag? On the Validity of Common-Sense Reasoning Benchmarks
par: Chizhov, Pavel, et autres
Publié: (2025)
par: Chizhov, Pavel, et autres
Publié: (2025)
Automating Research Synthesis with Domain-Specific Large Language Model Fine-Tuning
par: Susnjak, Teo, et autres
Publié: (2024)
par: Susnjak, Teo, et autres
Publié: (2024)
Documents similaires
-
Sinhala Transliteration: A Comparative Analysis Between Rule-based and Seq2Seq Approaches
par: De Mel, Yomal, et autres
Publié: (2024) -
SinLlama -- A Large Language Model for Sinhala
par: Aravinda, H. W. K., et autres
Publié: (2025) -
SiTSE: Sinhala Text Simplification Dataset and Evaluation
par: Ranathunga, Surangika, et autres
Publié: (2024) -
Shoulders of Giants: A Look at the Degree and Utility of Openness in NLP Research
par: Ranathunga, Surangika, et autres
Publié: (2024) -
Linguistic Analysis of Sinhala YouTube Comments on Sinhala Music Videos: A Dataset Study
par: De Mel, W. M. Yomal, et autres
Publié: (2025)