SiNFluD: Creating and Evaluating Figurative Language Dataset for Sindhi
Fuente:
arXiv
Saved in:
| Main Authors: | Ali, Wazir, Noor, Adeeb, Tumrani, Saifullah |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Enhancing Sindhi Word Segmentation using Subword Representation Learning and Position-aware Self-attention
by: Ali, Wazir, et al.
Published: (2020)
by: Ali, Wazir, et al.
Published: (2020)
An Evaluation of Sindhi Word Embedding in Semantic Analogies and Downstream Tasks
by: Ali, Wazir, et al.
Published: (2024)
by: Ali, Wazir, et al.
Published: (2024)
BioUNER: A Benchmark Dataset for Clinical Urdu Named Entity Recognition
by: Ali, Wazir, et al.
Published: (2026)
by: Ali, Wazir, et al.
Published: (2026)
SiLVERScore: Semantically-Aware Embeddings for Sign Language Generation Evaluation
by: Imai, Saki, et al.
Published: (2025)
by: Imai, Saki, et al.
Published: (2025)
ConSiDERS-The-Human Evaluation Framework: Rethinking Human Evaluation for Generative Large Language Models
by: Elangovan, Aparna, et al.
Published: (2024)
by: Elangovan, Aparna, et al.
Published: (2024)
Bridging the Data Gap: Creating a Hindi Text Summarization Dataset from the English XSUM
by: Katwe, Praveenkumar, et al.
Published: (2026)
by: Katwe, Praveenkumar, et al.
Published: (2026)
Evaluating Latent Knowledge of Public Tabular Datasets in Large Language Models
by: Silvestri, Matteo, et al.
Published: (2025)
by: Silvestri, Matteo, et al.
Published: (2025)
Benchmarking Large Language Models on CFLUE -- A Chinese Financial Language Understanding Evaluation Dataset
by: Zhu, Jie, et al.
Published: (2024)
by: Zhu, Jie, et al.
Published: (2024)
Crowdsource, Crawl, or Generate? Creating SEA-VL, a Multicultural Vision-Language Dataset for Southeast Asia
by: Cahyawijaya, Samuel, et al.
Published: (2025)
by: Cahyawijaya, Samuel, et al.
Published: (2025)
Past Meets Present: Creating Historical Analogy with Large Language Models
by: Li, Nianqi, et al.
Published: (2024)
by: Li, Nianqi, et al.
Published: (2024)
Can Language Models Analyze Data? Evaluating Large Language Models for Question Answering over Datasets
by: Xenofontos, Andreas, et al.
Published: (2026)
by: Xenofontos, Andreas, et al.
Published: (2026)
Evaluating the Quality of Benchmark Datasets for Low-Resource Languages: A Case Study on Turkish
by: Cengiz, Ayşe Aysu, et al.
Published: (2025)
by: Cengiz, Ayşe Aysu, et al.
Published: (2025)
The Heap: A Contamination-Free Multilingual Code Dataset for Evaluating Large Language Models
by: Katzy, Jonathan, et al.
Published: (2025)
by: Katzy, Jonathan, et al.
Published: (2025)
Meta-Cognitive Analysis: Evaluating Declarative and Procedural Knowledge in Datasets and Large Language Models
by: Li, Zhuoqun, et al.
Published: (2024)
by: Li, Zhuoqun, et al.
Published: (2024)
Can Large Language Models Create New Knowledge for Spatial Reasoning Tasks?
by: Greatrix, Thomas, et al.
Published: (2024)
by: Greatrix, Thomas, et al.
Published: (2024)
Creating a digital poet
by: Tohar, Vered, et al.
Published: (2026)
by: Tohar, Vered, et al.
Published: (2026)
SafetyPrompts: a Systematic Review of Open Datasets for Evaluating and Improving Large Language Model Safety
by: Röttger, Paul, et al.
Published: (2024)
by: Röttger, Paul, et al.
Published: (2024)
A Survey on Large Language Models from General Purpose to Medical Applications: Datasets, Methodologies, and Evaluations
by: Wang, Jinqiang, et al.
Published: (2024)
by: Wang, Jinqiang, et al.
Published: (2024)
NutriBench: A Dataset for Evaluating Large Language Models on Nutrition Estimation from Meal Descriptions
by: Hua, Andong, et al.
Published: (2024)
by: Hua, Andong, et al.
Published: (2024)
Development and Evaluation of a Retrieval-Augmented Generation Tool for Creating SAPPhIRE Models of Artificial Systems
by: Majumder, Anubhab, et al.
Published: (2024)
by: Majumder, Anubhab, et al.
Published: (2024)
A Survey of Large Language Models for European Languages
by: Ali, Wazir, et al.
Published: (2024)
by: Ali, Wazir, et al.
Published: (2024)
ParaNames 1.0: Creating an Entity Name Corpus for 400+ Languages using Wikidata
by: Sälevä, Jonne, et al.
Published: (2024)
by: Sälevä, Jonne, et al.
Published: (2024)
How Teachers Can Use Large Language Models and Bloom's Taxonomy to Create Educational Quizzes
by: Elkins, Sabina, et al.
Published: (2024)
by: Elkins, Sabina, et al.
Published: (2024)
MOSS-VoiceGenerator: Create Realistic Voices with Natural Language Descriptions
by: Huang, Kexin, et al.
Published: (2026)
by: Huang, Kexin, et al.
Published: (2026)
JETHICS: Japanese Ethics Understanding Evaluation Dataset
by: Takeshita, Masashi, et al.
Published: (2025)
by: Takeshita, Masashi, et al.
Published: (2025)
Empirical Evaluation of Public HateSpeech Datasets
by: Jaf, Sadar, et al.
Published: (2024)
by: Jaf, Sadar, et al.
Published: (2024)
EuropeMedQA Study Protocol: A Multilingual, Multimodal Medical Examination Dataset for Language Model Evaluation
by: Causio, Francesco Andrea, et al.
Published: (2026)
by: Causio, Francesco Andrea, et al.
Published: (2026)
Zero-Shot Commonsense Validation and Reasoning with Large Language Models: An Evaluation on SemEval-2020 Task 4 Dataset
by: Alfugaha, Rawand, et al.
Published: (2025)
by: Alfugaha, Rawand, et al.
Published: (2025)
A Survey of Pun Generation: Datasets, Evaluations and Methodologies
by: Su, Yuchen, et al.
Published: (2025)
by: Su, Yuchen, et al.
Published: (2025)
Creating and Evaluating Code-Mixed Nepali-English and Telugu-English Datasets for Abusive Language Detection Using Traditional and Deep Learning Models
by: Pandey, Manish, et al.
Published: (2025)
by: Pandey, Manish, et al.
Published: (2025)
Creating an AI Observer: Generative Semantic Workspaces
by: Holur, Pavan, et al.
Published: (2024)
by: Holur, Pavan, et al.
Published: (2024)
Using Generative Text Models to Create Qualitative Codebooks for Student Evaluations of Teaching
by: Katz, Andrew, et al.
Published: (2024)
by: Katz, Andrew, et al.
Published: (2024)
TruthEval: A Dataset to Evaluate LLM Truthfulness and Reliability
by: Khatun, Aisha, et al.
Published: (2024)
by: Khatun, Aisha, et al.
Published: (2024)
Datasets for Large Language Models: A Comprehensive Survey
by: Liu, Yang, et al.
Published: (2024)
by: Liu, Yang, et al.
Published: (2024)
Generative Ontology: When Structured Knowledge Learns to Create
by: Cheung, Benny
Published: (2026)
by: Cheung, Benny
Published: (2026)
Evaluating Language Models' Evaluations of Games
by: Collins, Katherine M., et al.
Published: (2025)
by: Collins, Katherine M., et al.
Published: (2025)
LitBench: A Benchmark and Dataset for Reliable Evaluation of Creative Writing
by: Fein, Daniel, et al.
Published: (2025)
by: Fein, Daniel, et al.
Published: (2025)
How Much Data is Enough Data? Fine-Tuning Large Language Models for In-House Translation: Performance Evaluation Across Multiple Dataset Sizes
by: Vieira, Inacio, et al.
Published: (2024)
by: Vieira, Inacio, et al.
Published: (2024)
iLSU-T: an Open Dataset for Uruguayan Sign Language Translation
by: Stassi, Ariel E., et al.
Published: (2025)
by: Stassi, Ariel E., et al.
Published: (2025)
Zyda: A 1.3T Dataset for Open Language Modeling
by: Tokpanov, Yury, et al.
Published: (2024)
by: Tokpanov, Yury, et al.
Published: (2024)
Similar Items
-
Enhancing Sindhi Word Segmentation using Subword Representation Learning and Position-aware Self-attention
by: Ali, Wazir, et al.
Published: (2020) -
An Evaluation of Sindhi Word Embedding in Semantic Analogies and Downstream Tasks
by: Ali, Wazir, et al.
Published: (2024) -
BioUNER: A Benchmark Dataset for Clinical Urdu Named Entity Recognition
by: Ali, Wazir, et al.
Published: (2026) -
SiLVERScore: Semantically-Aware Embeddings for Sign Language Generation Evaluation
by: Imai, Saki, et al.
Published: (2025) -
ConSiDERS-The-Human Evaluation Framework: Rethinking Human Evaluation for Generative Large Language Models
by: Elangovan, Aparna, et al.
Published: (2024)