SOLD: Sinhala Offensive Language Dataset
Fuente:
arXiv
Saved in:
| Main Authors: | Ranasinghe, Tharindu, Anuradha, Isuri, Premasiri, Damith, Silva, Kanishka, Hettiarachchi, Hansi, Uyangodage, Lasitha, Zampieri, Marcos |
|---|---|
| Format: | Preprint |
| Published: |
2022
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
NSINA: A News Corpus for Sinhala
by: Hettiarachchi, Hansi, et al.
Published: (2024)
by: Hettiarachchi, Hansi, et al.
Published: (2024)
Overview of the First Workshop on Language Models for Low-Resource Languages (LoResLM 2025)
by: Hettiarachchi, Hansi, et al.
Published: (2024)
by: Hettiarachchi, Hansi, et al.
Published: (2024)
A Federated Learning Approach to Privacy Preserving Offensive Language Identification
by: Zampieri, Marcos, et al.
Published: (2024)
by: Zampieri, Marcos, et al.
Published: (2024)
Towards Generalized Offensive Language Identification
by: Dmonte, Alphaeus, et al.
Published: (2024)
by: Dmonte, Alphaeus, et al.
Published: (2024)
LLM-based Embedders for Prior Case Retrieval
by: Premasiri, Damith, et al.
Published: (2025)
by: Premasiri, Damith, et al.
Published: (2025)
ALEXSIS-PT: A New Resource for Portuguese Lexical Simplification
by: North, Kai, et al.
Published: (2022)
by: North, Kai, et al.
Published: (2022)
AHaSIS: Shared Task on Sentiment Analysis for Arabic Dialects
by: Alharbi, Maram, et al.
Published: (2025)
by: Alharbi, Maram, et al.
Published: (2025)
MultiLS: A Multi-task Lexical Simplification Framework
by: North, Kai, et al.
Published: (2024)
by: North, Kai, et al.
Published: (2024)
Subasa - Adapting Language Models for Low-resourced Offensive Language Detection in Sinhala
by: Haturusinghe, Shanilka, et al.
Published: (2025)
by: Haturusinghe, Shanilka, et al.
Published: (2025)
Exploring the Performance of Large Language Models on Subjective Span Identification Tasks
by: Dmonte, Alphaeus, et al.
Published: (2026)
by: Dmonte, Alphaeus, et al.
Published: (2026)
HateCOT: An Explanation-Enhanced Dataset for Generalizable Offensive Speech Detection via Large Language Models
by: Nghiem, Huy, et al.
Published: (2024)
by: Nghiem, Huy, et al.
Published: (2024)
A Neuro-Symbolic Multi-Agent Approach to Legal-Cybersecurity Knowledge Integration
by: Bonfanti, Chiara, et al.
Published: (2025)
by: Bonfanti, Chiara, et al.
Published: (2025)
MUNIChus: Multilingual News Image Captioning Benchmark
by: Chen, Yuji, et al.
Published: (2026)
by: Chen, Yuji, et al.
Published: (2026)
Do LLMs Judge Distantly Supervised Named Entity Labels Well? Constructing the JudgeWEL Dataset
by: Plum, Alistair, et al.
Published: (2026)
by: Plum, Alistair, et al.
Published: (2026)
Vicarious Offense and Noise Audit of Offensive Speech Classifiers: Unifying Human and Machine Disagreement on What is Offensive
by: Weerasooriya, Tharindu Cyril, et al.
Published: (2023)
by: Weerasooriya, Tharindu Cyril, et al.
Published: (2023)
WebFAQ: A Multilingual Collection of Natural Q&A Datasets for Dense Retrieval
by: Dinzinger, Michael, et al.
Published: (2025)
by: Dinzinger, Michael, et al.
Published: (2025)
Human Mobility Datasets Enriched With Contextual and Social Dimensions
by: Pugliese, Chiara, et al.
Published: (2025)
by: Pugliese, Chiara, et al.
Published: (2025)
The Uli Dataset: An Exercise in Experience Led Annotation of oGBV
by: Arora, Arnav, et al.
Published: (2023)
by: Arora, Arnav, et al.
Published: (2023)
WOLI at SemEval-2020 Task 12: Arabic Offensive Language Identification on Different Twitter Datasets
by: Otiefy, Yasser, et al.
Published: (2020)
by: Otiefy, Yasser, et al.
Published: (2020)
CoSearch: Joint Training of Reasoning and Document Ranking via Reinforcement Learning for Agentic Search
by: Zeng, Hansi, et al.
Published: (2026)
by: Zeng, Hansi, et al.
Published: (2026)
Creating and Evaluating Code-Mixed Nepali-English and Telugu-English Datasets for Abusive Language Detection Using Traditional and Deep Learning Models
by: Pandey, Manish, et al.
Published: (2025)
by: Pandey, Manish, et al.
Published: (2025)
Understanding Sarcoidosis Using Large Language Models and Social Media Data
by: Xi, Nan Miles, et al.
Published: (2024)
by: Xi, Nan Miles, et al.
Published: (2024)
Whose Side Are You On? Investigating the Political Stance of Large Language Models
by: Pit, Pagnarasmey, et al.
Published: (2024)
by: Pit, Pagnarasmey, et al.
Published: (2024)
Can Large Language Models Detect Misinformation in Scientific News Reporting?
by: Cao, Yupeng, et al.
Published: (2024)
by: Cao, Yupeng, et al.
Published: (2024)
Monitoring Critical Infrastructure Facilities During Disasters Using Large Language Models
by: Ziaullah, Abdul Wahab, et al.
Published: (2024)
by: Ziaullah, Abdul Wahab, et al.
Published: (2024)
Measuring Social Media Polarization Using Large Language Models and Heuristic Rules
by: Chowdhury, Jawad, et al.
Published: (2026)
by: Chowdhury, Jawad, et al.
Published: (2026)
Enhancing Smart Environments with Context-Aware Chatbots using Large Language Models
by: Polo-Rodríguez, Aurora, et al.
Published: (2025)
by: Polo-Rodríguez, Aurora, et al.
Published: (2025)
Could Small Language Models Serve as Recommenders? Towards Data-centric Cold-start Recommendations
by: Wu, Xuansheng, et al.
Published: (2023)
by: Wu, Xuansheng, et al.
Published: (2023)
Large Language Models for Pedestrian Safety: An Application to Predicting Driver Yielding Behavior at Unsignalized Intersections
by: Yang, Yicheng, et al.
Published: (2025)
by: Yang, Yicheng, et al.
Published: (2025)
LMBot: Distilling Graph Knowledge into Language Model for Graph-less Deployment in Twitter Bot Detection
by: Cai, Zijian, et al.
Published: (2023)
by: Cai, Zijian, et al.
Published: (2023)
LLMTaxo: Leveraging Large Language Models for Constructing Taxonomy of Factual Claims from Social Media
by: Zhang, Haiqi, et al.
Published: (2025)
by: Zhang, Haiqi, et al.
Published: (2025)
Assessing Capabilities of Large Language Models in Social Media Analytics: A Multi-task Quest
by: Davoudi, Ramtin, et al.
Published: (2026)
by: Davoudi, Ramtin, et al.
Published: (2026)
Hate Speech Detection Using Cross-Platform Social Media Data In English and German Language
by: Shahi, Gautam Kishore, et al.
Published: (2024)
by: Shahi, Gautam Kishore, et al.
Published: (2024)
Large Language Models for Causal Relations Extraction in Social Media: A Validation Framework for Disaster Intelligence
by: Jeong, Ujun, et al.
Published: (2026)
by: Jeong, Ujun, et al.
Published: (2026)
A Multi-Stage Framework with Taxonomy-Guided Reasoning for Occupation Classification Using Large Language Models
by: Achananuparp, Palakorn, et al.
Published: (2025)
by: Achananuparp, Palakorn, et al.
Published: (2025)
Incentivizing News Consumption on Social Media Platforms Using Large Language Models and Realistic Bot Accounts
by: Askari, Hadi, et al.
Published: (2024)
by: Askari, Hadi, et al.
Published: (2024)
LLaVA-Docent: Instruction Tuning with Multimodal Large Language Model to Support Art Appreciation Education
by: Lee, Unggi, et al.
Published: (2024)
by: Lee, Unggi, et al.
Published: (2024)
Leveraging Large Language Models for Multi-Class and Multi-Label Detection of Drug Use and Overdose Symptoms on Social Media
by: Ahmad, Muhammad, et al.
Published: (2025)
by: Ahmad, Muhammad, et al.
Published: (2025)
They Look Like Each Other: Case-based Reasoning for Explainable Depression Detection on Twitter using Large Language Models
by: Mahdavinejad, Mohammad Saeid, et al.
Published: (2024)
by: Mahdavinejad, Mohammad Saeid, et al.
Published: (2024)
Improving Hate Speech Classification with Cross-Taxonomy Dataset Integration
by: Fillies, Jan, et al.
Published: (2025)
by: Fillies, Jan, et al.
Published: (2025)
Similar Items
-
NSINA: A News Corpus for Sinhala
by: Hettiarachchi, Hansi, et al.
Published: (2024) -
Overview of the First Workshop on Language Models for Low-Resource Languages (LoResLM 2025)
by: Hettiarachchi, Hansi, et al.
Published: (2024) -
A Federated Learning Approach to Privacy Preserving Offensive Language Identification
by: Zampieri, Marcos, et al.
Published: (2024) -
Towards Generalized Offensive Language Identification
by: Dmonte, Alphaeus, et al.
Published: (2024) -
LLM-based Embedders for Prior Case Retrieval
by: Premasiri, Damith, et al.
Published: (2025)