HateCOT: An Explanation-Enhanced Dataset for Generalizable Offensive Speech Detection via Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Nghiem, Huy, Daumé III, Hal |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SMARTER: A Data-efficient Framework to Improve Toxicity Detection with Explanation via Self-augmenting Large Language Models
by: Nghiem, Huy, et al.
Published: (2025)
by: Nghiem, Huy, et al.
Published: (2025)
"You Gotta be a Doctor, Lin": An Investigation of Name-Based Bias of Large Language Models in Employment Recommendations
by: Nghiem, Huy, et al.
Published: (2024)
by: Nghiem, Huy, et al.
Published: (2024)
SOLD: Sinhala Offensive Language Dataset
by: Ranasinghe, Tharindu, et al.
Published: (2022)
by: Ranasinghe, Tharindu, et al.
Published: (2022)
An Investigation of Large Language Models for Real-World Hate Speech Detection
by: Guo, Keyan, et al.
Published: (2024)
by: Guo, Keyan, et al.
Published: (2024)
A Necessary Step toward Faithfulness: Measuring and Improving Consistency in Free-Text Explanations
by: Zhao, Lingjun, et al.
Published: (2025)
by: Zhao, Lingjun, et al.
Published: (2025)
Hate Speech Detection Using Cross-Platform Social Media Data In English and German Language
by: Shahi, Gautam Kishore, et al.
Published: (2024)
by: Shahi, Gautam Kishore, et al.
Published: (2024)
Improving Hate Speech Classification with Cross-Taxonomy Dataset Integration
by: Fillies, Jan, et al.
Published: (2025)
by: Fillies, Jan, et al.
Published: (2025)
Bias in the Tails: How Name-conditioned Evaluative Framing in Resume Summaries Destabilizes LLM-based Hiring
by: Nghiem, Huy, et al.
Published: (2026)
by: Nghiem, Huy, et al.
Published: (2026)
Balancing Safety and Helpfulness in Healthcare AI Assistants through Iterative Preference Alignment
by: Nghiem, Huy, et al.
Published: (2025)
by: Nghiem, Huy, et al.
Published: (2025)
HateSieve: A Contrastive Learning Framework for Detecting and Segmenting Hateful Content in Multimodal Memes
by: Su, Xuanyu, et al.
Published: (2024)
by: Su, Xuanyu, et al.
Published: (2024)
MetaHate: A Dataset for Unifying Efforts on Hate Speech Detection
by: Piot, Paloma, et al.
Published: (2024)
by: Piot, Paloma, et al.
Published: (2024)
Language Models Predict Empathy Gaps Between Social In-groups and Out-groups
by: Hou, Yu, et al.
Published: (2025)
by: Hou, Yu, et al.
Published: (2025)
Explainable Identification of Hate Speech towards Islam using Graph Neural Networks
by: Wasi, Azmine Toushik
Published: (2023)
by: Wasi, Azmine Toushik
Published: (2023)
Can Large Language Models Detect Misinformation in Scientific News Reporting?
by: Cao, Yupeng, et al.
Published: (2024)
by: Cao, Yupeng, et al.
Published: (2024)
Steering Safely or Off a Cliff? Rethinking Specificity and Robustness in Inference-Time Interventions
by: Goyal, Navita, et al.
Published: (2026)
by: Goyal, Navita, et al.
Published: (2026)
Enhancing Smart Environments with Context-Aware Chatbots using Large Language Models
by: Polo-Rodríguez, Aurora, et al.
Published: (2025)
by: Polo-Rodríguez, Aurora, et al.
Published: (2025)
Efficient Hate Speech Detection: Evaluating 38 Models from Traditional Methods to Transformers
by: Abusaqer, Mahmoud, et al.
Published: (2025)
by: Abusaqer, Mahmoud, et al.
Published: (2025)
Mapping the Italian Telegram Ecosystem: Communities, Toxicity, and Hate Speech
by: Alvisi, Lorenzo, et al.
Published: (2025)
by: Alvisi, Lorenzo, et al.
Published: (2025)
Leveraging Large Language Models for Multi-Class and Multi-Label Detection of Drug Use and Overdose Symptoms on Social Media
by: Ahmad, Muhammad, et al.
Published: (2025)
by: Ahmad, Muhammad, et al.
Published: (2025)
They Look Like Each Other: Case-based Reasoning for Explainable Depression Detection on Twitter using Large Language Models
by: Mahdavinejad, Mohammad Saeid, et al.
Published: (2024)
by: Mahdavinejad, Mohammad Saeid, et al.
Published: (2024)
Seeing Hate Differently: Hate Subspace Modeling for Culture-Aware Hate Speech Detection
by: Cai, Weibin, et al.
Published: (2025)
by: Cai, Weibin, et al.
Published: (2025)
Understanding Sarcoidosis Using Large Language Models and Social Media Data
by: Xi, Nan Miles, et al.
Published: (2024)
by: Xi, Nan Miles, et al.
Published: (2024)
Whose Side Are You On? Investigating the Political Stance of Large Language Models
by: Pit, Pagnarasmey, et al.
Published: (2024)
by: Pit, Pagnarasmey, et al.
Published: (2024)
Measuring Social Media Polarization Using Large Language Models and Heuristic Rules
by: Chowdhury, Jawad, et al.
Published: (2026)
by: Chowdhury, Jawad, et al.
Published: (2026)
Monitoring Critical Infrastructure Facilities During Disasters Using Large Language Models
by: Ziaullah, Abdul Wahab, et al.
Published: (2024)
by: Ziaullah, Abdul Wahab, et al.
Published: (2024)
LMBot: Distilling Graph Knowledge into Language Model for Graph-less Deployment in Twitter Bot Detection
by: Cai, Zijian, et al.
Published: (2023)
by: Cai, Zijian, et al.
Published: (2023)
Large Language Models for Pedestrian Safety: An Application to Predicting Driver Yielding Behavior at Unsignalized Intersections
by: Yang, Yicheng, et al.
Published: (2025)
by: Yang, Yicheng, et al.
Published: (2025)
LLMTaxo: Leveraging Large Language Models for Constructing Taxonomy of Factual Claims from Social Media
by: Zhang, Haiqi, et al.
Published: (2025)
by: Zhang, Haiqi, et al.
Published: (2025)
Assessing Capabilities of Large Language Models in Social Media Analytics: A Multi-task Quest
by: Davoudi, Ramtin, et al.
Published: (2026)
by: Davoudi, Ramtin, et al.
Published: (2026)
A Multi-Stage Framework with Taxonomy-Guided Reasoning for Occupation Classification Using Large Language Models
by: Achananuparp, Palakorn, et al.
Published: (2025)
by: Achananuparp, Palakorn, et al.
Published: (2025)
Incentivizing News Consumption on Social Media Platforms Using Large Language Models and Realistic Bot Accounts
by: Askari, Hadi, et al.
Published: (2024)
by: Askari, Hadi, et al.
Published: (2024)
LLaVA-Docent: Instruction Tuning with Multimodal Large Language Model to Support Art Appreciation Education
by: Lee, Unggi, et al.
Published: (2024)
by: Lee, Unggi, et al.
Published: (2024)
Large Language Models for Causal Relations Extraction in Social Media: A Validation Framework for Disaster Intelligence
by: Jeong, Ujun, et al.
Published: (2026)
by: Jeong, Ujun, et al.
Published: (2026)
Community Detection on Model Explanation Graphs for Explainable AI
by: Moradi, Ehsan
Published: (2025)
by: Moradi, Ehsan
Published: (2025)
Creating and Evaluating Code-Mixed Nepali-English and Telugu-English Datasets for Abusive Language Detection Using Traditional and Deep Learning Models
by: Pandey, Manish, et al.
Published: (2025)
by: Pandey, Manish, et al.
Published: (2025)
Analyzing User Characteristics of Hate Speech Spreaders on Social Media
by: Geissler, Dominique, et al.
Published: (2023)
by: Geissler, Dominique, et al.
Published: (2023)
Evolving Hate Speech Online: An Adaptive Framework for Detection and Mitigation
by: Ali, Shiza, et al.
Published: (2025)
by: Ali, Shiza, et al.
Published: (2025)
Knowledge Homophily in Large Language Models
by: Sahu, Utkarsh, et al.
Published: (2025)
by: Sahu, Utkarsh, et al.
Published: (2025)
Detection of Conspiracy Theories Beyond Keyword Bias in German-Language Telegram Using Large Language Models
by: Pustet, Milena, et al.
Published: (2024)
by: Pustet, Milena, et al.
Published: (2024)
Successfully Guiding Humans with Imperfect Instructions by Highlighting Potential Errors and Suggesting Corrections
by: Zhao, Lingjun, et al.
Published: (2024)
by: Zhao, Lingjun, et al.
Published: (2024)
Similar Items
-
SMARTER: A Data-efficient Framework to Improve Toxicity Detection with Explanation via Self-augmenting Large Language Models
by: Nghiem, Huy, et al.
Published: (2025) -
"You Gotta be a Doctor, Lin": An Investigation of Name-Based Bias of Large Language Models in Employment Recommendations
by: Nghiem, Huy, et al.
Published: (2024) -
SOLD: Sinhala Offensive Language Dataset
by: Ranasinghe, Tharindu, et al.
Published: (2022) -
An Investigation of Large Language Models for Real-World Hate Speech Detection
by: Guo, Keyan, et al.
Published: (2024) -
A Necessary Step toward Faithfulness: Measuring and Improving Consistency in Free-Text Explanations
by: Zhao, Lingjun, et al.
Published: (2025)