Hate Speech Detection with Generalizable Target-aware Fairness
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Tong, Wang, Danny, Liang, Xurong, Risius, Marten, Demartini, Gianluca, Yin, Hongzhi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Effective, Robust and Fairness-aware Hate Speech Detection Framework
di: Mou, Guanyi, et al.
Pubblicazione: (2024)
di: Mou, Guanyi, et al.
Pubblicazione: (2024)
Towards Generalizable Generic Harmful Speech Datasets for Implicit Hate Speech Detection
di: Almohaimeed, Saad, et al.
Pubblicazione: (2025)
di: Almohaimeed, Saad, et al.
Pubblicazione: (2025)
Advancing Hate Speech Detection with Transformers: Insights from the MetaHate
di: Chapagain, Santosh, et al.
Pubblicazione: (2025)
di: Chapagain, Santosh, et al.
Pubblicazione: (2025)
HateTinyLLM : Hate Speech Detection Using Tiny Large Language Models
di: Sen, Tanmay, et al.
Pubblicazione: (2024)
di: Sen, Tanmay, et al.
Pubblicazione: (2024)
Hate Speech Detection and Classification in Amharic Text with Deep Learning
di: Gashe, Samuel Minale, et al.
Pubblicazione: (2024)
di: Gashe, Samuel Minale, et al.
Pubblicazione: (2024)
The Impact of Persona-based Political Perspectives on Hateful Content Detection
di: Civelli, Stefano, et al.
Pubblicazione: (2025)
di: Civelli, Stefano, et al.
Pubblicazione: (2025)
Cross-Platform Hate Speech Detection with Weakly Supervised Causal Disentanglement
di: Sheth, Paras, et al.
Pubblicazione: (2024)
di: Sheth, Paras, et al.
Pubblicazione: (2024)
Aligning Attention with Human Rationales for Self-Explaining Hate Speech Detection
di: Eilertsen, Brage, et al.
Pubblicazione: (2025)
di: Eilertsen, Brage, et al.
Pubblicazione: (2025)
A Survey on Automatic Online Hate Speech Detection in Low-Resource Languages
di: Das, Susmita, et al.
Pubblicazione: (2024)
di: Das, Susmita, et al.
Pubblicazione: (2024)
BOISHOMMO: Holistic Approach for Bangla Hate Speech
di: Kafi, Md Abdullah Al, et al.
Pubblicazione: (2025)
di: Kafi, Md Abdullah Al, et al.
Pubblicazione: (2025)
Deep Learning Approaches for Detecting Adversarial Cyberbullying and Hate Speech in Social Networks
di: Azumah, Sylvia Worlali, et al.
Pubblicazione: (2024)
di: Azumah, Sylvia Worlali, et al.
Pubblicazione: (2024)
1-800-SHARED-TASKS @ NLU of Devanagari Script Languages: Detection of Language, Hate Speech, and Targets using LLMs
di: Purbey, Jebish, et al.
Pubblicazione: (2024)
di: Purbey, Jebish, et al.
Pubblicazione: (2024)
On Importance of Code-Mixed Embeddings for Hate Speech Identification
di: Jagdale, Shruti, et al.
Pubblicazione: (2024)
di: Jagdale, Shruti, et al.
Pubblicazione: (2024)
SWE2: SubWord Enriched and Significant Word Emphasized Framework for Hate Speech Detection
di: Mou, Guanyi, et al.
Pubblicazione: (2024)
di: Mou, Guanyi, et al.
Pubblicazione: (2024)
Investigating Annotator Bias in Large Language Models for Hate Speech Detection
di: Das, Amit, et al.
Pubblicazione: (2024)
di: Das, Amit, et al.
Pubblicazione: (2024)
Causality Guided Representation Learning for Cross-Style Hate Speech Detection
di: Zhao, Chengshuai, et al.
Pubblicazione: (2025)
di: Zhao, Chengshuai, et al.
Pubblicazione: (2025)
Silencing Empowerment, Allowing Bigotry: Auditing the Moderation of Hate Speech on Twitch
di: Shukla, Prarabdh, et al.
Pubblicazione: (2025)
di: Shukla, Prarabdh, et al.
Pubblicazione: (2025)
Towards Detecting Persuasion on Social Media: From Model Development to Insights on Persuasion Strategies
di: Meguellati, Elyas, et al.
Pubblicazione: (2025)
di: Meguellati, Elyas, et al.
Pubblicazione: (2025)
Transformers and Ensemble methods: A solution for Hate Speech Detection in Arabic languages
di: de Paula, Angel Felipe Magnossão, et al.
Pubblicazione: (2023)
di: de Paula, Angel Felipe Magnossão, et al.
Pubblicazione: (2023)
Towards Interpretable Hate Speech Detection using Large Language Model-extracted Rationales
di: Nirmal, Ayushi, et al.
Pubblicazione: (2024)
di: Nirmal, Ayushi, et al.
Pubblicazione: (2024)
From BERT to Qwen: Hate Detection across architectures
di: Mon, Ariadna, et al.
Pubblicazione: (2025)
di: Mon, Ariadna, et al.
Pubblicazione: (2025)
Transfer Learning via Lexical Relatedness: A Sarcasm and Hate Speech Case Study
di: Cabrera, Angelly, et al.
Pubblicazione: (2025)
di: Cabrera, Angelly, et al.
Pubblicazione: (2025)
Diagnosing Hate Speech Classification: Where Do Humans and Machines Disagree, and Why?
di: Yang, Xilin
Pubblicazione: (2024)
di: Yang, Xilin
Pubblicazione: (2024)
Exploring the Plausibility of Hate and Counter Speech Detectors with Explainable AI
di: Böck, Adrian Jaques, et al.
Pubblicazione: (2024)
di: Böck, Adrian Jaques, et al.
Pubblicazione: (2024)
Multilingual Hate Speech Detection in Social Media Using Translation-Based Approaches with Large Language Models
di: Usman, Muhammad, et al.
Pubblicazione: (2025)
di: Usman, Muhammad, et al.
Pubblicazione: (2025)
Fairness without Sensitive Attributes via Knowledge Sharing
di: Ni, Hongliang, et al.
Pubblicazione: (2024)
di: Ni, Hongliang, et al.
Pubblicazione: (2024)
An Investigation of Large Language Models for Real-World Hate Speech Detection
di: Guo, Keyan, et al.
Pubblicazione: (2024)
di: Guo, Keyan, et al.
Pubblicazione: (2024)
Detecting Hope, Hate, and Emotion in Arabic Textual Speech and Multi-modal Memes Using Large Language Models
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)
Parameter-Efficient Fine-Tuning for Low-Resource Languages: A Comparative Study of LLMs for Bengali Hate Speech Detection
di: Islam, Akif, et al.
Pubblicazione: (2025)
di: Islam, Akif, et al.
Pubblicazione: (2025)
Comparison of Modern Multilingual Text Embedding Techniques for Hate Speech Detection Task
di: Vaiciukynas, Evaldas, et al.
Pubblicazione: (2026)
di: Vaiciukynas, Evaldas, et al.
Pubblicazione: (2026)
OSPC: Artificial VLM Features for Hateful Meme Detection
di: Grönquist, Peter
Pubblicazione: (2024)
di: Grönquist, Peter
Pubblicazione: (2024)
Dual Path Attribution: Efficient Attribution for SwiGLU-Transformers through Layer-Wise Target Propagation
di: Jantsch, Lasse Marten, et al.
Pubblicazione: (2026)
di: Jantsch, Lasse Marten, et al.
Pubblicazione: (2026)
Attentive Fusion: A Transformer-based Approach to Multimodal Hate Speech Detection
di: Mandal, Atanu, et al.
Pubblicazione: (2024)
di: Mandal, Atanu, et al.
Pubblicazione: (2024)
Opir: Efficient Multi-Task Safety Classification for Toxicity, Jailbreaks, Hate Speech, and Harmful Content
di: Stepanov, Ihor, et al.
Pubblicazione: (2026)
di: Stepanov, Ihor, et al.
Pubblicazione: (2026)
CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models
di: Wang, Song, et al.
Pubblicazione: (2024)
di: Wang, Song, et al.
Pubblicazione: (2024)
Multi-Modal Discussion Transformer: Integrating Text, Images and Graph Transformers to Detect Hate Speech on Social Media
di: Hebert, Liam, et al.
Pubblicazione: (2023)
di: Hebert, Liam, et al.
Pubblicazione: (2023)
TableDART: Dynamic Adaptive Multi-Modal Routing for Table Understanding
di: Xing, Xiaobo, et al.
Pubblicazione: (2025)
di: Xing, Xiaobo, et al.
Pubblicazione: (2025)
Text Meets Topology: Rethinking Out-of-distribution Detection in Text-Rich Networks
di: Wang, Danny, et al.
Pubblicazione: (2025)
di: Wang, Danny, et al.
Pubblicazione: (2025)
Stacking Small Language Models for Generalizability
di: Liang, Laurence
Pubblicazione: (2024)
di: Liang, Laurence
Pubblicazione: (2024)
Improving Hate Speech Classification with Cross-Taxonomy Dataset Integration
di: Fillies, Jan, et al.
Pubblicazione: (2025)
di: Fillies, Jan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
An Effective, Robust and Fairness-aware Hate Speech Detection Framework
di: Mou, Guanyi, et al.
Pubblicazione: (2024) -
Towards Generalizable Generic Harmful Speech Datasets for Implicit Hate Speech Detection
di: Almohaimeed, Saad, et al.
Pubblicazione: (2025) -
Advancing Hate Speech Detection with Transformers: Insights from the MetaHate
di: Chapagain, Santosh, et al.
Pubblicazione: (2025) -
HateTinyLLM : Hate Speech Detection Using Tiny Large Language Models
di: Sen, Tanmay, et al.
Pubblicazione: (2024) -
Hate Speech Detection and Classification in Amharic Text with Deep Learning
di: Gashe, Samuel Minale, et al.
Pubblicazione: (2024)