Hate Speech Detection with Generalizable Target-aware Fairness
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Tong, Wang, Danny, Liang, Xurong, Risius, Marten, Demartini, Gianluca, Yin, Hongzhi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
An Effective, Robust and Fairness-aware Hate Speech Detection Framework
por: Mou, Guanyi, et al.
Publicado: (2024)
por: Mou, Guanyi, et al.
Publicado: (2024)
Towards Generalizable Generic Harmful Speech Datasets for Implicit Hate Speech Detection
por: Almohaimeed, Saad, et al.
Publicado: (2025)
por: Almohaimeed, Saad, et al.
Publicado: (2025)
Advancing Hate Speech Detection with Transformers: Insights from the MetaHate
por: Chapagain, Santosh, et al.
Publicado: (2025)
por: Chapagain, Santosh, et al.
Publicado: (2025)
HateTinyLLM : Hate Speech Detection Using Tiny Large Language Models
por: Sen, Tanmay, et al.
Publicado: (2024)
por: Sen, Tanmay, et al.
Publicado: (2024)
Hate Speech Detection and Classification in Amharic Text with Deep Learning
por: Gashe, Samuel Minale, et al.
Publicado: (2024)
por: Gashe, Samuel Minale, et al.
Publicado: (2024)
The Impact of Persona-based Political Perspectives on Hateful Content Detection
por: Civelli, Stefano, et al.
Publicado: (2025)
por: Civelli, Stefano, et al.
Publicado: (2025)
Cross-Platform Hate Speech Detection with Weakly Supervised Causal Disentanglement
por: Sheth, Paras, et al.
Publicado: (2024)
por: Sheth, Paras, et al.
Publicado: (2024)
Aligning Attention with Human Rationales for Self-Explaining Hate Speech Detection
por: Eilertsen, Brage, et al.
Publicado: (2025)
por: Eilertsen, Brage, et al.
Publicado: (2025)
A Survey on Automatic Online Hate Speech Detection in Low-Resource Languages
por: Das, Susmita, et al.
Publicado: (2024)
por: Das, Susmita, et al.
Publicado: (2024)
BOISHOMMO: Holistic Approach for Bangla Hate Speech
por: Kafi, Md Abdullah Al, et al.
Publicado: (2025)
por: Kafi, Md Abdullah Al, et al.
Publicado: (2025)
Deep Learning Approaches for Detecting Adversarial Cyberbullying and Hate Speech in Social Networks
por: Azumah, Sylvia Worlali, et al.
Publicado: (2024)
por: Azumah, Sylvia Worlali, et al.
Publicado: (2024)
1-800-SHARED-TASKS @ NLU of Devanagari Script Languages: Detection of Language, Hate Speech, and Targets using LLMs
por: Purbey, Jebish, et al.
Publicado: (2024)
por: Purbey, Jebish, et al.
Publicado: (2024)
On Importance of Code-Mixed Embeddings for Hate Speech Identification
por: Jagdale, Shruti, et al.
Publicado: (2024)
por: Jagdale, Shruti, et al.
Publicado: (2024)
SWE2: SubWord Enriched and Significant Word Emphasized Framework for Hate Speech Detection
por: Mou, Guanyi, et al.
Publicado: (2024)
por: Mou, Guanyi, et al.
Publicado: (2024)
Investigating Annotator Bias in Large Language Models for Hate Speech Detection
por: Das, Amit, et al.
Publicado: (2024)
por: Das, Amit, et al.
Publicado: (2024)
Causality Guided Representation Learning for Cross-Style Hate Speech Detection
por: Zhao, Chengshuai, et al.
Publicado: (2025)
por: Zhao, Chengshuai, et al.
Publicado: (2025)
Silencing Empowerment, Allowing Bigotry: Auditing the Moderation of Hate Speech on Twitch
por: Shukla, Prarabdh, et al.
Publicado: (2025)
por: Shukla, Prarabdh, et al.
Publicado: (2025)
Towards Detecting Persuasion on Social Media: From Model Development to Insights on Persuasion Strategies
por: Meguellati, Elyas, et al.
Publicado: (2025)
por: Meguellati, Elyas, et al.
Publicado: (2025)
Transformers and Ensemble methods: A solution for Hate Speech Detection in Arabic languages
por: de Paula, Angel Felipe Magnossão, et al.
Publicado: (2023)
por: de Paula, Angel Felipe Magnossão, et al.
Publicado: (2023)
Towards Interpretable Hate Speech Detection using Large Language Model-extracted Rationales
por: Nirmal, Ayushi, et al.
Publicado: (2024)
por: Nirmal, Ayushi, et al.
Publicado: (2024)
From BERT to Qwen: Hate Detection across architectures
por: Mon, Ariadna, et al.
Publicado: (2025)
por: Mon, Ariadna, et al.
Publicado: (2025)
Transfer Learning via Lexical Relatedness: A Sarcasm and Hate Speech Case Study
por: Cabrera, Angelly, et al.
Publicado: (2025)
por: Cabrera, Angelly, et al.
Publicado: (2025)
Diagnosing Hate Speech Classification: Where Do Humans and Machines Disagree, and Why?
por: Yang, Xilin
Publicado: (2024)
por: Yang, Xilin
Publicado: (2024)
Exploring the Plausibility of Hate and Counter Speech Detectors with Explainable AI
por: Böck, Adrian Jaques, et al.
Publicado: (2024)
por: Böck, Adrian Jaques, et al.
Publicado: (2024)
Multilingual Hate Speech Detection in Social Media Using Translation-Based Approaches with Large Language Models
por: Usman, Muhammad, et al.
Publicado: (2025)
por: Usman, Muhammad, et al.
Publicado: (2025)
Fairness without Sensitive Attributes via Knowledge Sharing
por: Ni, Hongliang, et al.
Publicado: (2024)
por: Ni, Hongliang, et al.
Publicado: (2024)
An Investigation of Large Language Models for Real-World Hate Speech Detection
por: Guo, Keyan, et al.
Publicado: (2024)
por: Guo, Keyan, et al.
Publicado: (2024)
Detecting Hope, Hate, and Emotion in Arabic Textual Speech and Multi-modal Memes Using Large Language Models
por: AlDahoul, Nouar, et al.
Publicado: (2025)
por: AlDahoul, Nouar, et al.
Publicado: (2025)
Parameter-Efficient Fine-Tuning for Low-Resource Languages: A Comparative Study of LLMs for Bengali Hate Speech Detection
por: Islam, Akif, et al.
Publicado: (2025)
por: Islam, Akif, et al.
Publicado: (2025)
Comparison of Modern Multilingual Text Embedding Techniques for Hate Speech Detection Task
por: Vaiciukynas, Evaldas, et al.
Publicado: (2026)
por: Vaiciukynas, Evaldas, et al.
Publicado: (2026)
OSPC: Artificial VLM Features for Hateful Meme Detection
por: Grönquist, Peter
Publicado: (2024)
por: Grönquist, Peter
Publicado: (2024)
Dual Path Attribution: Efficient Attribution for SwiGLU-Transformers through Layer-Wise Target Propagation
por: Jantsch, Lasse Marten, et al.
Publicado: (2026)
por: Jantsch, Lasse Marten, et al.
Publicado: (2026)
Attentive Fusion: A Transformer-based Approach to Multimodal Hate Speech Detection
por: Mandal, Atanu, et al.
Publicado: (2024)
por: Mandal, Atanu, et al.
Publicado: (2024)
Opir: Efficient Multi-Task Safety Classification for Toxicity, Jailbreaks, Hate Speech, and Harmful Content
por: Stepanov, Ihor, et al.
Publicado: (2026)
por: Stepanov, Ihor, et al.
Publicado: (2026)
CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models
por: Wang, Song, et al.
Publicado: (2024)
por: Wang, Song, et al.
Publicado: (2024)
Multi-Modal Discussion Transformer: Integrating Text, Images and Graph Transformers to Detect Hate Speech on Social Media
por: Hebert, Liam, et al.
Publicado: (2023)
por: Hebert, Liam, et al.
Publicado: (2023)
TableDART: Dynamic Adaptive Multi-Modal Routing for Table Understanding
por: Xing, Xiaobo, et al.
Publicado: (2025)
por: Xing, Xiaobo, et al.
Publicado: (2025)
Text Meets Topology: Rethinking Out-of-distribution Detection in Text-Rich Networks
por: Wang, Danny, et al.
Publicado: (2025)
por: Wang, Danny, et al.
Publicado: (2025)
Stacking Small Language Models for Generalizability
por: Liang, Laurence
Publicado: (2024)
por: Liang, Laurence
Publicado: (2024)
Improving Hate Speech Classification with Cross-Taxonomy Dataset Integration
por: Fillies, Jan, et al.
Publicado: (2025)
por: Fillies, Jan, et al.
Publicado: (2025)
Ejemplares similares
-
An Effective, Robust and Fairness-aware Hate Speech Detection Framework
por: Mou, Guanyi, et al.
Publicado: (2024) -
Towards Generalizable Generic Harmful Speech Datasets for Implicit Hate Speech Detection
por: Almohaimeed, Saad, et al.
Publicado: (2025) -
Advancing Hate Speech Detection with Transformers: Insights from the MetaHate
por: Chapagain, Santosh, et al.
Publicado: (2025) -
HateTinyLLM : Hate Speech Detection Using Tiny Large Language Models
por: Sen, Tanmay, et al.
Publicado: (2024) -
Hate Speech Detection and Classification in Amharic Text with Deep Learning
por: Gashe, Samuel Minale, et al.
Publicado: (2024)