Specializing General-purpose LLM Embeddings for Implicit Hate Speech Detection across Datasets
Fuente:
arXiv
Guardado en:
| Autores principales: | Cheremetiev, Vassiliy, Ngo, Quang Long Ho, Kot, Chau Ying, Baia, Alina Elena, Cavallaro, Andrea |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Cross-modal Counterfactual Explanations: Uncovering Decision Factors and Dataset Biases in Subjective Classification
por: Baia, Alina Elena, et al.
Publicado: (2025)
por: Baia, Alina Elena, et al.
Publicado: (2025)
Image-guided topic modeling for interpretable privacy classification
por: Baia, Alina Elena, et al.
Publicado: (2024)
por: Baia, Alina Elena, et al.
Publicado: (2024)
Zero-shot image privacy classification with Vision-Language Models
por: Baia, Alina Elena, et al.
Publicado: (2025)
por: Baia, Alina Elena, et al.
Publicado: (2025)
Black-box Attacks on Image Activity Prediction and its Natural Language Explanations
por: Baia, Alina Elena, et al.
Publicado: (2023)
por: Baia, Alina Elena, et al.
Publicado: (2023)
Which private attributes do VLMs agree on and predict well?
por: Hrynenko, Olena, et al.
Publicado: (2026)
por: Hrynenko, Olena, et al.
Publicado: (2026)
Towards Generalizable Generic Harmful Speech Datasets for Implicit Hate Speech Detection
por: Almohaimeed, Saad, et al.
Publicado: (2025)
por: Almohaimeed, Saad, et al.
Publicado: (2025)
MM-HSD: Multi-Modal Hate Speech Detection in Videos
por: Céspedes-Sarrias, Berta, et al.
Publicado: (2025)
por: Céspedes-Sarrias, Berta, et al.
Publicado: (2025)
HatePrototypes: Interpretable and Transferable Representations for Implicit and Explicit Hate Speech Detection
por: Proskurina, Irina, et al.
Publicado: (2025)
por: Proskurina, Irina, et al.
Publicado: (2025)
ImpliHateVid: A Benchmark Dataset and Two-stage Contrastive Learning Framework for Implicit Hate Speech Detection in Videos
por: Rehman, Mohammad Zia Ur, et al.
Publicado: (2025)
por: Rehman, Mohammad Zia Ur, et al.
Publicado: (2025)
MetaHate: A Dataset for Unifying Efforts on Hate Speech Detection
por: Piot, Paloma, et al.
Publicado: (2024)
por: Piot, Paloma, et al.
Publicado: (2024)
Selective Demonstration Retrieval for Improved Implicit Hate Speech Detection
por: Kim, Yumin, et al.
Publicado: (2025)
por: Kim, Yumin, et al.
Publicado: (2025)
LLM in the Loop: Creating the ParaDeHate Dataset for Hate Speech Detoxification
por: Yuan, Shuzhou, et al.
Publicado: (2025)
por: Yuan, Shuzhou, et al.
Publicado: (2025)
HateBench: Benchmarking Hate Speech Detectors on LLM-Generated Content and Hate Campaigns
por: Shen, Xinyue, et al.
Publicado: (2025)
por: Shen, Xinyue, et al.
Publicado: (2025)
ChildGuard: A Specialized Dataset for Combatting Child-Targeted Hate Speech
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2025)
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2025)
Cracking the Code: Enhancing Implicit Hate Speech Detection through Coding Classification
por: Wei, Lu, et al.
Publicado: (2025)
por: Wei, Lu, et al.
Publicado: (2025)
Leveraging LLMs for Context-Aware Implicit Textual and Multimodal Hate Speech Detection
por: Brook, Joshua Wolfe, et al.
Publicado: (2025)
por: Brook, Joshua Wolfe, et al.
Publicado: (2025)
RV-HATE: Reinforced Multi-Module Voting for Implicit Hate Speech Detection
por: Lee, Yejin, et al.
Publicado: (2025)
por: Lee, Yejin, et al.
Publicado: (2025)
The two-level systems in cryogenic solids, or how to avoid stressful memories
por: Lubchenko, Vassiliy
Publicado: (2026)
por: Lubchenko, Vassiliy
Publicado: (2026)
AmpleHate: Amplifying the Attention for Versatile Implicit Hate Detection
por: Lee, Yejin, et al.
Publicado: (2025)
por: Lee, Yejin, et al.
Publicado: (2025)
HateTinyLLM : Hate Speech Detection Using Tiny Large Language Models
por: Sen, Tanmay, et al.
Publicado: (2024)
por: Sen, Tanmay, et al.
Publicado: (2024)
Automatic Textual Normalization for Hate Speech Detection
por: Nguyen, Anh Thi-Hoang, et al.
Publicado: (2023)
por: Nguyen, Anh Thi-Hoang, et al.
Publicado: (2023)
Tox-BART: Leveraging Toxicity Attributes for Explanation Generation of Implicit Hate Speech
por: Yadav, Neemesh, et al.
Publicado: (2024)
por: Yadav, Neemesh, et al.
Publicado: (2024)
BIDWESH: A Bangla Regional Based Hate Speech Detection Dataset
por: Fayaz, Azizul Hakim, et al.
Publicado: (2025)
por: Fayaz, Azizul Hakim, et al.
Publicado: (2025)
Comparison of Modern Multilingual Text Embedding Techniques for Hate Speech Detection Task
por: Vaiciukynas, Evaldas, et al.
Publicado: (2026)
por: Vaiciukynas, Evaldas, et al.
Publicado: (2026)
Improving Implicit Hate Speech Detection via a Community-Driven Multi-Agent Framework
por: Gajewska, Ewelina, et al.
Publicado: (2026)
por: Gajewska, Ewelina, et al.
Publicado: (2026)
Empirical Evaluation of Public HateSpeech Datasets
por: Jaf, Sadar, et al.
Publicado: (2024)
por: Jaf, Sadar, et al.
Publicado: (2024)
SynHate: Detecting Hate Speech in Synthetic Deepfake Audio
por: Ranjan, Rishabh, et al.
Publicado: (2025)
por: Ranjan, Rishabh, et al.
Publicado: (2025)
On Importance of Code-Mixed Embeddings for Hate Speech Identification
por: Jagdale, Shruti, et al.
Publicado: (2024)
por: Jagdale, Shruti, et al.
Publicado: (2024)
Seeing Hate Differently: Hate Subspace Modeling for Culture-Aware Hate Speech Detection
por: Cai, Weibin, et al.
Publicado: (2025)
por: Cai, Weibin, et al.
Publicado: (2025)
Label-aware Hard Negative Sampling Strategies with Momentum Contrastive Learning for Implicit Hate Speech Detection
por: Kim, Jaehoon, et al.
Publicado: (2024)
por: Kim, Jaehoon, et al.
Publicado: (2024)
Don't Go To Extremes: Revealing the Excessive Sensitivity and Calibration Limitations of LLMs in Implicit Hate Speech Detection
por: Zhang, Min, et al.
Publicado: (2024)
por: Zhang, Min, et al.
Publicado: (2024)
"Is Hate Lost in Translation?": Evaluation of Multilingual LGBTQIA+ Hate Speech Detection
por: Chan, Fai Leui, et al.
Publicado: (2024)
por: Chan, Fai Leui, et al.
Publicado: (2024)
Advancing Hate Speech Detection with Transformers: Insights from the MetaHate
por: Chapagain, Santosh, et al.
Publicado: (2025)
por: Chapagain, Santosh, et al.
Publicado: (2025)
BanTH: A Multi-label Hate Speech Detection Dataset for Transliterated Bangla
por: Haider, Fabiha, et al.
Publicado: (2024)
por: Haider, Fabiha, et al.
Publicado: (2024)
Is AI Ready for Multimodal Hate Speech Detection? A Comprehensive Dataset and Benchmark Evaluation
por: Xing, Rui, et al.
Publicado: (2026)
por: Xing, Rui, et al.
Publicado: (2026)
MasonPerplexity at Multimodal Hate Speech Event Detection 2024: Hate Speech and Target Detection Using Transformer Ensembles
por: Ganguly, Amrita, et al.
Publicado: (2024)
por: Ganguly, Amrita, et al.
Publicado: (2024)
AfriHate: A Multilingual Collection of Hate Speech and Abusive Language Datasets for African Languages
por: Muhammad, Shamsuddeen Hassan, et al.
Publicado: (2025)
por: Muhammad, Shamsuddeen Hassan, et al.
Publicado: (2025)
Hateful Person or Hateful Model? Investigating the Role of Personas in Hate Speech Detection by Large Language Models
por: Yuan, Shuzhou, et al.
Publicado: (2025)
por: Yuan, Shuzhou, et al.
Publicado: (2025)
Hate Speech
por: Guillén-Nieto, Victoria
Publicado: (2023)
por: Guillén-Nieto, Victoria
Publicado: (2023)
Knowledge as a Breaking of Ergodicity
por: He, Yang, et al.
Publicado: (2024)
por: He, Yang, et al.
Publicado: (2024)
Ejemplares similares
-
Cross-modal Counterfactual Explanations: Uncovering Decision Factors and Dataset Biases in Subjective Classification
por: Baia, Alina Elena, et al.
Publicado: (2025) -
Image-guided topic modeling for interpretable privacy classification
por: Baia, Alina Elena, et al.
Publicado: (2024) -
Zero-shot image privacy classification with Vision-Language Models
por: Baia, Alina Elena, et al.
Publicado: (2025) -
Black-box Attacks on Image Activity Prediction and its Natural Language Explanations
por: Baia, Alina Elena, et al.
Publicado: (2023) -
Which private attributes do VLMs agree on and predict well?
por: Hrynenko, Olena, et al.
Publicado: (2026)