Semantic Gradients Interactions in SSD: A Case Study in Racial Identity and Hate Speech
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ostrowicki, Felix, Plisiecki, Hubert |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Interpretable Semantic Gradients in SSD: A PCA Sweep Approach and a Case Study on AI Discourse
par: Plisiecki, Hubert, et autres
Publié: (2026)
par: Plisiecki, Hubert, et autres
Publié: (2026)
Eradicating Social Biases in Sentiment Analysis using Semantic Blinding and Semantic Propagation Graph Neural Networks
par: Plisiecki, Hubert
Publié: (2024)
par: Plisiecki, Hubert
Publié: (2024)
The Prediction-Measurement Gap: Toward Meaning Representations as Scientific Instruments
par: Plisiecki, Hubert
Publié: (2026)
par: Plisiecki, Hubert
Publié: (2026)
Supervised Semantic Differential for Cross-Cultural Concept Analysis: A Case Study of Human Affect
par: Sikora, Jan, et autres
Publié: (2026)
par: Sikora, Jan, et autres
Publié: (2026)
High Risk of Political Bias in Black Box Emotion Inference Models
par: Plisiecki, Hubert, et autres
Publié: (2024)
par: Plisiecki, Hubert, et autres
Publié: (2024)
Predicting Emotion Intensity in Polish Political Texts: Comparing Supervised Models and Large Language Models in a Resource-Poor Language
par: Plisiecki, Hubert, et autres
Publié: (2024)
par: Plisiecki, Hubert, et autres
Publié: (2024)
HateDebias: On the Diversity and Variability of Hate Speech Debiasing
par: Wu, Hongyan, et autres
Publié: (2024)
par: Wu, Hongyan, et autres
Publié: (2024)
Transfer Learning via Lexical Relatedness: A Sarcasm and Hate Speech Case Study
par: Cabrera, Angelly, et autres
Publié: (2025)
par: Cabrera, Angelly, et autres
Publié: (2025)
Web(er) of Hate: A Survey on How Hate Speech Is Typed
par: Wang, Luna, et autres
Publié: (2025)
par: Wang, Luna, et autres
Publié: (2025)
Untangling Hate Speech Definitions: A Semantic Componential Analysis Across Cultures and Domains
par: Korre, Katerina, et autres
Publié: (2024)
par: Korre, Katerina, et autres
Publié: (2024)
Decoding Hate: Exploring Language Models' Reactions to Hate Speech
par: Piot, Paloma, et autres
Publié: (2024)
par: Piot, Paloma, et autres
Publié: (2024)
"Is Hate Lost in Translation?": Evaluation of Multilingual LGBTQIA+ Hate Speech Detection
par: Chan, Fai Leui, et autres
Publié: (2024)
par: Chan, Fai Leui, et autres
Publié: (2024)
Hateful Person or Hateful Model? Investigating the Role of Personas in Hate Speech Detection by Large Language Models
par: Yuan, Shuzhou, et autres
Publié: (2025)
par: Yuan, Shuzhou, et autres
Publié: (2025)
LLM in the Loop: Creating the ParaDeHate Dataset for Hate Speech Detoxification
par: Yuan, Shuzhou, et autres
Publié: (2025)
par: Yuan, Shuzhou, et autres
Publié: (2025)
The Pinocchio Dimension: Phenomenality of Experience as the Primary Axis of LLM Psychometric Differences
par: Plisiecki, Hubert, et autres
Publié: (2026)
par: Plisiecki, Hubert, et autres
Publié: (2026)
Disentangling Hate Across Target Identities
par: Jin, Yiping, et autres
Publié: (2024)
par: Jin, Yiping, et autres
Publié: (2024)
AfriHate: A Multilingual Collection of Hate Speech and Abusive Language Datasets for African Languages
par: Muhammad, Shamsuddeen Hassan, et autres
Publié: (2025)
par: Muhammad, Shamsuddeen Hassan, et autres
Publié: (2025)
MasonPerplexity at Multimodal Hate Speech Event Detection 2024: Hate Speech and Target Detection Using Transformer Ensembles
par: Ganguly, Amrita, et autres
Publié: (2024)
par: Ganguly, Amrita, et autres
Publié: (2024)
When Hate Meets Facts: LLMs-in-the-Loop for Check-worthiness Detection in Hate Speech
par: Ocampo, Nicolás Benjamín, et autres
Publié: (2026)
par: Ocampo, Nicolás Benjamín, et autres
Publié: (2026)
HateGPT: Unleashing GPT-3.5 Turbo to Combat Hate Speech on X
par: Deroy, Aniket, et autres
Publié: (2024)
par: Deroy, Aniket, et autres
Publié: (2024)
NaijaHate: Evaluating Hate Speech Detection on Nigerian Twitter Using Representative Data
par: Tonneau, Manuel, et autres
Publié: (2024)
par: Tonneau, Manuel, et autres
Publié: (2024)
MetaHate: A Dataset for Unifying Efforts on Hate Speech Detection
par: Piot, Paloma, et autres
Publié: (2024)
par: Piot, Paloma, et autres
Publié: (2024)
Causal Intersectionality and Dual Form of Gradient Descent for Multimodal Analysis: a Case Study on Hateful Memes
par: Miyanishi, Yosuke, et autres
Publié: (2023)
par: Miyanishi, Yosuke, et autres
Publié: (2023)
Challenger at MultiPRIDE: Is It Hate Speech or Reclaimed?
par: Tekanlou, Hadi Bayrami Asl, et autres
Publié: (2026)
par: Tekanlou, Hadi Bayrami Asl, et autres
Publié: (2026)
Compositional Generalisation for Explainable Hate Speech Detection
par: Calabrese, Agostina, et autres
Publié: (2025)
par: Calabrese, Agostina, et autres
Publié: (2025)
Automatic Textual Normalization for Hate Speech Detection
par: Nguyen, Anh Thi-Hoang, et autres
Publié: (2023)
par: Nguyen, Anh Thi-Hoang, et autres
Publié: (2023)
Advancing Hate Speech Detection with Transformers: Insights from the MetaHate
par: Chapagain, Santosh, et autres
Publié: (2025)
par: Chapagain, Santosh, et autres
Publié: (2025)
The Enforcement and Feasibility of Hate Speech Moderation on Twitter
par: Tonneau, Manuel, et autres
Publié: (2026)
par: Tonneau, Manuel, et autres
Publié: (2026)
Generalizing Hate Speech Detection Using Multi-Task Learning: A Case Study of Political Public Figures
par: Yuan, Lanqin, et autres
Publié: (2022)
par: Yuan, Lanqin, et autres
Publié: (2022)
Dialogues of Dissent: Thematic and Rhetorical Dimensions of Hate and Counter-Hate Speech in Social Media Conversations
par: Levi, Effi, et autres
Publié: (2025)
par: Levi, Effi, et autres
Publié: (2025)
HatePRISM: Policies, Platforms, and Research Integration. Advancing NLP for Hate Speech Proactive Mitigation
par: Rizwan, Naquee, et autres
Publié: (2025)
par: Rizwan, Naquee, et autres
Publié: (2025)
Multi3Hate: Multimodal, Multilingual, and Multicultural Hate Speech Detection with Vision-Language Models
par: Bui, Minh Duc, et autres
Publié: (2024)
par: Bui, Minh Duc, et autres
Publié: (2024)
HateXScore: A Metric Suite for Evaluating Reasoning Quality in Hate Speech Explanations
par: Hu, Yujia, et autres
Publié: (2026)
par: Hu, Yujia, et autres
Publié: (2026)
GPT-HateCheck: Can LLMs Write Better Functional Tests for Hate Speech Detection?
par: Jin, Yiping, et autres
Publié: (2024)
par: Jin, Yiping, et autres
Publié: (2024)
ViHateT5: Enhancing Hate Speech Detection in Vietnamese With A Unified Text-to-Text Transformer Model
par: Nguyen, Luan Thanh
Publié: (2024)
par: Nguyen, Luan Thanh
Publié: (2024)
HatePrototypes: Interpretable and Transferable Representations for Implicit and Explicit Hate Speech Detection
par: Proskurina, Irina, et autres
Publié: (2025)
par: Proskurina, Irina, et autres
Publié: (2025)
HateModerate: Testing Hate Speech Detectors against Content Moderation Policies
par: Zheng, Jiangrui, et autres
Publié: (2023)
par: Zheng, Jiangrui, et autres
Publié: (2023)
DeHate: A Stable Diffusion-based Multimodal Approach to Mitigate Hate Speech in Images
par: Dalal, Dwip, et autres
Publié: (2025)
par: Dalal, Dwip, et autres
Publié: (2025)
EkoHate: Abusive Language and Hate Speech Detection for Code-switched Political Discussions on Nigerian Twitter
par: Ilevbare, Comfort Eseohen, et autres
Publié: (2024)
par: Ilevbare, Comfort Eseohen, et autres
Publié: (2024)
HateDay: Insights from a Global Hate Speech Dataset Representative of a Day on Twitter
par: Tonneau, Manuel, et autres
Publié: (2024)
par: Tonneau, Manuel, et autres
Publié: (2024)
Documents similaires
-
Interpretable Semantic Gradients in SSD: A PCA Sweep Approach and a Case Study on AI Discourse
par: Plisiecki, Hubert, et autres
Publié: (2026) -
Eradicating Social Biases in Sentiment Analysis using Semantic Blinding and Semantic Propagation Graph Neural Networks
par: Plisiecki, Hubert
Publié: (2024) -
The Prediction-Measurement Gap: Toward Meaning Representations as Scientific Instruments
par: Plisiecki, Hubert
Publié: (2026) -
Supervised Semantic Differential for Cross-Cultural Concept Analysis: A Case Study of Human Affect
par: Sikora, Jan, et autres
Publié: (2026) -
High Risk of Political Bias in Black Box Emotion Inference Models
par: Plisiecki, Hubert, et autres
Publié: (2024)