Evaluating Simple Debiasing Techniques in RoBERTa-based Hate Speech Detection Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Iftimie, Diana, Zinn, Erik |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multiclass Hate Speech Detection with RoBERTa-OTA: Integrating Transformer Attention and Graph Convolutional Networks
par: Abusaqer, Mahmoud, et autres
Publié: (2026)
par: Abusaqer, Mahmoud, et autres
Publié: (2026)
RoBERTurk: Adjusting RoBERTa for Turkish
par: Tas, Nuri
Publié: (2024)
par: Tas, Nuri
Publié: (2024)
Performance Evaluation of Emotion Classification in Japanese Using RoBERTa and DeBERTa
par: Takenaka, Yoichi
Publié: (2025)
par: Takenaka, Yoichi
Publié: (2025)
NER- RoBERTa: Fine-Tuning RoBERTa for Named Entity Recognition (NER) within low-resource languages
par: Abdullah, Abdulhady Abas, et autres
Publié: (2024)
par: Abdullah, Abdulhady Abas, et autres
Publié: (2024)
A RoBERTa-Based Functional Syntax Annotation Model for Chinese Texts
par: Xiaohui, Han, et autres
Publié: (2025)
par: Xiaohui, Han, et autres
Publié: (2025)
Multilingual Hope Speech Detection: A Comparative Study of Logistic Regression, mBERT, and XLM-RoBERTa with Active Learning
par: Abiola, T. O., et autres
Publié: (2025)
par: Abiola, T. O., et autres
Publié: (2025)
RoBERTa-BiLSTM: A Context-Aware Hybrid Model for Sentiment Analysis
par: Rahman, Md. Mostafizer, et autres
Publié: (2024)
par: Rahman, Md. Mostafizer, et autres
Publié: (2024)
Decoding Fake Narratives in Spreading Hateful Stories: A Dual-Head RoBERTa Model with Multi-Task Learning
par: Bhaskar, Yash, et autres
Publié: (2025)
par: Bhaskar, Yash, et autres
Publié: (2025)
Logits-Constrained Framework with RoBERTa for Ancient Chinese NER
par: Hua, Wenjie, et autres
Publié: (2025)
par: Hua, Wenjie, et autres
Publié: (2025)
Data Quality Matters: Suicide Intention Detection on Social Media Posts Using RoBERTa-CNN
par: Lin, Emily, et autres
Publié: (2024)
par: Lin, Emily, et autres
Publié: (2024)
EfficientQA : a RoBERTa Based Phrase-Indexed Question-Answering System
par: Chaybouti, Sofian, et autres
Publié: (2021)
par: Chaybouti, Sofian, et autres
Publié: (2021)
TartuNLP @ SIGTYP 2024 Shared Task: Adapting XLM-RoBERTa for Ancient and Historical Languages
par: Dorkin, Aleksei, et autres
Publié: (2024)
par: Dorkin, Aleksei, et autres
Publié: (2024)
Does RoBERTa Perform Better than BERT in Continual Learning: An Attention Sink Perspective
par: Bai, Xueying, et autres
Publié: (2024)
par: Bai, Xueying, et autres
Publié: (2024)
"AGI" team at SHROOM-CAP: Data-Centric Approach to Multilingual Hallucination Detection using XLM-RoBERTa
par: Rathva, Harsh, et autres
Publié: (2025)
par: Rathva, Harsh, et autres
Publié: (2025)
SemEval-2024 Task 8: Weighted Layer Averaging RoBERTa for Black-Box Machine-Generated Text Detection
par: Datta, Ayan, et autres
Publié: (2024)
par: Datta, Ayan, et autres
Publié: (2024)
Bilingual Sexism Classification: Fine-Tuned XLM-RoBERTa and GPT-3.5 Few-Shot Learning
par: Azadi, AmirMohammad, et autres
Publié: (2024)
par: Azadi, AmirMohammad, et autres
Publié: (2024)
Why Antiwork: A RoBERTa-Based System for Work-Related Stress Identification and Leading Factor Analysis
par: Lu, Tao, et autres
Publié: (2024)
par: Lu, Tao, et autres
Publié: (2024)
NCL-BU at SemEval-2026 Task 3: Fine-tuning XLM-RoBERTa for Multilingual Dimensional Sentiment Regression
par: Wu, Tong, et autres
Publié: (2026)
par: Wu, Tong, et autres
Publié: (2026)
HateDebias: On the Diversity and Variability of Hate Speech Debiasing
par: Wu, Hongyan, et autres
Publié: (2024)
par: Wu, Hongyan, et autres
Publié: (2024)
Fine-tuning RoBERTa for CVE-to-CWE Classification: A 125M Parameter Model Competitive with LLMs
par: Mosievskiy, Nikita
Publié: (2026)
par: Mosievskiy, Nikita
Publié: (2026)
EDU-NER-2025: Named Entity Recognition in Urdu Educational Texts using XLM-RoBERTa with X (formerly Twitter)
par: Ullah, Fida, et autres
Publié: (2025)
par: Ullah, Fida, et autres
Publié: (2025)
The Role of Model Architecture and Scale in Predicting Molecular Properties: Insights from Fine-Tuning RoBERTa, BART, and LLaMA
par: Youngmin, Lee, et autres
Publié: (2024)
par: Youngmin, Lee, et autres
Publié: (2024)
Mast Kalandar at SemEval-2024 Task 8: On the Trail of Textual Origins: RoBERTa-BiLSTM Approach to Detect AI-Generated Text
par: Bafna, Jainit Sushil, et autres
Publié: (2024)
par: Bafna, Jainit Sushil, et autres
Publié: (2024)
SG-UniBuc-NLP at SemEval-2026 Task 6: Multi-Head RoBERTa with Chunking for Long-Context Evasion Detection
par: Stefan, Gabriel, et autres
Publié: (2026)
par: Stefan, Gabriel, et autres
Publié: (2026)
Antibody Foundational Model : Ab-RoBERTa
par: Huh, Eunna, et autres
Publié: (2025)
par: Huh, Eunna, et autres
Publié: (2025)
QuadAI at SemEval-2026 Task 3: Ensemble Learning of Hybrid RoBERTa and LLMs for Dimensional Aspect-Based Sentiment Analysis
par: de Vink, A. J. W., et autres
Publié: (2026)
par: de Vink, A. J. W., et autres
Publié: (2026)
MaLei at the PLABA Track of TREC 2024: RoBERTa for Term Replacement -- LLaMA3.1 and GPT-4o for Complete Abstract Adaptation
par: Ling, Zhidong, et autres
Publié: (2024)
par: Ling, Zhidong, et autres
Publié: (2024)
The Large Language Model GreekLegalRoBERTa
par: Saketos, Vasileios, et autres
Publié: (2024)
par: Saketos, Vasileios, et autres
Publié: (2024)
RoBERTa-Augmented Synthesis for Detecting Malicious API Requests
par: Aharon, Udi, et autres
Publié: (2024)
par: Aharon, Udi, et autres
Publié: (2024)
"Is Hate Lost in Translation?": Evaluation of Multilingual LGBTQIA+ Hate Speech Detection
par: Chan, Fai Leui, et autres
Publié: (2024)
par: Chan, Fai Leui, et autres
Publié: (2024)
Hateful Person or Hateful Model? Investigating the Role of Personas in Hate Speech Detection by Large Language Models
par: Yuan, Shuzhou, et autres
Publié: (2025)
par: Yuan, Shuzhou, et autres
Publié: (2025)
NaijaHate: Evaluating Hate Speech Detection on Nigerian Twitter Using Representative Data
par: Tonneau, Manuel, et autres
Publié: (2024)
par: Tonneau, Manuel, et autres
Publié: (2024)
StressRoBERTa: Cross-Condition Transfer Learning from Depression, Anxiety, and PTSD to Stress Detection
par: Alqahtani, Amal, et autres
Publié: (2025)
par: Alqahtani, Amal, et autres
Publié: (2025)
VLAI: A RoBERTa-Based Model for Automated Vulnerability Severity Classification
par: Bonhomme, Cédric, et autres
Publié: (2025)
par: Bonhomme, Cédric, et autres
Publié: (2025)
Disagreeing Rationales: Rethinking Classification and Explainability Evaluation in Hate Speech Detection
par: Muscato, Benedetta, et autres
Publié: (2026)
par: Muscato, Benedetta, et autres
Publié: (2026)
Multi3Hate: Multimodal, Multilingual, and Multicultural Hate Speech Detection with Vision-Language Models
par: Bui, Minh Duc, et autres
Publié: (2024)
par: Bui, Minh Duc, et autres
Publié: (2024)
MasonPerplexity at Multimodal Hate Speech Event Detection 2024: Hate Speech and Target Detection Using Transformer Ensembles
par: Ganguly, Amrita, et autres
Publié: (2024)
par: Ganguly, Amrita, et autres
Publié: (2024)
Decoding Hate: Exploring Language Models' Reactions to Hate Speech
par: Piot, Paloma, et autres
Publié: (2024)
par: Piot, Paloma, et autres
Publié: (2024)
Detecting Anti-Semitic Hate Speech using Transformer-based Large Language Models
par: Liu, Dengyi, et autres
Publié: (2024)
par: Liu, Dengyi, et autres
Publié: (2024)
Compositional Generalisation for Explainable Hate Speech Detection
par: Calabrese, Agostina, et autres
Publié: (2025)
par: Calabrese, Agostina, et autres
Publié: (2025)
Documents similaires
-
Multiclass Hate Speech Detection with RoBERTa-OTA: Integrating Transformer Attention and Graph Convolutional Networks
par: Abusaqer, Mahmoud, et autres
Publié: (2026) -
RoBERTurk: Adjusting RoBERTa for Turkish
par: Tas, Nuri
Publié: (2024) -
Performance Evaluation of Emotion Classification in Japanese Using RoBERTa and DeBERTa
par: Takenaka, Yoichi
Publié: (2025) -
NER- RoBERTa: Fine-Tuning RoBERTa for Named Entity Recognition (NER) within low-resource languages
par: Abdullah, Abdulhady Abas, et autres
Publié: (2024) -
A RoBERTa-Based Functional Syntax Annotation Model for Chinese Texts
par: Xiaohui, Han, et autres
Publié: (2025)