MMBERT: Scaled Mixture-of-Experts Multimodal BERT for Robust Chinese Hate Speech Detection under Cloaking Perturbations
Fuente:
arXiv
Guardado en:
| Autores principales: | Xue, Qiyao, Dou, Yuchen, Shi, Ryan, Li, Xiang Lorraine, Gao, Wei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ToxiCloakCN: Evaluating Robustness of Offensive Language Detection in Chinese with Cloaking Perturbations
por: Xiao, Yunze, et al.
Publicado: (2024)
por: Xiao, Yunze, et al.
Publicado: (2024)
Breaking the Cloak! Unveiling Chinese Cloaked Toxicity with Homophone Graph and Toxic Lexicon
por: Ma, Xuchen, et al.
Publicado: (2025)
por: Ma, Xuchen, et al.
Publicado: (2025)
Feature Selection Empowered BERT for Detection of Hate Speech with Vocabulary Augmentation
por: Desai, Pritish N., et al.
Publicado: (2025)
por: Desai, Pritish N., et al.
Publicado: (2025)
Lost in Pronunciation: Detecting Chinese Offensive Language Disguised by Phonetic Cloaking Replacement
por: Guo, Haotan, et al.
Publicado: (2025)
por: Guo, Haotan, et al.
Publicado: (2025)
MasonPerplexity at Multimodal Hate Speech Event Detection 2024: Hate Speech and Target Detection Using Transformer Ensembles
por: Ganguly, Amrita, et al.
Publicado: (2024)
por: Ganguly, Amrita, et al.
Publicado: (2024)
Incorporating Human Explanations for Robust Hate Speech Detection
por: Chen, Jennifer L., et al.
Publicado: (2024)
por: Chen, Jennifer L., et al.
Publicado: (2024)
A Comprehensive Study on NLP Data Augmentation for Hate Speech Detection: Legacy Methods, BERT, and LLMs
por: Jahan, Md Saroar, et al.
Publicado: (2024)
por: Jahan, Md Saroar, et al.
Publicado: (2024)
Multi3Hate: Multimodal, Multilingual, and Multicultural Hate Speech Detection with Vision-Language Models
por: Bui, Minh Duc, et al.
Publicado: (2024)
por: Bui, Minh Duc, et al.
Publicado: (2024)
From BERT to Qwen: Hate Detection across architectures
por: Mon, Ariadna, et al.
Publicado: (2025)
por: Mon, Ariadna, et al.
Publicado: (2025)
NLPineers@ NLU of Devanagari Script Languages 2025: Hate Speech Detection using Ensembling of BERT-based models
por: Guragain, Anmol, et al.
Publicado: (2024)
por: Guragain, Anmol, et al.
Publicado: (2024)
Cracking the Code: Enhancing Implicit Hate Speech Detection through Coding Classification
por: Wei, Lu, et al.
Publicado: (2025)
por: Wei, Lu, et al.
Publicado: (2025)
An Effective, Robust and Fairness-aware Hate Speech Detection Framework
por: Mou, Guanyi, et al.
Publicado: (2024)
por: Mou, Guanyi, et al.
Publicado: (2024)
Leveraging LLMs for Context-Aware Implicit Textual and Multimodal Hate Speech Detection
por: Brook, Joshua Wolfe, et al.
Publicado: (2025)
por: Brook, Joshua Wolfe, et al.
Publicado: (2025)
"Is Hate Lost in Translation?": Evaluation of Multilingual LGBTQIA+ Hate Speech Detection
por: Chan, Fai Leui, et al.
Publicado: (2024)
por: Chan, Fai Leui, et al.
Publicado: (2024)
Demystifying Hateful Content: Leveraging Large Multimodal Models for Hateful Meme Detection with Explainable Decisions
por: Hee, Ming Shan, et al.
Publicado: (2025)
por: Hee, Ming Shan, et al.
Publicado: (2025)
Mixture of Neuron Experts
por: Cheng, Runxi, et al.
Publicado: (2025)
por: Cheng, Runxi, et al.
Publicado: (2025)
Hateful Person or Hateful Model? Investigating the Role of Personas in Hate Speech Detection by Large Language Models
por: Yuan, Shuzhou, et al.
Publicado: (2025)
por: Yuan, Shuzhou, et al.
Publicado: (2025)
Recent Advances in Hate Speech Moderation: Multimodality and the Role of Large Models
por: Hee, Ming Shan, et al.
Publicado: (2024)
por: Hee, Ming Shan, et al.
Publicado: (2024)
Advancing Hate Speech Detection with Transformers: Insights from the MetaHate
por: Chapagain, Santosh, et al.
Publicado: (2025)
por: Chapagain, Santosh, et al.
Publicado: (2025)
Compositional Generalisation for Explainable Hate Speech Detection
por: Calabrese, Agostina, et al.
Publicado: (2025)
por: Calabrese, Agostina, et al.
Publicado: (2025)
Automatic Textual Normalization for Hate Speech Detection
por: Nguyen, Anh Thi-Hoang, et al.
Publicado: (2023)
por: Nguyen, Anh Thi-Hoang, et al.
Publicado: (2023)
SAFE-MEME: Structured Reasoning Framework for Robust Hate Speech Detection in Memes
por: Nandi, Palash, et al.
Publicado: (2024)
por: Nandi, Palash, et al.
Publicado: (2024)
Unveiling Super Experts in Mixture-of-Experts Large Language Models
por: Su, Zunhai, et al.
Publicado: (2025)
por: Su, Zunhai, et al.
Publicado: (2025)
Robust Audiovisual Speech Recognition Models with Mixture-of-Experts
por: Wu, Yihan, et al.
Publicado: (2024)
por: Wu, Yihan, et al.
Publicado: (2024)
MetaHate: A Dataset for Unifying Efforts on Hate Speech Detection
por: Piot, Paloma, et al.
Publicado: (2024)
por: Piot, Paloma, et al.
Publicado: (2024)
When Hate Meets Facts: LLMs-in-the-Loop for Check-worthiness Detection in Hate Speech
por: Ocampo, Nicolás Benjamín, et al.
Publicado: (2026)
por: Ocampo, Nicolás Benjamín, et al.
Publicado: (2026)
NaijaHate: Evaluating Hate Speech Detection on Nigerian Twitter Using Representative Data
por: Tonneau, Manuel, et al.
Publicado: (2024)
por: Tonneau, Manuel, et al.
Publicado: (2024)
HatePrototypes: Interpretable and Transferable Representations for Implicit and Explicit Hate Speech Detection
por: Proskurina, Irina, et al.
Publicado: (2025)
por: Proskurina, Irina, et al.
Publicado: (2025)
Self-Explaining Hate Speech Detection with Moral Rationales
por: Vargas, Francielle, et al.
Publicado: (2026)
por: Vargas, Francielle, et al.
Publicado: (2026)
Hate Speech According to the Law: An Analysis for Effective Detection
por: Korre, Katerina, et al.
Publicado: (2024)
por: Korre, Katerina, et al.
Publicado: (2024)
Code-Mixed Telugu-English Hate Speech Detection
por: Kakarla, Santhosh, et al.
Publicado: (2025)
por: Kakarla, Santhosh, et al.
Publicado: (2025)
HateDebias: On the Diversity and Variability of Hate Speech Debiasing
por: Wu, Hongyan, et al.
Publicado: (2024)
por: Wu, Hongyan, et al.
Publicado: (2024)
cantnlp@DravidianLangTech2025: A Bag-of-Sounds Approach to Multimodal Hate Speech Detection
por: Wong, Sidney, et al.
Publicado: (2025)
por: Wong, Sidney, et al.
Publicado: (2025)
MHS-STMA: Multimodal Hate Speech Detection via Scalable Transformer-Based Multilevel Attention Framework
por: Chhabra, Anusha, et al.
Publicado: (2024)
por: Chhabra, Anusha, et al.
Publicado: (2024)
HateTinyLLM : Hate Speech Detection Using Tiny Large Language Models
por: Sen, Tanmay, et al.
Publicado: (2024)
por: Sen, Tanmay, et al.
Publicado: (2024)
More Than Sum of Its Parts: Deciphering Intent Shifts in Multimodal Hate Speech Detection
por: Sun, Runze, et al.
Publicado: (2026)
por: Sun, Runze, et al.
Publicado: (2026)
Fine-Grained Chinese Hate Speech Understanding: Span-Level Resources, Coded Term Lexicon, and Enhanced Detection Frameworks
por: Bai, Zewen, et al.
Publicado: (2025)
por: Bai, Zewen, et al.
Publicado: (2025)
STATE ToxiCN: A Benchmark for Span-level Target-Aware Toxicity Extraction in Chinese Hate Speech Detection
por: Bai, Zewen, et al.
Publicado: (2025)
por: Bai, Zewen, et al.
Publicado: (2025)
EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models
por: Jing, Linglin, et al.
Publicado: (2025)
por: Jing, Linglin, et al.
Publicado: (2025)
DeHate: A Stable Diffusion-based Multimodal Approach to Mitigate Hate Speech in Images
por: Dalal, Dwip, et al.
Publicado: (2025)
por: Dalal, Dwip, et al.
Publicado: (2025)
Ejemplares similares
-
ToxiCloakCN: Evaluating Robustness of Offensive Language Detection in Chinese with Cloaking Perturbations
por: Xiao, Yunze, et al.
Publicado: (2024) -
Breaking the Cloak! Unveiling Chinese Cloaked Toxicity with Homophone Graph and Toxic Lexicon
por: Ma, Xuchen, et al.
Publicado: (2025) -
Feature Selection Empowered BERT for Detection of Hate Speech with Vocabulary Augmentation
por: Desai, Pritish N., et al.
Publicado: (2025) -
Lost in Pronunciation: Detecting Chinese Offensive Language Disguised by Phonetic Cloaking Replacement
por: Guo, Haotan, et al.
Publicado: (2025) -
MasonPerplexity at Multimodal Hate Speech Event Detection 2024: Hate Speech and Target Detection Using Transformer Ensembles
por: Ganguly, Amrita, et al.
Publicado: (2024)