Demystifying Hateful Content: Leveraging Large Multimodal Models for Hateful Meme Detection with Explainable Decisions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hee, Ming Shan, Lee, Roy Ka-Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Modularized Networks for Few-shot Hateful Meme Detection
par: Cao, Rui, et autres
Publié: (2024)
par: Cao, Rui, et autres
Publié: (2024)
Recent Advances in Hate Speech Moderation: Multimodality and the Role of Large Models
par: Hee, Ming Shan, et autres
Publié: (2024)
par: Hee, Ming Shan, et autres
Publié: (2024)
Bridging Modalities: Enhancing Cross-Modality Hate Speech Detection with Few-Shot In-Context Learning
par: Hee, Ming Shan, et autres
Publié: (2024)
par: Hee, Ming Shan, et autres
Publié: (2024)
Detecting and Mitigating Hateful Content in Multimodal Memes with Vision-Language Models
par: Van, Minh-Hao, et autres
Publié: (2025)
par: Van, Minh-Hao, et autres
Publié: (2025)
MemeIntel: Explainable Detection of Propagandistic and Hateful Memes
par: Kmainasi, Mohamed Bayan, et autres
Publié: (2025)
par: Kmainasi, Mohamed Bayan, et autres
Publié: (2025)
SGHateCheck: Functional Tests for Detecting Hate Speech in Low-Resource Languages of Singapore
par: Ng, Ri Chi, et autres
Publié: (2024)
par: Ng, Ri Chi, et autres
Publié: (2024)
HateSieve: A Contrastive Learning Framework for Detecting and Segmenting Hateful Content in Multimodal Memes
par: Su, Xuanyu, et autres
Publié: (2024)
par: Su, Xuanyu, et autres
Publié: (2024)
HateXScore: A Metric Suite for Evaluating Reasoning Quality in Hate Speech Explanations
par: Hu, Yujia, et autres
Publié: (2026)
par: Hu, Yujia, et autres
Publié: (2026)
Deciphering Hate: Identifying Hateful Memes and Their Targets
par: Hossain, Eftekhar, et autres
Publié: (2024)
par: Hossain, Eftekhar, et autres
Publié: (2024)
Evolver: Chain-of-Evolution Prompting to Boost Large Multimodal Models for Hateful Meme Detection
par: Huang, Jinfa, et autres
Publié: (2024)
par: Huang, Jinfa, et autres
Publié: (2024)
Can Thinking Models Think to Detect Hateful Memes?
par: Kmainasi, Mohamed Bayan, et autres
Publié: (2026)
par: Kmainasi, Mohamed Bayan, et autres
Publié: (2026)
Robust Adaptation of Large Multimodal Models for Retrieval Augmented Hateful Meme Detection
par: Mei, Jingbiao, et autres
Publié: (2025)
par: Mei, Jingbiao, et autres
Publié: (2025)
Detecting Hate and Inflammatory Content in Bengali Memes: A New Multimodal Dataset and Co-Attention Framework
par: Ullah, Rakib, et autres
Publié: (2026)
par: Ullah, Rakib, et autres
Publié: (2026)
Prompt-enhanced Network for Hateful Meme Classification
par: Liu, Junxi, et autres
Publié: (2024)
par: Liu, Junxi, et autres
Publié: (2024)
ExPO-HM: Learning to Explain-then-Detect for Hateful Meme Detection
par: Mei, Jingbiao, et autres
Publié: (2025)
par: Mei, Jingbiao, et autres
Publié: (2025)
Leveraging Argument Structure to Predict Content Hatefulness
par: Ocampo, Nicolás Benjamín, et autres
Publié: (2026)
par: Ocampo, Nicolás Benjamín, et autres
Publié: (2026)
Hateful Person or Hateful Model? Investigating the Role of Personas in Hate Speech Detection by Large Language Models
par: Yuan, Shuzhou, et autres
Publié: (2025)
par: Yuan, Shuzhou, et autres
Publié: (2025)
OSPC: Artificial VLM Features for Hateful Meme Detection
par: Grönquist, Peter
Publié: (2024)
par: Grönquist, Peter
Publié: (2024)
MemeCraft: Contextual and Stance-Driven Multimodal Meme Generation
par: Wang, Han, et autres
Publié: (2024)
par: Wang, Han, et autres
Publié: (2024)
Cross-Modal Transfer from Memes to Videos: Addressing Data Scarcity in Hateful Video Detection
par: Wang, Han, et autres
Publié: (2025)
par: Wang, Han, et autres
Publié: (2025)
FBHM: Functional Benchmarking and Steering of VLMs for Hateful Meme Detection
par: Bhaskar, Paramananda, et autres
Publié: (2026)
par: Bhaskar, Paramananda, et autres
Publié: (2026)
Improving Hateful Meme Detection through Retrieval-Guided Contrastive Learning
par: Mei, Jingbiao, et autres
Publié: (2023)
par: Mei, Jingbiao, et autres
Publié: (2023)
Compositional Generalisation for Explainable Hate Speech Detection
par: Calabrese, Agostina, et autres
Publié: (2025)
par: Calabrese, Agostina, et autres
Publié: (2025)
SEAHateCheck: Functional Tests for Detecting Hate Speech in Low-Resource Languages of Southeast Asia
par: Ng, Ri Chi, et autres
Publié: (2026)
par: Ng, Ri Chi, et autres
Publié: (2026)
SAFE-MEME: Structured Reasoning Framework for Robust Hate Speech Detection in Memes
par: Nandi, Palash, et autres
Publié: (2024)
par: Nandi, Palash, et autres
Publié: (2024)
An Investigation Into Explainable Audio Hate Speech Detection
par: An, Jinmyeong, et autres
Publié: (2024)
par: An, Jinmyeong, et autres
Publié: (2024)
Multi3Hate: Multimodal, Multilingual, and Multicultural Hate Speech Detection with Vision-Language Models
par: Bui, Minh Duc, et autres
Publié: (2024)
par: Bui, Minh Duc, et autres
Publié: (2024)
Retrieval Augmented Enhanced Dual Co-Attention Framework for Target Aware Multimodal Bengali Hateful Meme Detection
par: Tanvir, Raihan, et autres
Publié: (2026)
par: Tanvir, Raihan, et autres
Publié: (2026)
Leveraging LLMs for Context-Aware Implicit Textual and Multimodal Hate Speech Detection
par: Brook, Joshua Wolfe, et autres
Publié: (2025)
par: Brook, Joshua Wolfe, et autres
Publié: (2025)
HateModerate: Testing Hate Speech Detectors against Content Moderation Policies
par: Zheng, Jiangrui, et autres
Publié: (2023)
par: Zheng, Jiangrui, et autres
Publié: (2023)
HateTinyLLM : Hate Speech Detection Using Tiny Large Language Models
par: Sen, Tanmay, et autres
Publié: (2024)
par: Sen, Tanmay, et autres
Publié: (2024)
Towards Efficient and Explainable Hate Speech Detection via Model Distillation
par: Piot, Paloma, et autres
Publié: (2024)
par: Piot, Paloma, et autres
Publié: (2024)
MEME-Fusion@CHiPSAL 2026: Multimodal Ablation Study of Hate Detection and Sentiment Analysis on Nepali Memes
par: Wagle, Samir, et autres
Publié: (2026)
par: Wagle, Samir, et autres
Publié: (2026)
See, Explain, and Intervene: A Few-Shot Multimodal Agent Framework for Hateful Meme Moderation
par: Rizwan, Naquee, et autres
Publié: (2026)
par: Rizwan, Naquee, et autres
Publié: (2026)
Align before Attend: Aligning Visual and Textual Features for Multimodal Hateful Content Detection
par: Hossain, Eftekhar, et autres
Publié: (2024)
par: Hossain, Eftekhar, et autres
Publié: (2024)
MemeScouts@LT-EDI 2026: Asking the Right Questions -- Prompted Weak Supervision for Meme Hate Speech Detection
par: Bueno, Ivo, et autres
Publié: (2026)
par: Bueno, Ivo, et autres
Publié: (2026)
Detecting Hope, Hate, and Emotion in Arabic Textual Speech and Multi-modal Memes Using Large Language Models
par: AlDahoul, Nouar, et autres
Publié: (2025)
par: AlDahoul, Nouar, et autres
Publié: (2025)
Exploring the Limits of Zero Shot Vision Language Models for Hate Meme Detection: The Vulnerabilities and their Interpretations
par: Rizwan, Naquee, et autres
Publié: (2024)
par: Rizwan, Naquee, et autres
Publié: (2024)
MasonPerplexity at Multimodal Hate Speech Event Detection 2024: Hate Speech and Target Detection Using Transformer Ensembles
par: Ganguly, Amrita, et autres
Publié: (2024)
par: Ganguly, Amrita, et autres
Publié: (2024)
AmpleHate: Amplifying the Attention for Versatile Implicit Hate Detection
par: Lee, Yejin, et autres
Publié: (2025)
par: Lee, Yejin, et autres
Publié: (2025)
Documents similaires
-
Modularized Networks for Few-shot Hateful Meme Detection
par: Cao, Rui, et autres
Publié: (2024) -
Recent Advances in Hate Speech Moderation: Multimodality and the Role of Large Models
par: Hee, Ming Shan, et autres
Publié: (2024) -
Bridging Modalities: Enhancing Cross-Modality Hate Speech Detection with Few-Shot In-Context Learning
par: Hee, Ming Shan, et autres
Publié: (2024) -
Detecting and Mitigating Hateful Content in Multimodal Memes with Vision-Language Models
par: Van, Minh-Hao, et autres
Publié: (2025) -
MemeIntel: Explainable Detection of Propagandistic and Hateful Memes
par: Kmainasi, Mohamed Bayan, et autres
Publié: (2025)