See, Explain, and Intervene: A Few-Shot Multimodal Agent Framework for Hateful Meme Moderation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rizwan, Naquee, Swain, Subhankar, Bhaskar, Paramananda, Aryan, Gagan, Khan, Shehryaar Shah, Mukherjee, Animesh |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FBHM: Functional Benchmarking and Steering of VLMs for Hateful Meme Detection
par: Bhaskar, Paramananda, et autres
Publié: (2026)
par: Bhaskar, Paramananda, et autres
Publié: (2026)
Exploring the Limits of Zero Shot Vision Language Models for Hate Meme Detection: The Vulnerabilities and their Interpretations
par: Rizwan, Naquee, et autres
Publié: (2024)
par: Rizwan, Naquee, et autres
Publié: (2024)
STEMTOX: From Social Tags to Fine-Grained Toxic Meme Detection via Entropy-Guided Multi-Task Learning
par: Swain, Subhankar, et autres
Publié: (2025)
par: Swain, Subhankar, et autres
Publié: (2025)
MemeSense: An Adaptive In-Context Framework for Social Commonsense Driven Meme Moderation
par: Adak, Sayantan, et autres
Publié: (2025)
par: Adak, Sayantan, et autres
Publié: (2025)
Modularized Networks for Few-shot Hateful Meme Detection
par: Cao, Rui, et autres
Publié: (2024)
par: Cao, Rui, et autres
Publié: (2024)
HatePRISM: Policies, Platforms, and Research Integration. Advancing NLP for Hate Speech Proactive Mitigation
par: Rizwan, Naquee, et autres
Publié: (2025)
par: Rizwan, Naquee, et autres
Publié: (2025)
Toxicity Begets Toxicity: Unraveling Conversational Chains in Political Podcasts
par: Rizwan, Naquee, et autres
Publié: (2025)
par: Rizwan, Naquee, et autres
Publié: (2025)
ExPO-HM: Learning to Explain-then-Detect for Hateful Meme Detection
par: Mei, Jingbiao, et autres
Publié: (2025)
par: Mei, Jingbiao, et autres
Publié: (2025)
Propaganda to Hate: A Multimodal Analysis of Arabic Memes with Multi-Agent LLMs
par: Alam, Firoj, et autres
Publié: (2024)
par: Alam, Firoj, et autres
Publié: (2024)
From Native Memes to Global Moderation: Cross-Cultural Evaluation of Vision-Language Models for Hateful Meme Detection
par: Wang, Mo, et autres
Publié: (2026)
par: Wang, Mo, et autres
Publié: (2026)
Deciphering Hate: Identifying Hateful Memes and Their Targets
par: Hossain, Eftekhar, et autres
Publié: (2024)
par: Hossain, Eftekhar, et autres
Publié: (2024)
Demarked: A Strategy for Enhanced Abusive Speech Moderation through Counterspeech, Detoxification, and Message Management
par: Yimam, Seid Muhie, et autres
Publié: (2024)
par: Yimam, Seid Muhie, et autres
Publié: (2024)
HateSieve: A Contrastive Learning Framework for Detecting and Segmenting Hateful Content in Multimodal Memes
par: Su, Xuanyu, et autres
Publié: (2024)
par: Su, Xuanyu, et autres
Publié: (2024)
Demystifying Hateful Content: Leveraging Large Multimodal Models for Hateful Meme Detection with Explainable Decisions
par: Hee, Ming Shan, et autres
Publié: (2025)
par: Hee, Ming Shan, et autres
Publié: (2025)
Detecting and Mitigating Hateful Content in Multimodal Memes with Vision-Language Models
par: Van, Minh-Hao, et autres
Publié: (2025)
par: Van, Minh-Hao, et autres
Publié: (2025)
MemeIntel: Explainable Detection of Propagandistic and Hateful Memes
par: Kmainasi, Mohamed Bayan, et autres
Publié: (2025)
par: Kmainasi, Mohamed Bayan, et autres
Publié: (2025)
GatedCLIP: Gated Multimodal Fusion for Hateful Memes Detection
par: Guo, Yingying, et autres
Publié: (2026)
par: Guo, Yingying, et autres
Publié: (2026)
SAFE-MEME: Structured Reasoning Framework for Robust Hate Speech Detection in Memes
par: Nandi, Palash, et autres
Publié: (2024)
par: Nandi, Palash, et autres
Publié: (2024)
Detecting Hate and Inflammatory Content in Bengali Memes: A New Multimodal Dataset and Co-Attention Framework
par: Ullah, Rakib, et autres
Publié: (2026)
par: Ullah, Rakib, et autres
Publié: (2026)
HateGPT: Unleashing GPT-3.5 Turbo to Combat Hate Speech on X
par: Deroy, Aniket, et autres
Publié: (2024)
par: Deroy, Aniket, et autres
Publié: (2024)
Improving Multimodal Hateful Meme Detection Exploiting LMM-Generated Knowledge
par: Tzelepi, Maria, et autres
Publié: (2025)
par: Tzelepi, Maria, et autres
Publié: (2025)
Evolver: Chain-of-Evolution Prompting to Boost Large Multimodal Models for Hateful Meme Detection
par: Huang, Jinfa, et autres
Publié: (2024)
par: Huang, Jinfa, et autres
Publié: (2024)
Robust Adaptation of Large Multimodal Models for Retrieval Augmented Hateful Meme Detection
par: Mei, Jingbiao, et autres
Publié: (2025)
par: Mei, Jingbiao, et autres
Publié: (2025)
Prompt-enhanced Network for Hateful Meme Classification
par: Liu, Junxi, et autres
Publié: (2024)
par: Liu, Junxi, et autres
Publié: (2024)
Retrieval Augmented Enhanced Dual Co-Attention Framework for Target Aware Multimodal Bengali Hateful Meme Detection
par: Tanvir, Raihan, et autres
Publié: (2026)
par: Tanvir, Raihan, et autres
Publié: (2026)
MemeCLIP: Leveraging CLIP Representations for Multimodal Meme Classification
par: Shah, Siddhant Bikram, et autres
Publié: (2024)
par: Shah, Siddhant Bikram, et autres
Publié: (2024)
MemeGuard: An LLM and VLM-based Framework for Advancing Content Moderation via Meme Intervention
par: Jha, Prince, et autres
Publié: (2024)
par: Jha, Prince, et autres
Publié: (2024)
Can Thinking Models Think to Detect Hateful Memes?
par: Kmainasi, Mohamed Bayan, et autres
Publié: (2026)
par: Kmainasi, Mohamed Bayan, et autres
Publié: (2026)
Judging by Appearances? Auditing and Intervening Vision-Language Models for Bail Prediction
par: Basu, Sagnik, et autres
Publié: (2025)
par: Basu, Sagnik, et autres
Publié: (2025)
Beyond Hate: Differentiating Uncivil and Intolerant Speech in Multimodal Content Moderation
par: Herrmann, Nils A., et autres
Publié: (2026)
par: Herrmann, Nils A., et autres
Publié: (2026)
Improving Hateful Meme Detection through Retrieval-Guided Contrastive Learning
par: Mei, Jingbiao, et autres
Publié: (2023)
par: Mei, Jingbiao, et autres
Publié: (2023)
Recent Advances in Hate Speech Moderation: Multimodality and the Role of Large Models
par: Hee, Ming Shan, et autres
Publié: (2024)
par: Hee, Ming Shan, et autres
Publié: (2024)
Towards Smarter Hiring: Are Zero-Shot and Few-Shot Pre-trained LLMs Ready for HR Spoken Interview Transcript Analysis?
par: Maity, Subhankar, et autres
Publié: (2025)
par: Maity, Subhankar, et autres
Publié: (2025)
HateModerate: Testing Hate Speech Detectors against Content Moderation Policies
par: Zheng, Jiangrui, et autres
Publié: (2023)
par: Zheng, Jiangrui, et autres
Publié: (2023)
OSPC: Artificial VLM Features for Hateful Meme Detection
par: Grönquist, Peter
Publié: (2024)
par: Grönquist, Peter
Publié: (2024)
STROKEVISION-BENCH: A Multimodal Video And 2D Pose Benchmark For Tracking Stroke Recovery
par: Robinson, David, et autres
Publié: (2025)
par: Robinson, David, et autres
Publié: (2025)
Causal Intersectionality and Dual Form of Gradient Descent for Multimodal Analysis: a Case Study on Hateful Memes
par: Miyanishi, Yosuke, et autres
Publié: (2023)
par: Miyanishi, Yosuke, et autres
Publié: (2023)
Few-shot Hate Speech Detection Based on the MindSpore Framework
par: Qin, Zhenkai, et autres
Publié: (2025)
par: Qin, Zhenkai, et autres
Publié: (2025)
Explainable Multimodal Sentiment Analysis on Bengali Memes
par: Elahi, Kazi Toufique, et autres
Publié: (2023)
par: Elahi, Kazi Toufique, et autres
Publié: (2023)
I Came, I Saw, I Explained: Benchmarking Multimodal LLMs on Figurative Meaning in Memes
par: Zhou, Shijia, et autres
Publié: (2026)
par: Zhou, Shijia, et autres
Publié: (2026)
Documents similaires
-
FBHM: Functional Benchmarking and Steering of VLMs for Hateful Meme Detection
par: Bhaskar, Paramananda, et autres
Publié: (2026) -
Exploring the Limits of Zero Shot Vision Language Models for Hate Meme Detection: The Vulnerabilities and their Interpretations
par: Rizwan, Naquee, et autres
Publié: (2024) -
STEMTOX: From Social Tags to Fine-Grained Toxic Meme Detection via Entropy-Guided Multi-Task Learning
par: Swain, Subhankar, et autres
Publié: (2025) -
MemeSense: An Adaptive In-Context Framework for Social Commonsense Driven Meme Moderation
par: Adak, Sayantan, et autres
Publié: (2025) -
Modularized Networks for Few-shot Hateful Meme Detection
par: Cao, Rui, et autres
Publié: (2024)