Exploring the Limits of Zero Shot Vision Language Models for Hate Meme Detection: The Vulnerabilities and their Interpretations
Fuente:
arXiv
Guardado en:
| Autores principales: | Rizwan, Naquee, Bhaskar, Paramananda, Das, Mithun, Majhi, Swadhin Satyaprakash, Saha, Punyajoy, Mukherjee, Animesh |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FBHM: Functional Benchmarking and Steering of VLMs for Hateful Meme Detection
por: Bhaskar, Paramananda, et al.
Publicado: (2026)
por: Bhaskar, Paramananda, et al.
Publicado: (2026)
See, Explain, and Intervene: A Few-Shot Multimodal Agent Framework for Hateful Meme Moderation
por: Rizwan, Naquee, et al.
Publicado: (2026)
por: Rizwan, Naquee, et al.
Publicado: (2026)
STEMTOX: From Social Tags to Fine-Grained Toxic Meme Detection via Entropy-Guided Multi-Task Learning
por: Swain, Subhankar, et al.
Publicado: (2025)
por: Swain, Subhankar, et al.
Publicado: (2025)
Low-Resource Counterspeech Generation for Indic Languages: The Case of Bengali and Hindi
por: Das, Mithun, et al.
Publicado: (2024)
por: Das, Mithun, et al.
Publicado: (2024)
On Zero-Shot Counterspeech Generation by LLMs
por: Saha, Punyajoy, et al.
Publicado: (2024)
por: Saha, Punyajoy, et al.
Publicado: (2024)
HatePRISM: Policies, Platforms, and Research Integration. Advancing NLP for Hate Speech Proactive Mitigation
por: Rizwan, Naquee, et al.
Publicado: (2025)
por: Rizwan, Naquee, et al.
Publicado: (2025)
CrowdCounter: A benchmark type-specific multi-target counterspeech dataset
por: Saha, Punyajoy, et al.
Publicado: (2024)
por: Saha, Punyajoy, et al.
Publicado: (2024)
InfFeed: Influence Functions as a Feedback to Improve the Performance of Subjective Tasks
por: Banerjee, Somnath, et al.
Publicado: (2024)
por: Banerjee, Somnath, et al.
Publicado: (2024)
Demarked: A Strategy for Enhanced Abusive Speech Moderation through Counterspeech, Detoxification, and Message Management
por: Yimam, Seid Muhie, et al.
Publicado: (2024)
por: Yimam, Seid Muhie, et al.
Publicado: (2024)
Detecting and Mitigating Hateful Content in Multimodal Memes with Vision-Language Models
por: Van, Minh-Hao, et al.
Publicado: (2025)
por: Van, Minh-Hao, et al.
Publicado: (2025)
Toxicity Begets Toxicity: Unraveling Conversational Chains in Political Podcasts
por: Rizwan, Naquee, et al.
Publicado: (2025)
por: Rizwan, Naquee, et al.
Publicado: (2025)
MemeIntel: Explainable Detection of Propagandistic and Hateful Memes
por: Kmainasi, Mohamed Bayan, et al.
Publicado: (2025)
por: Kmainasi, Mohamed Bayan, et al.
Publicado: (2025)
Modularized Networks for Few-shot Hateful Meme Detection
por: Cao, Rui, et al.
Publicado: (2024)
por: Cao, Rui, et al.
Publicado: (2024)
Deciphering Hate: Identifying Hateful Memes and Their Targets
por: Hossain, Eftekhar, et al.
Publicado: (2024)
por: Hossain, Eftekhar, et al.
Publicado: (2024)
From Native Memes to Global Moderation: Cross-Cultural Evaluation of Vision-Language Models for Hateful Meme Detection
por: Wang, Mo, et al.
Publicado: (2026)
por: Wang, Mo, et al.
Publicado: (2026)
MemeSense: An Adaptive In-Context Framework for Social Commonsense Driven Meme Moderation
por: Adak, Sayantan, et al.
Publicado: (2025)
por: Adak, Sayantan, et al.
Publicado: (2025)
Can Thinking Models Think to Detect Hateful Memes?
por: Kmainasi, Mohamed Bayan, et al.
Publicado: (2026)
por: Kmainasi, Mohamed Bayan, et al.
Publicado: (2026)
ExPO-HM: Learning to Explain-then-Detect for Hateful Meme Detection
por: Mei, Jingbiao, et al.
Publicado: (2025)
por: Mei, Jingbiao, et al.
Publicado: (2025)
Improving Hateful Meme Detection through Retrieval-Guided Contrastive Learning
por: Mei, Jingbiao, et al.
Publicado: (2023)
por: Mei, Jingbiao, et al.
Publicado: (2023)
Demystifying Hateful Content: Leveraging Large Multimodal Models for Hateful Meme Detection with Explainable Decisions
por: Hee, Ming Shan, et al.
Publicado: (2025)
por: Hee, Ming Shan, et al.
Publicado: (2025)
SAFE-MEME: Structured Reasoning Framework for Robust Hate Speech Detection in Memes
por: Nandi, Palash, et al.
Publicado: (2024)
por: Nandi, Palash, et al.
Publicado: (2024)
OSPC: Artificial VLM Features for Hateful Meme Detection
por: Grönquist, Peter
Publicado: (2024)
por: Grönquist, Peter
Publicado: (2024)
GatedCLIP: Gated Multimodal Fusion for Hateful Memes Detection
por: Guo, Yingying, et al.
Publicado: (2026)
por: Guo, Yingying, et al.
Publicado: (2026)
Prompt-enhanced Network for Hateful Meme Classification
por: Liu, Junxi, et al.
Publicado: (2024)
por: Liu, Junxi, et al.
Publicado: (2024)
Analysis and Detection of Multilingual Hate Speech Using Transformer Based Deep Learning
por: Das, Arijit, et al.
Publicado: (2024)
por: Das, Arijit, et al.
Publicado: (2024)
Evolver: Chain-of-Evolution Prompting to Boost Large Multimodal Models for Hateful Meme Detection
por: Huang, Jinfa, et al.
Publicado: (2024)
por: Huang, Jinfa, et al.
Publicado: (2024)
Improving Multimodal Hateful Meme Detection Exploiting LMM-Generated Knowledge
por: Tzelepi, Maria, et al.
Publicado: (2025)
por: Tzelepi, Maria, et al.
Publicado: (2025)
Robust Adaptation of Large Multimodal Models for Retrieval Augmented Hateful Meme Detection
por: Mei, Jingbiao, et al.
Publicado: (2025)
por: Mei, Jingbiao, et al.
Publicado: (2025)
Can Safety Emerge from Weak Supervision? A Systematic Analysis of Small Language Models
por: Saha, Punyajoy, et al.
Publicado: (2026)
por: Saha, Punyajoy, et al.
Publicado: (2026)
HateSieve: A Contrastive Learning Framework for Detecting and Segmenting Hateful Content in Multimodal Memes
por: Su, Xuanyu, et al.
Publicado: (2024)
por: Su, Xuanyu, et al.
Publicado: (2024)
MemeScouts@LT-EDI 2026: Asking the Right Questions -- Prompted Weak Supervision for Meme Hate Speech Detection
por: Bueno, Ivo, et al.
Publicado: (2026)
por: Bueno, Ivo, et al.
Publicado: (2026)
MsEdF: A Multi-stream Encoder-decoder Framework for Remote Sensing Image Captioning
por: Das, Swadhin, et al.
Publicado: (2025)
por: Das, Swadhin, et al.
Publicado: (2025)
Interpretable Zero-Shot Learning with Locally-Aligned Vision-Language Model
por: Chen, Shiming, et al.
Publicado: (2025)
por: Chen, Shiming, et al.
Publicado: (2025)
HateTinyLLM : Hate Speech Detection Using Tiny Large Language Models
por: Sen, Tanmay, et al.
Publicado: (2024)
por: Sen, Tanmay, et al.
Publicado: (2024)
Detecting and Understanding Hateful Contents in Memes Through Captioning and Visual Question-Answering
por: Anaissi, Ali, et al.
Publicado: (2025)
por: Anaissi, Ali, et al.
Publicado: (2025)
JSSFF: A Joint Structural-Semantic Fusion Framework for Remote Sensing Image Captioning
por: Das, Swadhin, et al.
Publicado: (2026)
por: Das, Swadhin, et al.
Publicado: (2026)
Text or Image? What is More Important in Cross-Domain Generalization Capabilities of Hate Meme Detection Models?
por: Aggarwal, Piush, et al.
Publicado: (2024)
por: Aggarwal, Piush, et al.
Publicado: (2024)
Multi3Hate: Multimodal, Multilingual, and Multicultural Hate Speech Detection with Vision-Language Models
por: Bui, Minh Duc, et al.
Publicado: (2024)
por: Bui, Minh Duc, et al.
Publicado: (2024)
Detecting Hate and Inflammatory Content in Bengali Memes: A New Multimodal Dataset and Co-Attention Framework
por: Ullah, Rakib, et al.
Publicado: (2026)
por: Ullah, Rakib, et al.
Publicado: (2026)
Beyond Meme Templates: Limitations of Visual Similarity Measures in Meme Matching
por: Hazman, Muzhaffar, et al.
Publicado: (2025)
por: Hazman, Muzhaffar, et al.
Publicado: (2025)
Ejemplares similares
-
FBHM: Functional Benchmarking and Steering of VLMs for Hateful Meme Detection
por: Bhaskar, Paramananda, et al.
Publicado: (2026) -
See, Explain, and Intervene: A Few-Shot Multimodal Agent Framework for Hateful Meme Moderation
por: Rizwan, Naquee, et al.
Publicado: (2026) -
STEMTOX: From Social Tags to Fine-Grained Toxic Meme Detection via Entropy-Guided Multi-Task Learning
por: Swain, Subhankar, et al.
Publicado: (2025) -
Low-Resource Counterspeech Generation for Indic Languages: The Case of Bengali and Hindi
por: Das, Mithun, et al.
Publicado: (2024) -
On Zero-Shot Counterspeech Generation by LLMs
por: Saha, Punyajoy, et al.
Publicado: (2024)