M-QUEST -- Meme Question-Understanding Evaluation on Semantics and Toxicity
Fuente:
arXiv
Guardado en:
| Autores principales: | De Giorgis, Stefano, Chen, Ting-Chih, Ilievski, Filip |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SemEval-2024 Task 9: BRAINTEASER: A Novel Task Defying Common Sense
por: Jiang, Yifan, et al.
Publicado: (2024)
por: Jiang, Yifan, et al.
Publicado: (2024)
Enhancing Structural Mapping with LLM-derived Abstractions for Analogical Reasoning in Narratives
por: Khojasteh, Mohammadhossein, et al.
Publicado: (2026)
por: Khojasteh, Mohammadhossein, et al.
Publicado: (2026)
Clustering Internet Memes Through Template Matching and Multi-Dimensional Similarity
por: Bloem, Tygo, et al.
Publicado: (2025)
por: Bloem, Tygo, et al.
Publicado: (2025)
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
por: Wang, Zhanliang, et al.
Publicado: (2026)
por: Wang, Zhanliang, et al.
Publicado: (2026)
OSPC: Artificial VLM Features for Hateful Meme Detection
por: Grönquist, Peter
Publicado: (2024)
por: Grönquist, Peter
Publicado: (2024)
Augmenting Math Word Problems via Iterative Question Composing
por: Liu, Haoxiong, et al.
Publicado: (2024)
por: Liu, Haoxiong, et al.
Publicado: (2024)
ASTRA: Adaptive Semantic Tree Reasoning Architecture for Complex Table Question Answering
por: Guo, Xiaoke, et al.
Publicado: (2026)
por: Guo, Xiaoke, et al.
Publicado: (2026)
Analyzing Persuasive Strategies in Meme Texts: A Fusion of Language Models with Paraphrase Enrichment
por: Nayak, Kota Shamanth Ramanath, et al.
Publicado: (2024)
por: Nayak, Kota Shamanth Ramanath, et al.
Publicado: (2024)
Emergent Semantic Role Understanding in Language Models
por: Griffiths, Carla, et al.
Publicado: (2026)
por: Griffiths, Carla, et al.
Publicado: (2026)
IITK at SemEval-2024 Task 4: Hierarchical Embeddings for Detection of Persuasion Techniques in Memes
por: Chikoti, Shreenaga, et al.
Publicado: (2024)
por: Chikoti, Shreenaga, et al.
Publicado: (2024)
Detecting Hope, Hate, and Emotion in Arabic Textual Speech and Multi-modal Memes Using Large Language Models
por: AlDahoul, Nouar, et al.
Publicado: (2025)
por: AlDahoul, Nouar, et al.
Publicado: (2025)
A Dataset for Evaluating LLM-based Evaluation Functions for Research Question Extraction Task
por: Fujisaki, Yuya, et al.
Publicado: (2024)
por: Fujisaki, Yuya, et al.
Publicado: (2024)
SENSE: Semantic Embedding Navigation with Soft-gated Evaluation for Retrieval-based Speculative Decoding
por: Chen, Shaowen, et al.
Publicado: (2026)
por: Chen, Shaowen, et al.
Publicado: (2026)
Beyond Independent Passages: Adaptive Passage Combination Retrieval for Retrieval Augmented Open-Domain Question Answering
por: Ko, Ting-Wen, et al.
Publicado: (2025)
por: Ko, Ting-Wen, et al.
Publicado: (2025)
Explainable Multimodal Sentiment Analysis on Bengali Memes
por: Elahi, Kazi Toufique, et al.
Publicado: (2023)
por: Elahi, Kazi Toufique, et al.
Publicado: (2023)
One Swallow Does Not Make a Summer: Understanding Semantic Structures in Embedding Spaces
por: Sun, Yandong, et al.
Publicado: (2025)
por: Sun, Yandong, et al.
Publicado: (2025)
Beyond Semantic Similarity: A Component-Wise Evaluation Framework for Medical Question Answering Systems with Health Equity Implications
por: Sakib, Abu Noman Md, et al.
Publicado: (2026)
por: Sakib, Abu Noman Md, et al.
Publicado: (2026)
Investigating the Robustness of Deductive Reasoning with Large Language Models
por: Hoppe, Fabian, et al.
Publicado: (2025)
por: Hoppe, Fabian, et al.
Publicado: (2025)
Collapse of Irrelevant Representations (CIR) Ensures Robust and Non-Disruptive LLM Unlearning
por: Sondej, Filip, et al.
Publicado: (2025)
por: Sondej, Filip, et al.
Publicado: (2025)
Robust Adaptation of Large Multimodal Models for Retrieval Augmented Hateful Meme Detection
por: Mei, Jingbiao, et al.
Publicado: (2025)
por: Mei, Jingbiao, et al.
Publicado: (2025)
Text2Freq: Learning Series Patterns from Text via Frequency Domain
por: Lo, Ming-Chih, et al.
Publicado: (2024)
por: Lo, Ming-Chih, et al.
Publicado: (2024)
A Large-Scale Benchmark for Evaluating Large Language Models on Medical Question Answering in Romanian
por: Rogoz, Ana-Cristina, et al.
Publicado: (2025)
por: Rogoz, Ana-Cristina, et al.
Publicado: (2025)
TopBench: A Benchmark for Implicit Prediction and Reasoning over Tabular Question Answering
por: Ji, An-Yang, et al.
Publicado: (2026)
por: Ji, An-Yang, et al.
Publicado: (2026)
Evaluating LLM Understanding via Structured Tabular Decision Simulations
por: Li, Sichao, et al.
Publicado: (2025)
por: Li, Sichao, et al.
Publicado: (2025)
Towards Detecting Contextual Real-Time Toxicity for In-Game Chat
por: Yang, Zachary, et al.
Publicado: (2023)
por: Yang, Zachary, et al.
Publicado: (2023)
Just KIDDIN: Knowledge Infusion and Distillation for Detection of INdecent Memes
por: Garg, Rahul, et al.
Publicado: (2024)
por: Garg, Rahul, et al.
Publicado: (2024)
On the Limitations of Rank-One Model Editing in Answering Multi-hop Questions
por: He, Zhiyuan, et al.
Publicado: (2026)
por: He, Zhiyuan, et al.
Publicado: (2026)
Temporal Knowledge Graph Question Answering: A Survey
por: Su, Miao, et al.
Publicado: (2024)
por: Su, Miao, et al.
Publicado: (2024)
Tree Matching Networks for Natural Language Inference: Parameter-Efficient Semantic Understanding via Dependency Parse Trees
por: Lunder, Jason
Publicado: (2025)
por: Lunder, Jason
Publicado: (2025)
iQUEST: An Iterative Question-Guided Framework for Knowledge Base Question Answering
por: Wang, Shuai, et al.
Publicado: (2025)
por: Wang, Shuai, et al.
Publicado: (2025)
Toxicity Detection Should Measure Contextual Harm, Not Text-Intrinsic Badness
por: Berezin, Sergei, et al.
Publicado: (2025)
por: Berezin, Sergei, et al.
Publicado: (2025)
ReConcile: Round-Table Conference Improves Reasoning via Consensus among Diverse LLMs
por: Chen, Justin Chih-Yao, et al.
Publicado: (2023)
por: Chen, Justin Chih-Yao, et al.
Publicado: (2023)
Multi-Turn Multi-Modal Question Clarification for Enhanced Conversational Understanding
por: Ramezan, Kimia, et al.
Publicado: (2025)
por: Ramezan, Kimia, et al.
Publicado: (2025)
Synthetic Multimodal Question Generation
por: Wu, Ian, et al.
Publicado: (2024)
por: Wu, Ian, et al.
Publicado: (2024)
When Answers Stray from Questions: Hallucination Detection via Question-Answer Orthogonal Decomposition
por: Yao, Siyang, et al.
Publicado: (2026)
por: Yao, Siyang, et al.
Publicado: (2026)
Examining LLMs' Uncertainty Expression Towards Questions Outside Parametric Knowledge
por: Liu, Genglin, et al.
Publicado: (2023)
por: Liu, Genglin, et al.
Publicado: (2023)
Where Does Toxicity Live? Mechanistic Localization and Targeted Suppression in Language Models
por: Beniwal, Himanshu, et al.
Publicado: (2026)
por: Beniwal, Himanshu, et al.
Publicado: (2026)
Characterizing Large Language Model Geometry Helps Solve Toxicity Detection and Generation
por: Balestriero, Randall, et al.
Publicado: (2023)
por: Balestriero, Randall, et al.
Publicado: (2023)
Rephrase and Respond: Let Large Language Models Ask Better Questions for Themselves
por: Deng, Yihe, et al.
Publicado: (2023)
por: Deng, Yihe, et al.
Publicado: (2023)
AQAScore: Evaluating Semantic Alignment in Text-to-Audio Generation via Audio Question Answering
por: Kuan, Chun-Yi, et al.
Publicado: (2026)
por: Kuan, Chun-Yi, et al.
Publicado: (2026)
Ejemplares similares
-
SemEval-2024 Task 9: BRAINTEASER: A Novel Task Defying Common Sense
por: Jiang, Yifan, et al.
Publicado: (2024) -
Enhancing Structural Mapping with LLM-derived Abstractions for Analogical Reasoning in Narratives
por: Khojasteh, Mohammadhossein, et al.
Publicado: (2026) -
Clustering Internet Memes Through Template Matching and Multi-Dimensional Similarity
por: Bloem, Tygo, et al.
Publicado: (2025) -
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
por: Wang, Zhanliang, et al.
Publicado: (2026) -
OSPC: Artificial VLM Features for Hateful Meme Detection
por: Grönquist, Peter
Publicado: (2024)