Retrieval Augmented Verification for Zero-Shot Detection of Multimodal Disinformation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dey, Arka Ujjal, Llabrés, Artemis, Valveny, Ernest, Karatzas, Dimosthenis |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Image-text matching for large-scale book collections
par: Llabrés, Artemis, et autres
Publié: (2024)
par: Llabrés, Artemis, et autres
Publié: (2024)
Enhancing Document VQA Models via Retrieval-Augmented Generation
par: López, Eric, et autres
Publié: (2025)
par: López, Eric, et autres
Publié: (2025)
Fact-Checking with Contextual Narratives: Leveraging Retrieval-Augmented LLMs for Social Media Analysis
par: Dey, Arka Ujjal, et autres
Publié: (2025)
par: Dey, Arka Ujjal, et autres
Publié: (2025)
ComicsPAP: understanding comic strips by picking the correct panel
par: Vivoli, Emanuele, et autres
Publié: (2025)
par: Vivoli, Emanuele, et autres
Publié: (2025)
CoSMo: A Multimodal Transformer for Page Stream Segmentation in Comic Books
par: Ortega, Marc Serra, et autres
Publié: (2025)
par: Ortega, Marc Serra, et autres
Publié: (2025)
Retrieval-Augmented Multimodal Model for Fake News Detection
par: Li, Yiheng, et autres
Publié: (2026)
par: Li, Yiheng, et autres
Publié: (2026)
Hyperbolic Multimodal Generative Representation Learning for Generalized Zero-Shot Multimodal Information Extraction
par: Zhou, Baohang, et autres
Publié: (2026)
par: Zhou, Baohang, et autres
Publié: (2026)
Multimodal Graph-Based Variational Mixture of Experts Network for Zero-Shot Multimodal Information Extraction
par: Zhou, Baohang, et autres
Publié: (2025)
par: Zhou, Baohang, et autres
Publié: (2025)
Multimodal Transformer for Comics Text-Cloze
par: Vivoli, Emanuele, et autres
Publié: (2024)
par: Vivoli, Emanuele, et autres
Publié: (2024)
MM-InstructEval: Zero-Shot Evaluation of (Multimodal) Large Language Models on Multimodal Reasoning Tasks
par: Yang, Xiaocui, et autres
Publié: (2024)
par: Yang, Xiaocui, et autres
Publié: (2024)
Multi-Page Document Visual Question Answering using Self-Attention Scoring Mechanism
par: Kang, Lei, et autres
Publié: (2024)
par: Kang, Lei, et autres
Publié: (2024)
Zero-Shot Relational Learning for Multimodal Knowledge Graphs
par: Cai, Rui, et autres
Publié: (2024)
par: Cai, Rui, et autres
Publié: (2024)
Towards Multimodal Sentiment Analysis via Contrastive Cross-modal Retrieval Augmentation and Hierachical Prompts
par: Zhao, Xianbing, et autres
Publié: (2025)
par: Zhao, Xianbing, et autres
Publié: (2025)
Zero-Shot Visual Grounding in 3D Gaussians via View Retrieval
par: Liao, Liwei, et autres
Publié: (2025)
par: Liao, Liwei, et autres
Publié: (2025)
Fine-grained Textual Inversion Network for Zero-Shot Composed Image Retrieval
par: Lin, Haoqiang, et autres
Publié: (2025)
par: Lin, Haoqiang, et autres
Publié: (2025)
A New Hybrid Intelligent Approach for Multimodal Detection of Suspected Disinformation on TikTok
par: Guerrero-Sosa, Jared D. T., et autres
Publié: (2025)
par: Guerrero-Sosa, Jared D. T., et autres
Publié: (2025)
RA-BLIP: Multimodal Adaptive Retrieval-Augmented Bootstrapping Language-Image Pre-training
par: Ding, Muhe, et autres
Publié: (2024)
par: Ding, Muhe, et autres
Publié: (2024)
Semantic Compensation via Adversarial Removal for Robust Zero-Shot ECG Diagnosis
par: Liu, Hongjun, et autres
Publié: (2026)
par: Liu, Hongjun, et autres
Publié: (2026)
Multi-source Knowledge Enhanced Graph Attention Networks for Multimodal Fact Verification
par: Cao, Han, et autres
Publié: (2024)
par: Cao, Han, et autres
Publié: (2024)
Fact-Checking at Scale: Multimodal AI for Authenticity and Context Verification in Online Media
par: Phan, Van-Hoang, et autres
Publié: (2025)
par: Phan, Van-Hoang, et autres
Publié: (2025)
Scaling Prompt Instructed Zero Shot Composed Image Retrieval with Image-Only Data
par: Duan, Yiqun, et autres
Publié: (2025)
par: Duan, Yiqun, et autres
Publié: (2025)
UniCVR: From Alignment to Reranking for Unified Zero-Shot Composed Visual Retrieval
par: Wen, Haokun, et autres
Publié: (2026)
par: Wen, Haokun, et autres
Publié: (2026)
Zero-Shot Fake Video Detection by Audio-Visual Consistency
par: Li, Xiaolou, et autres
Publié: (2024)
par: Li, Xiaolou, et autres
Publié: (2024)
Towards Alleviating Text-to-Image Retrieval Hallucination for CLIP in Zero-shot Learning
par: Wang, Hanyao, et autres
Publié: (2024)
par: Wang, Hanyao, et autres
Publié: (2024)
Zero-Shot Character Identification and Speaker Prediction in Comics via Iterative Multimodal Fusion
par: Li, Yingxuan, et autres
Publié: (2024)
par: Li, Yingxuan, et autres
Publié: (2024)
Automatic Prompt Generation and Grounding Object Detection for Zero-Shot Image Anomaly Detection
par: Cheung, Tsun-Hin, et autres
Publié: (2024)
par: Cheung, Tsun-Hin, et autres
Publié: (2024)
KEN: Knowledge Augmentation and Emotion Guidance Network for Multimodal Fake News Detection
par: Zhu, Peican, et autres
Publié: (2025)
par: Zhu, Peican, et autres
Publié: (2025)
Multimodal Classification and Out-of-distribution Detection for Multimodal Intent Understanding
par: Zhang, Hanlei, et autres
Publié: (2024)
par: Zhang, Hanlei, et autres
Publié: (2024)
Graph-based Interaction Augmentation Network for Robust Multimodal Sentiment Analysis
par: Zhangfeng, Hu, et autres
Publié: (2025)
par: Zhangfeng, Hu, et autres
Publié: (2025)
Augmenting Intra-Modal Understanding in MLLMs for Robust Multimodal Keyphrase Generation
par: Cao, Jiajun, et autres
Publié: (2025)
par: Cao, Jiajun, et autres
Publié: (2025)
Simple but Effective Raw-Data Level Multimodal Fusion for Composed Image Retrieval
par: Wen, Haokun, et autres
Publié: (2024)
par: Wen, Haokun, et autres
Publié: (2024)
Is One-Shot In-Context Learning Helpful for Data Selection in Task-Specific Fine-Tuning of Multimodal LLMs?
par: An, Xiao, et autres
Publié: (2026)
par: An, Xiao, et autres
Publié: (2026)
EntroAD: Structural Entropy-Guided Prompt Adaptation for Zero-Shot Anomaly Detection
par: Zhao, Xinyu, et autres
Publié: (2026)
par: Zhao, Xinyu, et autres
Publié: (2026)
Zero-shot Video Moment Retrieval via Off-the-shelf Multimodal Large Language Models
par: Xu, Yifang, et autres
Publié: (2025)
par: Xu, Yifang, et autres
Publié: (2025)
Exploring the Role of Audio in Multimodal Misinformation Detection
par: Liu, Moyang, et autres
Publié: (2024)
par: Liu, Moyang, et autres
Publié: (2024)
Multimodal LLMs Can Reason about Aesthetics in Zero-Shot
par: Jiang, Ruixiang, et autres
Publié: (2025)
par: Jiang, Ruixiang, et autres
Publié: (2025)
Multimodal Learned Sparse Retrieval for Image Suggestion
par: Nguyen, Thong, et autres
Publié: (2024)
par: Nguyen, Thong, et autres
Publié: (2024)
Reading in the Dark: Low-light Scene Text Recognition
par: Fu, Xuanshuo, et autres
Publié: (2026)
par: Fu, Xuanshuo, et autres
Publié: (2026)
Learning Quantifiable Visual Explanations Without Ground-Truth
par: Singh, Amritpal, et autres
Publié: (2026)
par: Singh, Amritpal, et autres
Publié: (2026)
xLSTM-ECG: Multi-label ECG Classification via Feature Fusion with xLSTM
par: Kang, Lei, et autres
Publié: (2025)
par: Kang, Lei, et autres
Publié: (2025)
Documents similaires
-
Image-text matching for large-scale book collections
par: Llabrés, Artemis, et autres
Publié: (2024) -
Enhancing Document VQA Models via Retrieval-Augmented Generation
par: López, Eric, et autres
Publié: (2025) -
Fact-Checking with Contextual Narratives: Leveraging Retrieval-Augmented LLMs for Social Media Analysis
par: Dey, Arka Ujjal, et autres
Publié: (2025) -
ComicsPAP: understanding comic strips by picking the correct panel
par: Vivoli, Emanuele, et autres
Publié: (2025) -
CoSMo: A Multimodal Transformer for Page Stream Segmentation in Comic Books
par: Ortega, Marc Serra, et autres
Publié: (2025)