MediFact at MEDIQA-M3G 2024: Medical Question Answering in Dermatology with Multimodal Learning
Fuente:
arXiv
Salvato in:
| Autore principale: | Saeed, Nadia |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MediFact at MEDIQA-CORR 2024: Why AI Needs a Human Touch
di: Saeed, Nadia
Pubblicazione: (2024)
di: Saeed, Nadia
Pubblicazione: (2024)
MMToM-QA: Multimodal Theory of Mind Question Answering
di: Jin, Chuanyang, et al.
Pubblicazione: (2024)
di: Jin, Chuanyang, et al.
Pubblicazione: (2024)
MapIQ: Evaluating Multimodal Large Language Models for Map Question Answering
di: Srivastava, Varun, et al.
Pubblicazione: (2025)
di: Srivastava, Varun, et al.
Pubblicazione: (2025)
Prompting Medical Large Vision-Language Models to Diagnose Pathologies by Visual Question Answering
di: Guo, Danfeng, et al.
Pubblicazione: (2024)
di: Guo, Danfeng, et al.
Pubblicazione: (2024)
Exploring Diverse Methods in Visual Question Answering
di: Li, Panfeng, et al.
Pubblicazione: (2024)
di: Li, Panfeng, et al.
Pubblicazione: (2024)
CVQA: Culturally-diverse Multilingual Visual Question Answering Benchmark
di: Romero, David, et al.
Pubblicazione: (2024)
di: Romero, David, et al.
Pubblicazione: (2024)
Find The Gap: Knowledge Base Reasoning For Visual Question Answering
di: Barezi, Elham J., et al.
Pubblicazione: (2024)
di: Barezi, Elham J., et al.
Pubblicazione: (2024)
Federated Document Visual Question Answering: A Pilot Study
di: Nguyen, Khanh, et al.
Pubblicazione: (2024)
di: Nguyen, Khanh, et al.
Pubblicazione: (2024)
Meta-Adaptive Prompt Distillation for Few-Shot Visual Question Answering
di: Gupta, Akash, et al.
Pubblicazione: (2025)
di: Gupta, Akash, et al.
Pubblicazione: (2025)
Spatially Grounded Explanations in Vision Language Models for Document Visual Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
Bridging the Gap between 2D and 3D Visual Question Answering: A Fusion Approach for 3D VQA
di: Mo, Wentao, et al.
Pubblicazione: (2024)
di: Mo, Wentao, et al.
Pubblicazione: (2024)
TraveLER: A Modular Multi-LMM Agent Framework for Video Question-Answering
di: Shang, Chuyi, et al.
Pubblicazione: (2024)
di: Shang, Chuyi, et al.
Pubblicazione: (2024)
Visual Question Decomposition on Multimodal Large Language Models
di: Zhang, Haowei, et al.
Pubblicazione: (2024)
di: Zhang, Haowei, et al.
Pubblicazione: (2024)
FRAMES-VQA: Benchmarking Fine-Tuning Robustness across Multi-Modal Shifts in Visual Question Answering
di: Huang, Chengyue, et al.
Pubblicazione: (2025)
di: Huang, Chengyue, et al.
Pubblicazione: (2025)
Guiding Vision-Language Model Selection for Visual Question-Answering Across Tasks, Domains, and Knowledge Types
di: Sinha, Neelabh, et al.
Pubblicazione: (2024)
di: Sinha, Neelabh, et al.
Pubblicazione: (2024)
DermaVQA-DAS: Dermatology Assessment Schema (DAS) & Datasets for Closed-Ended Question Answering & Segmentation in Patient-Generated Dermatology Images
di: Yim, Wen-wai, et al.
Pubblicazione: (2025)
di: Yim, Wen-wai, et al.
Pubblicazione: (2025)
FM2DS: Few-Shot Multimodal Multihop Data Synthesis with Knowledge Distillation for Question Answering
di: Abaskohi, Amirhossein, et al.
Pubblicazione: (2024)
di: Abaskohi, Amirhossein, et al.
Pubblicazione: (2024)
Advancing Multimodal Medical Capabilities of Gemini
di: Yang, Lin, et al.
Pubblicazione: (2024)
di: Yang, Lin, et al.
Pubblicazione: (2024)
An Image Grid Can Be Worth a Video: Zero-shot Video Question Answering Using a VLM
di: Kim, Wonkyun, et al.
Pubblicazione: (2024)
di: Kim, Wonkyun, et al.
Pubblicazione: (2024)
DermaBench: A Clinician-Annotated Benchmark Dataset for Dermatology Visual Question Answering and Reasoning
di: Yilmaz, Abdurrahim, et al.
Pubblicazione: (2026)
di: Yilmaz, Abdurrahim, et al.
Pubblicazione: (2026)
Hallucination Benchmark in Medical Visual Question Answering
di: Wu, Jinge, et al.
Pubblicazione: (2024)
di: Wu, Jinge, et al.
Pubblicazione: (2024)
Integrating Medical Imaging and Clinical Reports Using Multimodal Deep Learning for Advanced Disease Analysis
di: Yao, Ziyan, et al.
Pubblicazione: (2024)
di: Yao, Ziyan, et al.
Pubblicazione: (2024)
Examining Modality Incongruity in Multimodal Federated Learning for Medical Vision and Language-based Disease Detection
di: Saha, Pramit, et al.
Pubblicazione: (2024)
di: Saha, Pramit, et al.
Pubblicazione: (2024)
CausalChaos! Dataset for Comprehensive Causal Action Question Answering Over Longer Causal Chains Grounded in Dynamic Visual Scenes
di: Parmar, Paritosh, et al.
Pubblicazione: (2024)
di: Parmar, Paritosh, et al.
Pubblicazione: (2024)
Exploring Compositional Generalization of Multimodal LLMs for Medical Imaging
di: Cai, Zhenyang, et al.
Pubblicazione: (2024)
di: Cai, Zhenyang, et al.
Pubblicazione: (2024)
Towards Human-Level Understanding of Complex Process Engineering Schematics: A Pedagogical, Introspective Multi-Agent Framework for Open-Domain Question Answering
di: Sakhinana, Sagar Srinivas, et al.
Pubblicazione: (2024)
di: Sakhinana, Sagar Srinivas, et al.
Pubblicazione: (2024)
Beyond Single Plots: A Benchmark for Question Answering on Multi-Charts
di: Efat, Azher Ahmed, et al.
Pubblicazione: (2026)
di: Efat, Azher Ahmed, et al.
Pubblicazione: (2026)
MMedAgent-RL: Optimizing Multi-Agent Collaboration for Multimodal Medical Reasoning
di: Xia, Peng, et al.
Pubblicazione: (2025)
di: Xia, Peng, et al.
Pubblicazione: (2025)
HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale
di: Chen, Junying, et al.
Pubblicazione: (2024)
di: Chen, Junying, et al.
Pubblicazione: (2024)
MMedPO: Aligning Medical Vision-Language Models with Clinical-Aware Multimodal Preference Optimization
di: Zhu, Kangyu, et al.
Pubblicazione: (2024)
di: Zhu, Kangyu, et al.
Pubblicazione: (2024)
SPIQA: A Dataset for Multimodal Question Answering on Scientific Papers
di: Pramanick, Shraman, et al.
Pubblicazione: (2024)
di: Pramanick, Shraman, et al.
Pubblicazione: (2024)
VOILA: Value-of-Information Guided Fidelity Selection for Cost-Aware Multimodal Question Answering
di: Bhope, Rahul Atul, et al.
Pubblicazione: (2026)
di: Bhope, Rahul Atul, et al.
Pubblicazione: (2026)
MultiMed: Massively Multimodal and Multitask Medical Understanding
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
Modality-Aware Integration with Large Language Models for Knowledge-based Visual Question Answering
di: Dong, Junnan, et al.
Pubblicazione: (2024)
di: Dong, Junnan, et al.
Pubblicazione: (2024)
Multimodal Task Vectors Enable Many-Shot Multimodal In-Context Learning
di: Huang, Brandon, et al.
Pubblicazione: (2024)
di: Huang, Brandon, et al.
Pubblicazione: (2024)
FactCHD: Benchmarking Fact-Conflicting Hallucination Detection
di: Chen, Xiang, et al.
Pubblicazione: (2023)
di: Chen, Xiang, et al.
Pubblicazione: (2023)
LOVA3: Learning to Visual Question Answering, Asking and Assessment
di: Zhao, Henry Hengyuan, et al.
Pubblicazione: (2024)
di: Zhao, Henry Hengyuan, et al.
Pubblicazione: (2024)
Advancing Egocentric Video Question Answering with Multimodal Large Language Models
di: Patel, Alkesh, et al.
Pubblicazione: (2025)
di: Patel, Alkesh, et al.
Pubblicazione: (2025)
Chain of Questions: Guiding Multimodal Curiosity in Language Models
di: Iji, Nima, et al.
Pubblicazione: (2025)
di: Iji, Nima, et al.
Pubblicazione: (2025)
ECCV 2024 W-CODA: 1st Workshop on Multimodal Perception and Comprehension of Corner Cases in Autonomous Driving
di: Chen, Kai, et al.
Pubblicazione: (2025)
di: Chen, Kai, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MediFact at MEDIQA-CORR 2024: Why AI Needs a Human Touch
di: Saeed, Nadia
Pubblicazione: (2024) -
MMToM-QA: Multimodal Theory of Mind Question Answering
di: Jin, Chuanyang, et al.
Pubblicazione: (2024) -
MapIQ: Evaluating Multimodal Large Language Models for Map Question Answering
di: Srivastava, Varun, et al.
Pubblicazione: (2025) -
Prompting Medical Large Vision-Language Models to Diagnose Pathologies by Visual Question Answering
di: Guo, Danfeng, et al.
Pubblicazione: (2024) -
Exploring Diverse Methods in Visual Question Answering
di: Li, Panfeng, et al.
Pubblicazione: (2024)