WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Matos, João, Chen, Shan, Placino, Siena, Li, Yingya, Pardo, Juan Carlos Climent, Idan, Daphna, Tohyama, Takeshi, Restrepo, David, Nakayama, Luis F., Pascual-Leone, Jose M. M., Savova, Guergana, Aerts, Hugo, Celi, Leo A., Wong, A. Ian, Bitterman, Danielle S., Gallifant, Jack |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluation of ChatGPT Family of Models for Biomedical Reasoning and Classification
par: Chen, Shan, et autres
Publié: (2023)
par: Chen, Shan, et autres
Publié: (2023)
Identifying Task Groupings for Multi-Task Learning Using Pointwise V-Usable Information
par: Li, Yingya, et autres
Publié: (2024)
par: Li, Yingya, et autres
Publié: (2024)
Artificial Intelligence in the Legal Field: Law Students Perspective
par: Andreeva, Daniela, et autres
Publié: (2024)
par: Andreeva, Daniela, et autres
Publié: (2024)
Assessing the Macro and Micro Effects of Random Seeds on Fine-Tuning Large Language Models
par: Bui, Nghia, et autres
Publié: (2025)
par: Bui, Nghia, et autres
Publié: (2025)
Large language models require a new form of oversight: capability-based monitoring
par: Kellogg, Katherine C., et autres
Publié: (2025)
par: Kellogg, Katherine C., et autres
Publié: (2025)
MedBrowseComp: Benchmarking Medical Deep Research and Computer Use
par: Chen, Shan, et autres
Publié: (2025)
par: Chen, Shan, et autres
Publié: (2025)
Analyzing Diversity in Healthcare LLM Research: A Scientometric Perspective
par: Restrepo, David, et autres
Publié: (2024)
par: Restrepo, David, et autres
Publié: (2024)
Sparse Autoencoder Features for Classifications and Transferability
par: Gallifant, Jack, et autres
Publié: (2025)
par: Gallifant, Jack, et autres
Publié: (2025)
A multimodal multiplex of the mental lexicon for multilingual individuals
par: Huynh, Maria, et autres
Publié: (2025)
par: Huynh, Maria, et autres
Publié: (2025)
Language Models are Surprisingly Fragile to Drug Names in Biomedical Benchmarks
par: Gallifant, Jack, et autres
Publié: (2024)
par: Gallifant, Jack, et autres
Publié: (2024)
FLiP: Towards understanding and interpreting multimodal multilingual sentence embeddings
par: Kesiraju, Santosh, et autres
Publié: (2026)
par: Kesiraju, Santosh, et autres
Publié: (2026)
DF-DM: A foundational process model for multimodal data fusion in the artificial intelligence era
par: Restrepo, David, et autres
Publié: (2024)
par: Restrepo, David, et autres
Publié: (2024)
Can Language Models Identify Side Effects of Breast Cancer Radiation Treatments?
par: Seah, Natalie, et autres
Publié: (2026)
par: Seah, Natalie, et autres
Publié: (2026)
Clinical classification of memory and cognitive impairment with multimodal digital biomarkers
par: Russell Banks, et autres
Publié: (2024)
par: Russell Banks, et autres
Publié: (2024)
Metáfora multimodal: representación mediática del despojo
par: Neyla Graciela Pardo Abril
Publié: (2012)
par: Neyla Graciela Pardo Abril
Publié: (2012)
SENSE models: an open source solution for multilingual and multimodal semantic-based tasks
par: Mdhaffar, Salima, et autres
Publié: (2025)
par: Mdhaffar, Salima, et autres
Publié: (2025)
Wait, but Tylenol is Acetaminophen... Investigating and Improving Language Models' Ability to Resist Requests for Misinformation
par: Chen, Shan, et autres
Publié: (2024)
par: Chen, Shan, et autres
Publié: (2024)
J-EDI QA: Benchmark for deep-sea organism-specific multimodal LLM
par: Yoshida, Takero, et autres
Publié: (2024)
par: Yoshida, Takero, et autres
Publié: (2024)
Large Language Models to Identify Social Determinants of Health in Electronic Health Records
par: Guevara, Marco, et autres
Publié: (2023)
par: Guevara, Marco, et autres
Publié: (2023)
Adapting Abstract Meaning Representation Parsing to the Clinical Narrative -- the SPRING THYME parser
par: Cai, Jon Z., et autres
Publié: (2024)
par: Cai, Jon Z., et autres
Publié: (2024)
KScope: A Framework for Characterizing the Knowledge Status of Language Models
par: Xiao, Yuxin, et autres
Publié: (2025)
par: Xiao, Yuxin, et autres
Publié: (2025)
Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs
par: Restrepo, David, et autres
Publié: (2024)
par: Restrepo, David, et autres
Publié: (2024)
MedGEN-Bench: Contextually entangled benchmark for open-ended multimodal medical generation
par: Yang, Junjie, et autres
Publié: (2025)
par: Yang, Junjie, et autres
Publié: (2025)
La emocionalidad en las narrativas mediáticas del despojo en Colombia. Estudio multimodal.
par: Neyla Graciela Pardo Abril
Publié: (2016)
par: Neyla Graciela Pardo Abril
Publié: (2016)
Over One Hundred Years' Service to Science
par: Savova, Elena
Publié: (1971)
par: Savova, Elena
Publié: (1971)
Aspect-Oriented Summarization for Psychiatric Short-Term Readmission Prediction
par: Yoon, WonJin, et autres
Publié: (2025)
par: Yoon, WonJin, et autres
Publié: (2025)
Attacks on multimodal models
par: Iablochnikov, Viacheslav, et autres
Publié: (2024)
par: Iablochnikov, Viacheslav, et autres
Publié: (2024)
The future of multimodal corpora
par: Dawn Knight
Publié: (2011)
par: Dawn Knight
Publié: (2011)
Learning Isometric Embeddings of Road Networks using Multidimensional Scaling
par: Pardo, Juan Carlos Climent
Publié: (2025)
par: Pardo, Juan Carlos Climent
Publié: (2025)
MULTIAQUA: A multimodal maritime dataset and robust training strategies for multimodal semantic segmentation
par: Muhovič, Jon, et autres
Publié: (2025)
par: Muhovič, Jon, et autres
Publié: (2025)
Cross-Care: Assessing the Healthcare Implications of Pre-training Data on Language Model Bias
par: Chen, Shan, et autres
Publié: (2024)
par: Chen, Shan, et autres
Publié: (2024)
mChartQA: A universal benchmark for multimodal Chart Question Answer based on Vision-Language Alignment and Reasoning
par: Wei, Jingxuan, et autres
Publié: (2024)
par: Wei, Jingxuan, et autres
Publié: (2024)
Laser-scanning optical-frequency-comb microscopy for multimodal imaging
par: Kajiwara, Shimpei, et autres
Publié: (2024)
par: Kajiwara, Shimpei, et autres
Publié: (2024)
Ansprechhaltung und Adressierung – multimodal
Publié: (2026)
Publié: (2026)
Towards ethical multimodal systems
par: Roger, Alexis, et autres
Publié: (2023)
par: Roger, Alexis, et autres
Publié: (2023)
Normalization for multimodal type theory
par: Gratzer, Daniel
Publié: (2023)
par: Gratzer, Daniel
Publié: (2023)
Simultaneous measurement of multimode squeezing
par: Barakat, Ismail, et autres
Publié: (2024)
par: Barakat, Ismail, et autres
Publié: (2024)
Carcinoma hepatocelular. Tratamiento multimodal
par: Germán Gómez Santos
Publié: (2008)
par: Germán Gómez Santos
Publié: (2008)
Nonlinear multimode photonics on‐chip
par: Valerio Vitali, et autres
Publié: (2025)
par: Valerio Vitali, et autres
Publié: (2025)
MedConceptsQA: Open Source Medical Concepts QA Benchmark
par: Shoham, Ofir Ben, et autres
Publié: (2024)
par: Shoham, Ofir Ben, et autres
Publié: (2024)
Documents similaires
-
Evaluation of ChatGPT Family of Models for Biomedical Reasoning and Classification
par: Chen, Shan, et autres
Publié: (2023) -
Identifying Task Groupings for Multi-Task Learning Using Pointwise V-Usable Information
par: Li, Yingya, et autres
Publié: (2024) -
Artificial Intelligence in the Legal Field: Law Students Perspective
par: Andreeva, Daniela, et autres
Publié: (2024) -
Assessing the Macro and Micro Effects of Random Seeds on Fine-Tuning Large Language Models
par: Bui, Nghia, et autres
Publié: (2025) -
Large language models require a new form of oversight: capability-based monitoring
par: Kellogg, Katherine C., et autres
Publié: (2025)