Evaluating Strategies for Synthesizing Clinical Notes for Medical Multimodal AI
Fuente:
arXiv
Saved in:
| Main Authors: | Marini, Niccolo, Liang, Zhaohui, Rajaraman, Sivaramakrishnan, Xue, Zhiyun, Antani, Sameer |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-task Cross-modal Learning for Chest X-ray Image Retrieval
by: Liang, Zhaohui, et al.
Published: (2026)
by: Liang, Zhaohui, et al.
Published: (2026)
A Systematic Evaluation of GPT-4V's Multimodal Capability for Medical Image Analysis
by: Li, Yingshu, et al.
Published: (2023)
by: Li, Yingshu, et al.
Published: (2023)
Scene Graph-Guided Generative AI Framework for Synthesizing and Evaluating Industrial Hazard Scenarios
by: Acharjee, Sanjay, et al.
Published: (2025)
by: Acharjee, Sanjay, et al.
Published: (2025)
Synthesizing Reality: Leveraging the Generative AI-Powered Platform Midjourney for Construction Worker Detection
by: Zhao, Hongyang, et al.
Published: (2025)
by: Zhao, Hongyang, et al.
Published: (2025)
Safety Assessment of Scaffolding on Construction Site using AI
by: Prabhu, Sameer, et al.
Published: (2025)
by: Prabhu, Sameer, et al.
Published: (2025)
Hierarchy-Aware Multimodal Unlearning for Medical AI
by: Wu, Fengli, et al.
Published: (2025)
by: Wu, Fengli, et al.
Published: (2025)
Zeus: Zero-shot LLM Instruction for Union Segmentation in Multimodal Medical Imaging
by: Dai, Siyuan, et al.
Published: (2025)
by: Dai, Siyuan, et al.
Published: (2025)
Evaluating the Impact of Medical Image Reconstruction on Downstream AI Fairness and Performance
by: Wohlrapp, Matteo, et al.
Published: (2026)
by: Wohlrapp, Matteo, et al.
Published: (2026)
Touchstone Benchmark: Are We on the Right Way for Evaluating AI Algorithms for Medical Segmentation?
by: Bassi, Pedro R. A. S., et al.
Published: (2024)
by: Bassi, Pedro R. A. S., et al.
Published: (2024)
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
by: Gong, Haozhen, et al.
Published: (2025)
by: Gong, Haozhen, et al.
Published: (2025)
Benchmarking Egocentric Clinical Intent Understanding Capability for Medical Multimodal Large Language Models
by: Liu, Shaonan, et al.
Published: (2026)
by: Liu, Shaonan, et al.
Published: (2026)
HalluGen: Synthesizing Realistic and Controllable Hallucinations for Evaluating Image Restoration
by: Kim, Seunghoi, et al.
Published: (2025)
by: Kim, Seunghoi, et al.
Published: (2025)
Why Text Prevails: Vision May Undermine Multimodal Medical Decision Making
by: Dai, Siyuan, et al.
Published: (2025)
by: Dai, Siyuan, et al.
Published: (2025)
Synthesizing Multimodal Geometry Datasets from Scratch and Enabling Visual Alignment via Plotting Code
by: Lin, Haobo, et al.
Published: (2026)
by: Lin, Haobo, et al.
Published: (2026)
Synthesizing Efficient Data with Diffusion Models for Person Re-Identification Pre-Training
by: Niu, Ke, et al.
Published: (2024)
by: Niu, Ke, et al.
Published: (2024)
Evaluating Multimodal Generative AI with Korean Educational Standards
by: Park, Sanghee, et al.
Published: (2025)
by: Park, Sanghee, et al.
Published: (2025)
Evaluating LLM -- Generated Multimodal Diagnosis from Medical Images and Symptom Analysis
by: Panagoulias, Dimitrios P., et al.
Published: (2024)
by: Panagoulias, Dimitrios P., et al.
Published: (2024)
Parameter-Efficient Fine-Tuning Medical Multimodal Large Language Models for Medical Visual Grounding
by: He, Jinlong, et al.
Published: (2024)
by: He, Jinlong, et al.
Published: (2024)
Unsupervised Salient Patch Selection for Data-Efficient Reinforcement Learning
by: Jiang, Zhaohui, et al.
Published: (2024)
by: Jiang, Zhaohui, et al.
Published: (2024)
Are Multimodal LLMs Ready for Clinical Dermatology? A Real-World Evaluation in Dermatology
by: Jiang, Roy, et al.
Published: (2026)
by: Jiang, Roy, et al.
Published: (2026)
Discrete Diffusion Models with MLLMs for Unified Medical Multimodal Generation
by: Mao, Jiawei, et al.
Published: (2025)
by: Mao, Jiawei, et al.
Published: (2025)
Complementary Information Mutual Learning for Multimodality Medical Image Segmentation
by: Shen, Chuyun, et al.
Published: (2024)
by: Shen, Chuyun, et al.
Published: (2024)
The Era of Foundation Models in Medical Imaging is Approaching : A Scoping Review of the Clinical Value of Large-Scale Generative AI Applications in Radiology
by: Seo, Inwoo, et al.
Published: (2024)
by: Seo, Inwoo, et al.
Published: (2024)
MAJORScore: A Novel Metric for Evaluating Multimodal Relevance via Joint Representation
by: Du, Zhicheng, et al.
Published: (2025)
by: Du, Zhicheng, et al.
Published: (2025)
A Multimodal Vision Foundation Model for Clinical Dermatology
by: Yan, Siyuan, et al.
Published: (2024)
by: Yan, Siyuan, et al.
Published: (2024)
Multimodal Medical Image Classification via Synergistic Learning Pre-training
by: Lin, Qinghua, et al.
Published: (2025)
by: Lin, Qinghua, et al.
Published: (2025)
Timing Is Everything: Finding the Optimal Fusion Points in Multimodal Medical Imaging
by: Guarrasi, Valerio, et al.
Published: (2025)
by: Guarrasi, Valerio, et al.
Published: (2025)
GazeVLM: Active Vision via Internal Attention Control for Multimodal Reasoning
by: Ebouky, Brown, et al.
Published: (2026)
by: Ebouky, Brown, et al.
Published: (2026)
Rethinking Normalization Strategies and Convolutional Kernels for Multimodal Image Fusion
by: He, Dan, et al.
Published: (2024)
by: He, Dan, et al.
Published: (2024)
Enhancing the Safety of Medical Vision-Language Models by Synthetic Demonstrations
by: Xue, Zhiyu, et al.
Published: (2025)
by: Xue, Zhiyu, et al.
Published: (2025)
MIBench: Evaluating LMMs on Multimodal Interaction
by: Miao, Yu, et al.
Published: (2026)
by: Miao, Yu, et al.
Published: (2026)
OmniBrainBench: A Comprehensive Multimodal Benchmark for Brain Imaging Analysis Across Multi-stage Clinical Tasks
by: Peng, Zhihao, et al.
Published: (2025)
by: Peng, Zhihao, et al.
Published: (2025)
HOPPR Medical-Grade Platform for Medical Imaging AI
by: Slavkova, Kalina P., et al.
Published: (2024)
by: Slavkova, Kalina P., et al.
Published: (2024)
Clinical Validation of the Melanoscope AI Mobile Dermoscopy Clinical Decision Support System
by: Kozachok, Elena Sergeevna, et al.
Published: (2026)
by: Kozachok, Elena Sergeevna, et al.
Published: (2026)
Adaptation of Foundation Models for Medical Image Analysis: Strategies, Challenges, and Future Directions
by: Phuntsho, Karma, et al.
Published: (2025)
by: Phuntsho, Karma, et al.
Published: (2025)
Multivariate Gaussian Representation Learning for Medical Action Evaluation
by: Yang, Luming, et al.
Published: (2025)
by: Yang, Luming, et al.
Published: (2025)
Conditional Idempotent Generative Networks
by: Ronchetti, Niccolò
Published: (2024)
by: Ronchetti, Niccolò
Published: (2024)
VideoWebArena: Evaluating Long Context Multimodal Agents with Video Understanding Web Tasks
by: Jang, Lawrence, et al.
Published: (2024)
by: Jang, Lawrence, et al.
Published: (2024)
CrossMed: A Multimodal Cross-Task Benchmark for Compositional Generalization in Medical Imaging
by: Singh, Pooja, et al.
Published: (2025)
by: Singh, Pooja, et al.
Published: (2025)
Case-Aware Medical Image Classification with Multimodal Knowledge Graphs and Reliability-Guided Refinement
by: Xu, Yiming, et al.
Published: (2026)
by: Xu, Yiming, et al.
Published: (2026)
Similar Items
-
Multi-task Cross-modal Learning for Chest X-ray Image Retrieval
by: Liang, Zhaohui, et al.
Published: (2026) -
A Systematic Evaluation of GPT-4V's Multimodal Capability for Medical Image Analysis
by: Li, Yingshu, et al.
Published: (2023) -
Scene Graph-Guided Generative AI Framework for Synthesizing and Evaluating Industrial Hazard Scenarios
by: Acharjee, Sanjay, et al.
Published: (2025) -
Synthesizing Reality: Leveraging the Generative AI-Powered Platform Midjourney for Construction Worker Detection
by: Zhao, Hongyang, et al.
Published: (2025) -
Safety Assessment of Scaffolding on Construction Site using AI
by: Prabhu, Sameer, et al.
Published: (2025)