MedAtlas: Evaluating LLMs for Multi-Round, Multi-Task Medical Reasoning Across Diverse Imaging Modalities and Clinical Text
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Xu, Ronghao, Huang, Zhen, Wei, Yangbo, Zhou, Xiaoqian, Xu, Zikang, Liu, Ting, Jiang, Zihang, Zhou, S. Kevin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
FairMedFM: Fairness Benchmarking for Medical Imaging Foundation Models
von: Jin, Ruinan, et al.
Veröffentlicht: (2024)
von: Jin, Ruinan, et al.
Veröffentlicht: (2024)
ClinKD: Cross-Modal Clinical Knowledge Distiller For Multi-Task Medical Images
von: Ge, Hongyu, et al.
Veröffentlicht: (2025)
von: Ge, Hongyu, et al.
Veröffentlicht: (2025)
Ensemble Deep Learning for Medical Image Classification Across Diverse Modalities: A Multi-Architecture Evaluation With Uncertainty Quantification on MedMNIST
von: Sanap, Hrushikesh
Veröffentlicht: (2026)
von: Sanap, Hrushikesh
Veröffentlicht: (2026)
Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks
von: Dong, Wenhan, et al.
Veröffentlicht: (2025)
von: Dong, Wenhan, et al.
Veröffentlicht: (2025)
Landmarks Are Alike Yet Distinct: Harnessing Similarity and Individuality for One-Shot Medical Landmark Detection
von: He, Xu, et al.
Veröffentlicht: (2025)
von: He, Xu, et al.
Veröffentlicht: (2025)
Med3D-R1: Incentivizing Clinical Reasoning in 3D Medical Vision-Language Models for Abnormality Diagnosis
von: Lai, Haoran, et al.
Veröffentlicht: (2026)
von: Lai, Haoran, et al.
Veröffentlicht: (2026)
MedFrameQA: A Multi-Image Medical VQA Benchmark for Clinical Reasoning
von: Yu, Suhao, et al.
Veröffentlicht: (2025)
von: Yu, Suhao, et al.
Veröffentlicht: (2025)
MultiMedVision: Multi-Modal Medical Vision Framework
von: Li, Frank, et al.
Veröffentlicht: (2026)
von: Li, Frank, et al.
Veröffentlicht: (2026)
Med-VRAgent: A Framework for Medical Visual Reasoning-Enhanced Agents
von: Guo, Guangfu, et al.
Veröffentlicht: (2025)
von: Guo, Guangfu, et al.
Veröffentlicht: (2025)
LawLuo: A Multi-Agent Collaborative Framework for Multi-Round Chinese Legal Consultation
von: Sun, Jingyun, et al.
Veröffentlicht: (2024)
von: Sun, Jingyun, et al.
Veröffentlicht: (2024)
MediRound: Multi-Round Entity-Level Reasoning Segmentation in Medical Images
von: Tong, Qinyue, et al.
Veröffentlicht: (2025)
von: Tong, Qinyue, et al.
Veröffentlicht: (2025)
M3: High-fidelity Text-to-Image Generation via Multi-Modal, Multi-Agent and Multi-Round Visual Reasoning
von: Yang, Bangji, et al.
Veröffentlicht: (2026)
von: Yang, Bangji, et al.
Veröffentlicht: (2026)
ReasonMed: A 370K Multi-Agent Generated Dataset for Advancing Medical Reasoning
von: Sun, Yu, et al.
Veröffentlicht: (2025)
von: Sun, Yu, et al.
Veröffentlicht: (2025)
MedAgentBoard: Benchmarking Multi-Agent Collaboration with Conventional Methods for Diverse Medical Tasks
von: Zhu, Yinghao, et al.
Veröffentlicht: (2025)
von: Zhu, Yinghao, et al.
Veröffentlicht: (2025)
MedROV: Towards Real-Time Open-Vocabulary Detection Across Diverse Medical Imaging Modalities
von: Sheikh, Tooba Tehreem, et al.
Veröffentlicht: (2025)
von: Sheikh, Tooba Tehreem, et al.
Veröffentlicht: (2025)
ADP-FL-MedSeg: Adaptive Differential Privacy for Federated Medical Segmentation Across Diverse Modalities
von: Saha, Puja, et al.
Veröffentlicht: (2026)
von: Saha, Puja, et al.
Veröffentlicht: (2026)
MedReason: Eliciting Factual Medical Reasoning Steps in LLMs via Knowledge Graphs
von: Wu, Juncheng, et al.
Veröffentlicht: (2025)
von: Wu, Juncheng, et al.
Veröffentlicht: (2025)
Parameter Identification and Open‐Circuit Voltage Estimation of Lithium‐Ion Battery Circuit Model Based on Multi‐Innovation Theory
von: Yangbo Zou, et al.
Veröffentlicht: (2025)
von: Yangbo Zou, et al.
Veröffentlicht: (2025)
Semi-MedRef: Semi-Supervised Medical Referring Image Segmentation with Cross-Modal Alignment
von: Li, Yuchen, et al.
Veröffentlicht: (2026)
von: Li, Yuchen, et al.
Veröffentlicht: (2026)
Slide-SAM: Medical SAM Meets Sliding Window
von: Quan, Quan, et al.
Veröffentlicht: (2023)
von: Quan, Quan, et al.
Veröffentlicht: (2023)
MedRECT: A Medical Reasoning Benchmark for Error Correction in Clinical Texts
von: Iwase, Naoto, et al.
Veröffentlicht: (2025)
von: Iwase, Naoto, et al.
Veröffentlicht: (2025)
H3DE-Net: Efficient and Accurate 3D Landmark Detection in Medical Imaging
von: Huang, Zhen, et al.
Veröffentlicht: (2025)
von: Huang, Zhen, et al.
Veröffentlicht: (2025)
MedSegFactory: Text-Guided Generation of Medical Image-Mask Pairs
von: Mao, Jiawei, et al.
Veröffentlicht: (2025)
von: Mao, Jiawei, et al.
Veröffentlicht: (2025)
The Multi-Round Diagnostic RAG Framework for Emulating Clinical Reasoning
von: Sun, Penglei, et al.
Veröffentlicht: (2025)
von: Sun, Penglei, et al.
Veröffentlicht: (2025)
M$^3$-Med: A Benchmark for Multi-lingual, Multi-modal, and Multi-hop Reasoning in Medical Instructional Video Understanding
von: Liu, Shenxi, et al.
Veröffentlicht: (2025)
von: Liu, Shenxi, et al.
Veröffentlicht: (2025)
Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning
von: Zhang, Xiaotian, et al.
Veröffentlicht: (2025)
von: Zhang, Xiaotian, et al.
Veröffentlicht: (2025)
Hierarchical Attacks for Multi-Modal Multi-Agent Reasoning
von: Zhou, Hao, et al.
Veröffentlicht: (2026)
von: Zhou, Hao, et al.
Veröffentlicht: (2026)
MedMT-Bench: Can LLMs Memorize and Understand Long Multi-Turn Conversations in Medical Scenarios?
von: Yang, Lin, et al.
Veröffentlicht: (2026)
von: Yang, Lin, et al.
Veröffentlicht: (2026)
UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities
von: Khattak, Muhammad Uzair, et al.
Veröffentlicht: (2024)
von: Khattak, Muhammad Uzair, et al.
Veröffentlicht: (2024)
HiMed: Incentivizing Hindi Reasoning in Medical LLMs
von: Jiang, Dingfeng, et al.
Veröffentlicht: (2026)
von: Jiang, Dingfeng, et al.
Veröffentlicht: (2026)
MedGS: Gaussian Splatting for Multi-Modal 3D Medical Imaging
von: Marzol, Kacper, et al.
Veröffentlicht: (2025)
von: Marzol, Kacper, et al.
Veröffentlicht: (2025)
KnowGuard: Knowledge-Driven Abstention for Multi-Round Clinical Reasoning
von: Dang, Xilin, et al.
Veröffentlicht: (2025)
von: Dang, Xilin, et al.
Veröffentlicht: (2025)
Foundational Automatic Evaluators: Scaling Multi-Task Generative Evaluator Training for Reasoning-Centric Domains
von: Xu, Austin, et al.
Veröffentlicht: (2025)
von: Xu, Austin, et al.
Veröffentlicht: (2025)
MedKGEval: A Knowledge Graph-Based Multi-Turn Evaluation Framework for Open-Ended Patient Interactions with Clinical LLMs
von: Yu, Yuechun, et al.
Veröffentlicht: (2025)
von: Yu, Yuechun, et al.
Veröffentlicht: (2025)
MIRROR: Multi-agent Intra- and Inter-Reflection for Optimized Reasoning in Tool Learning
von: Guo, Zikang, et al.
Veröffentlicht: (2025)
von: Guo, Zikang, et al.
Veröffentlicht: (2025)
AgentsEval: Clinically Faithful Evaluation of Medical Imaging Reports via Multi-Agent Reasoning
von: Fu, Suzhong, et al.
Veröffentlicht: (2026)
von: Fu, Suzhong, et al.
Veröffentlicht: (2026)
Multi-Task GRPO: Reliable LLM Reasoning Across Tasks
von: Ramesh, Shyam Sundhar, et al.
Veröffentlicht: (2026)
von: Ramesh, Shyam Sundhar, et al.
Veröffentlicht: (2026)
MedVLThinker: Simple Baselines for Multimodal Medical Reasoning
von: Huang, Xiaoke, et al.
Veröffentlicht: (2025)
von: Huang, Xiaoke, et al.
Veröffentlicht: (2025)
Think Before Writing: Feature-Level Multi-Objective Optimization for Generative Citation Visibility
von: Liu, Zikang, et al.
Veröffentlicht: (2026)
von: Liu, Zikang, et al.
Veröffentlicht: (2026)
MedAction: Towards Active Multi-turn Clinical Diagnostic LLMs
von: Hsu, Hsin-Ling, et al.
Veröffentlicht: (2026)
von: Hsu, Hsin-Ling, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
FairMedFM: Fairness Benchmarking for Medical Imaging Foundation Models
von: Jin, Ruinan, et al.
Veröffentlicht: (2024) -
ClinKD: Cross-Modal Clinical Knowledge Distiller For Multi-Task Medical Images
von: Ge, Hongyu, et al.
Veröffentlicht: (2025) -
Ensemble Deep Learning for Medical Image Classification Across Diverse Modalities: A Multi-Architecture Evaluation With Uncertainty Quantification on MedMNIST
von: Sanap, Hrushikesh
Veröffentlicht: (2026) -
Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks
von: Dong, Wenhan, et al.
Veröffentlicht: (2025) -
Landmarks Are Alike Yet Distinct: Harnessing Similarity and Individuality for One-Shot Medical Landmark Detection
von: He, Xu, et al.
Veröffentlicht: (2025)