MedMASLab: A Unified Orchestration Framework for Benchmarking Multimodal Medical Multi-Agent Systems
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Qian, Yunhang, Hu, Xiaobin, Yu, Jiaquan, Xin, Siyang, Chen, Xiaokun, Zhang, Jiangning, Jiang, Peng-Tao, Liu, Jiawei, Li, Hongwei Bran |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
von: Gong, Haozhen, et al.
Veröffentlicht: (2025)
von: Gong, Haozhen, et al.
Veröffentlicht: (2025)
MASLab: A Unified and Comprehensive Codebase for LLM-based Multi-Agent Systems
von: Ye, Rui, et al.
Veröffentlicht: (2025)
von: Ye, Rui, et al.
Veröffentlicht: (2025)
Evo-MedAgent: Beyond One-Shot Diagnosis with Agents That Remember, Reflect, and Improve
von: Shen, Weixiang, et al.
Veröffentlicht: (2026)
von: Shen, Weixiang, et al.
Veröffentlicht: (2026)
UniICL: Systematizing Unified Multimodal In-context Learning through a Capability-Oriented Taxonomy
von: Xu, Yicheng, et al.
Veröffentlicht: (2026)
von: Xu, Yicheng, et al.
Veröffentlicht: (2026)
SkillGraph: Self-Evolving Multi-Agent Collaboration with Multimodal Graph Topology
von: Nie, Zheng, et al.
Veröffentlicht: (2026)
von: Nie, Zheng, et al.
Veröffentlicht: (2026)
ShortcutBreaker: Low-Rank Noisy Bottleneck and Frequency Filtering Block for Multi-Class Unsupervised Anomaly Detection
von: Tang, Peng, et al.
Veröffentlicht: (2025)
von: Tang, Peng, et al.
Veröffentlicht: (2025)
Human-MME: A Holistic Evaluation Benchmark for Human-Centric Multimodal Large Language Models
von: Liu, Yuansen, et al.
Veröffentlicht: (2025)
von: Liu, Yuansen, et al.
Veröffentlicht: (2025)
Towards Generalized Multi-Image Editing for Unified Multimodal Models
von: Xu, Pengcheng, et al.
Veröffentlicht: (2026)
von: Xu, Pengcheng, et al.
Veröffentlicht: (2026)
MedAgentsBench: Benchmarking Thinking Models and Agent Frameworks for Complex Medical Reasoning
von: Tang, Xiangru, et al.
Veröffentlicht: (2025)
von: Tang, Xiangru, et al.
Veröffentlicht: (2025)
SPIKE: An Adaptive Dual Controller Framework for Cost-Efficient Long-Horizon Game Agents
von: Jiang, Wencan, et al.
Veröffentlicht: (2026)
von: Jiang, Wencan, et al.
Veröffentlicht: (2026)
PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
von: He, Qingdong, et al.
Veröffentlicht: (2024)
von: He, Qingdong, et al.
Veröffentlicht: (2024)
MedRAX: Medical Reasoning Agent for Chest X-ray
von: Fallahpour, Adibvafa, et al.
Veröffentlicht: (2025)
von: Fallahpour, Adibvafa, et al.
Veröffentlicht: (2025)
MedKCO: Medical Vision-Language Pretraining via Knowledge-Driven Cognitive Orchestration
von: Zhang, Chenran, et al.
Veröffentlicht: (2026)
von: Zhang, Chenran, et al.
Veröffentlicht: (2026)
M3CoTBench: Benchmark Chain-of-Thought of MLLMs in Medical Image Understanding
von: Jiang, Juntao, et al.
Veröffentlicht: (2026)
von: Jiang, Juntao, et al.
Veröffentlicht: (2026)
MedGym:A Unified Continuous-Time Benchmark for Dynamic Medical Treatment Reinforcement Learning
von: Wang, Yuepeng, et al.
Veröffentlicht: (2026)
von: Wang, Yuepeng, et al.
Veröffentlicht: (2026)
MedAgentBench: A Realistic Virtual EHR Environment to Benchmark Medical LLM Agents
von: Jiang, Yixing, et al.
Veröffentlicht: (2025)
von: Jiang, Yixing, et al.
Veröffentlicht: (2025)
Small Model as Master Orchestrator: Learning Unified Agent-Tool Orchestration with Parallel Subtask Decomposition
von: Yuan, Wenzhen, et al.
Veröffentlicht: (2026)
von: Yuan, Wenzhen, et al.
Veröffentlicht: (2026)
MedAgentBoard: Benchmarking Multi-Agent Collaboration with Conventional Methods for Diverse Medical Tasks
von: Zhu, Yinghao, et al.
Veröffentlicht: (2025)
von: Zhu, Yinghao, et al.
Veröffentlicht: (2025)
MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning
von: Pan, Jiazhen, et al.
Veröffentlicht: (2025)
von: Pan, Jiazhen, et al.
Veröffentlicht: (2025)
MedChat: A Multi-Agent Framework for Multimodal Diagnosis with Large Language Models
von: Liu, Philip R., et al.
Veröffentlicht: (2025)
von: Liu, Philip R., et al.
Veröffentlicht: (2025)
MedBench v4: A Robust and Scalable Benchmark for Evaluating Chinese Medical Language Models, Multimodal Models, and Intelligent Agents
von: Ding, Jinru, et al.
Veröffentlicht: (2025)
von: Ding, Jinru, et al.
Veröffentlicht: (2025)
Boosting Reasoning in Large Multimodal Models via Activation Replay
von: Xing, Yun, et al.
Veröffentlicht: (2025)
von: Xing, Yun, et al.
Veröffentlicht: (2025)
ProbMed: A Probabilistic Framework for Medical Multimodal Binding
von: Gao, Yuan, et al.
Veröffentlicht: (2025)
von: Gao, Yuan, et al.
Veröffentlicht: (2025)
Challenge Summary U-MedSAM: Uncertainty-aware MedSAM for Medical Image Segmentation
von: Wang, Xin, et al.
Veröffentlicht: (2024)
von: Wang, Xin, et al.
Veröffentlicht: (2024)
SVFR: A Unified Framework for Generalized Video Face Restoration
von: Wang, Zhiyao, et al.
Veröffentlicht: (2025)
von: Wang, Zhiyao, et al.
Veröffentlicht: (2025)
RJUA-MedDQA: A Multimodal Benchmark for Medical Document Question Answering and Clinical Reasoning
von: Jin, Congyun, et al.
Veröffentlicht: (2024)
von: Jin, Congyun, et al.
Veröffentlicht: (2024)
RWKV-UNet: Improving UNet with Long-Range Cooperation for Effective Medical Image Segmentation
von: Jiang, Juntao, et al.
Veröffentlicht: (2025)
von: Jiang, Juntao, et al.
Veröffentlicht: (2025)
VTBench: Comprehensive Benchmark Suite Towards Real-World Virtual Try-on Models
von: Xiaobin, Hu, et al.
Veröffentlicht: (2025)
von: Xiaobin, Hu, et al.
Veröffentlicht: (2025)
SOLVE-Med: Specialized Orchestration for Leading Vertical Experts across Medical Specialties
von: Di Marino, Roberta, et al.
Veröffentlicht: (2025)
von: Di Marino, Roberta, et al.
Veröffentlicht: (2025)
MedFuncta: A Unified Framework for Learning Efficient Medical Neural Fields
von: Friedrich, Paul, et al.
Veröffentlicht: (2025)
von: Friedrich, Paul, et al.
Veröffentlicht: (2025)
uMedSum: A Unified Framework for Advancing Medical Abstractive Summarization
von: Nagar, Aishik, et al.
Veröffentlicht: (2024)
von: Nagar, Aishik, et al.
Veröffentlicht: (2024)
MedFM-Robust: Benchmarking Robustness of Medical Foundation Models
von: Cui, Xiangxiang, et al.
Veröffentlicht: (2026)
von: Cui, Xiangxiang, et al.
Veröffentlicht: (2026)
Visual Document Understanding and Reasoning: A Multi-Agent Collaboration Framework with Agent-Wise Adaptive Test-Time Scaling
von: Yu, Xinlei, et al.
Veröffentlicht: (2025)
von: Yu, Xinlei, et al.
Veröffentlicht: (2025)
MedM2G: Unifying Medical Multi-Modal Generation via Cross-Guided Diffusion with Visual Invariant
von: Zhan, Chenlu, et al.
Veröffentlicht: (2024)
von: Zhan, Chenlu, et al.
Veröffentlicht: (2024)
CrossMed: A Multimodal Cross-Task Benchmark for Compositional Generalization in Medical Imaging
von: Singh, Pooja, et al.
Veröffentlicht: (2025)
von: Singh, Pooja, et al.
Veröffentlicht: (2025)
MedHallu: A Comprehensive Benchmark for Detecting Medical Hallucinations in Large Language Models
von: Pandit, Shrey, et al.
Veröffentlicht: (2025)
von: Pandit, Shrey, et al.
Veröffentlicht: (2025)
Med-VRAgent: A Framework for Medical Visual Reasoning-Enhanced Agents
von: Guo, Guangfu, et al.
Veröffentlicht: (2025)
von: Guo, Guangfu, et al.
Veröffentlicht: (2025)
EmambaIR: Efficient Visual State Space Model for Event-guided Image Reconstruction
von: Yu, Wei, et al.
Veröffentlicht: (2026)
von: Yu, Wei, et al.
Veröffentlicht: (2026)
MedDialogRubrics: A Comprehensive Benchmark and Evaluation Framework for Multi-turn Medical Consultations in Large Language Models
von: Gong, Lecheng, et al.
Veröffentlicht: (2026)
von: Gong, Lecheng, et al.
Veröffentlicht: (2026)
A Theoretical Framework of the Processes of Change in Psychotherapy Delivered by Artificial Agents
von: Herbener, Arthur Bran, et al.
Veröffentlicht: (2025)
von: Herbener, Arthur Bran, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
von: Gong, Haozhen, et al.
Veröffentlicht: (2025) -
MASLab: A Unified and Comprehensive Codebase for LLM-based Multi-Agent Systems
von: Ye, Rui, et al.
Veröffentlicht: (2025) -
Evo-MedAgent: Beyond One-Shot Diagnosis with Agents That Remember, Reflect, and Improve
von: Shen, Weixiang, et al.
Veröffentlicht: (2026) -
UniICL: Systematizing Unified Multimodal In-context Learning through a Capability-Oriented Taxonomy
von: Xu, Yicheng, et al.
Veröffentlicht: (2026) -
SkillGraph: Self-Evolving Multi-Agent Collaboration with Multimodal Graph Topology
von: Nie, Zheng, et al.
Veröffentlicht: (2026)