MMedAgent: Learning to Use Medical Tools with Multi-modal Agent
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Binxu, Yan, Tiankai, Pan, Yuanting, Luo, Jie, Ji, Ruiyang, Ding, Jiayuan, Xu, Zhe, Liu, Shilong, Dong, Haoyu, Lin, Zihao, Wang, Yixin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MMedAgent-RL: Optimizing Multi-Agent Collaboration for Multimodal Medical Reasoning
par: Xia, Peng, et autres
Publié: (2025)
par: Xia, Peng, et autres
Publié: (2025)
MMedExpert-R1: Strengthening Multimodal Medical Reasoning via Domain-Specific Adaptation and Clinical Guideline Reinforcement
par: Ding, Meidan, et autres
Publié: (2026)
par: Ding, Meidan, et autres
Publié: (2026)
MMed-RAG: Versatile Multimodal RAG System for Medical Vision Language Models
par: Xia, Peng, et autres
Publié: (2024)
par: Xia, Peng, et autres
Publié: (2024)
Multi-modal Agent Tuning: Building a VLM-Driven Agent for Efficient Tool Usage
par: Gao, Zhi, et autres
Publié: (2024)
par: Gao, Zhi, et autres
Publié: (2024)
TUMIX: Multi-Agent Test-Time Scaling with Tool-Use Mixture
par: Chen, Yongchao, et autres
Publié: (2025)
par: Chen, Yongchao, et autres
Publié: (2025)
M3SD: Multi-modal, Multi-scenario and Multi-language Speaker Diarization Dataset
par: Wu, Shilong
Publié: (2025)
par: Wu, Shilong
Publié: (2025)
AgentGuard: An Attribute-Based Access Control Framework for Tool-Use LLM-Based Agent
par: Luo, Jiaqi, et autres
Publié: (2026)
par: Luo, Jiaqi, et autres
Publié: (2026)
CCA: Collaborative Competitive Agents for Image Editing
par: Hang, Tiankai, et autres
Publié: (2024)
par: Hang, Tiankai, et autres
Publié: (2024)
Approximate Global Convergence of Independent Learning in Multi-Agent Systems
par: Jin, Ruiyang, et autres
Publié: (2024)
par: Jin, Ruiyang, et autres
Publié: (2024)
Learning to Rewrite Tool Descriptions for Reliable LLM-Agent Tool Use
par: Guo, Ruocheng, et autres
Publié: (2026)
par: Guo, Ruocheng, et autres
Publié: (2026)
Evolving in Tasks: Empowering the Multi-modality Large Language Model as the Computer Use Agent
par: Cheng, Yuhao, et autres
Publié: (2025)
par: Cheng, Yuhao, et autres
Publié: (2025)
MMedPO: Aligning Medical Vision-Language Models with Clinical-Aware Multimodal Preference Optimization
par: Zhu, Kangyu, et autres
Publié: (2024)
par: Zhu, Kangyu, et autres
Publié: (2024)
MMedFD: A Real-world Healthcare Benchmark for Multi-turn Full-Duplex Automatic Speech Recognition
par: Chen, Hongzhao, et autres
Publié: (2025)
par: Chen, Hongzhao, et autres
Publié: (2025)
SciToolAgent: A Knowledge Graph-Driven Scientific Agent for Multi-Tool Integration
par: Ding, Keyan, et autres
Publié: (2025)
par: Ding, Keyan, et autres
Publié: (2025)
STRIDE: A Tool-Assisted LLM Agent Framework for Strategic and Interactive Decision-Making
par: Li, Chuanhao, et autres
Publié: (2024)
par: Li, Chuanhao, et autres
Publié: (2024)
Tree-of-Reasoning: Towards Complex Medical Diagnosis via Multi-Agent Reasoning with Evidence Tree
par: Peng, Qi, et autres
Publié: (2025)
par: Peng, Qi, et autres
Publié: (2025)
AgentsEval: Clinically Faithful Evaluation of Medical Imaging Reports via Multi-Agent Reasoning
par: Fu, Suzhong, et autres
Publié: (2026)
par: Fu, Suzhong, et autres
Publié: (2026)
CrashAgent: Crash Scenario Generation via Multi-modal Reasoning
par: Li, Miao, et autres
Publié: (2025)
par: Li, Miao, et autres
Publié: (2025)
The Evolution of Tool Use in LLM Agents: From Single-Tool Call to Multi-Tool Orchestration
par: Xu, Haoyuan, et autres
Publié: (2026)
par: Xu, Haoyuan, et autres
Publié: (2026)
Multi-Agent End-to-End Vulnerability Management for Mitigating Recurring Vulnerabilities
par: Zheng, Zelong, et autres
Publié: (2026)
par: Zheng, Zelong, et autres
Publié: (2026)
The Tool Illusion: Rethinking Tool Use in Web Agents
par: Lou, Renze, et autres
Publié: (2026)
par: Lou, Renze, et autres
Publié: (2026)
Learning to Use Tools via Cooperative and Interactive Agents
par: Shi, Zhengliang, et autres
Publié: (2024)
par: Shi, Zhengliang, et autres
Publié: (2024)
SoccerRef-Agents: Multi-Agent System for Automated Soccer Refereeing
par: Meng, Zi, et autres
Publié: (2026)
par: Meng, Zi, et autres
Publié: (2026)
No Attacker Needed: Unintentional Cross-User Contamination in Shared-State LLM Agents
par: Yang, Tiankai, et autres
Publié: (2026)
par: Yang, Tiankai, et autres
Publié: (2026)
Tool-to-Agent Retrieval: Bridging Tools and Agents for Scalable LLM Multi-Agent Systems
par: Lumer, Elias, et autres
Publié: (2025)
par: Lumer, Elias, et autres
Publié: (2025)
Rethinking the Role of Entropy in Optimizing Tool-Use Behaviors for Large Language Model Agents
par: Li, Zeping, et autres
Publié: (2026)
par: Li, Zeping, et autres
Publié: (2026)
LEMON: Learning Executable Multi-Agent Orchestration via Counterfactual Reinforcement Learning
par: Chen, Xudong, et autres
Publié: (2026)
par: Chen, Xudong, et autres
Publié: (2026)
Small LLMs Are Weak Tool Learners: A Multi-LLM Agent
par: Shen, Weizhou, et autres
Publié: (2024)
par: Shen, Weizhou, et autres
Publié: (2024)
Diversity Over Frequency: Rethinking Tool Use in Visual Chain-of-Thought Agents
par: Kim, Dong-Hee, et autres
Publié: (2026)
par: Kim, Dong-Hee, et autres
Publié: (2026)
Very Large-Scale Multi-Agent Simulation in AgentScope
par: Pan, Xuchen, et autres
Publié: (2024)
par: Pan, Xuchen, et autres
Publié: (2024)
Procedural Environment Generation for Tool-Use Agents
par: Sullivan, Michael, et autres
Publié: (2025)
par: Sullivan, Michael, et autres
Publié: (2025)
ToolCUA: Towards Optimal GUI-Tool Path Orchestration for Computer Use Agents
par: Hu, Xuhao, et autres
Publié: (2026)
par: Hu, Xuhao, et autres
Publié: (2026)
InvCoSS: Inversion-driven Continual Self-supervised Learning in Medical Multi-modal Image Pre-training
par: Luo, Zihao, et autres
Publié: (2025)
par: Luo, Zihao, et autres
Publié: (2025)
BattleAgent: Multi-modal Dynamic Emulation on Historical Battles to Complement Historical Analysis
par: Lin, Shuhang, et autres
Publié: (2024)
par: Lin, Shuhang, et autres
Publié: (2024)
Matching Accuracy, Different Geometry: Evolution Strategies vs GRPO in LLM Post-Training
par: Hoy, William, et autres
Publié: (2026)
par: Hoy, William, et autres
Publié: (2026)
Circuit Mechanisms for Spatial Relation Generation in Diffusion Transformers
par: Wang, Binxu, et autres
Publié: (2026)
par: Wang, Binxu, et autres
Publié: (2026)
GoAgent: Group-of-Agents Communication Topology Generation for LLM-based Multi-Agent Systems
par: Chen, Hongjiang, et autres
Publié: (2026)
par: Chen, Hongjiang, et autres
Publié: (2026)
CMR-Agent: Learning a Cross-Modal Agent for Iterative Image-to-Point Cloud Registration
par: Yao, Gongxin, et autres
Publié: (2024)
par: Yao, Gongxin, et autres
Publié: (2024)
FELA: A Multi-Agent Evolutionary System for Feature Engineering of Industrial Event Log Data
par: Ouyang, Kun, et autres
Publié: (2025)
par: Ouyang, Kun, et autres
Publié: (2025)
AgentTrust: Runtime Safety Evaluation and Interception for AI Agent Tool Use
par: Yang, Chenglin
Publié: (2026)
par: Yang, Chenglin
Publié: (2026)
Documents similaires
-
MMedAgent-RL: Optimizing Multi-Agent Collaboration for Multimodal Medical Reasoning
par: Xia, Peng, et autres
Publié: (2025) -
MMedExpert-R1: Strengthening Multimodal Medical Reasoning via Domain-Specific Adaptation and Clinical Guideline Reinforcement
par: Ding, Meidan, et autres
Publié: (2026) -
MMed-RAG: Versatile Multimodal RAG System for Medical Vision Language Models
par: Xia, Peng, et autres
Publié: (2024) -
Multi-modal Agent Tuning: Building a VLM-Driven Agent for Efficient Tool Usage
par: Gao, Zhi, et autres
Publié: (2024) -
TUMIX: Multi-Agent Test-Time Scaling with Tool-Use Mixture
par: Chen, Yongchao, et autres
Publié: (2025)