MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Pan, Jiazhen, Liu, Che, Wu, Junde, Liu, Fenglin, Zhu, Jiayuan, Li, Hongwei Bran, Chen, Chen, Ouyang, Cheng, Rueckert, Daniel |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Ask Patients with Patience: Enabling LLMs for Human-Centric Medical Dialogue with Grounded Reasoning
por: Zhu, Jiayuan, et al.
Publicado: (2025)
por: Zhu, Jiayuan, et al.
Publicado: (2025)
MedUHIP: Towards Human-In-the-Loop Medical Segmentation
por: Zhu, Jiayuan, et al.
Publicado: (2024)
por: Zhu, Jiayuan, et al.
Publicado: (2024)
Beyond Benchmarks: Dynamic, Automatic And Systematic Red-Teaming Agents For Trustworthy Medical Language Models
por: Pan, Jiazhen, et al.
Publicado: (2025)
por: Pan, Jiazhen, et al.
Publicado: (2025)
MedOpenClaw and MedFlowBench: Auditing Medical Agents in Full-Study Workflows
por: Shen, Weixiang, et al.
Publicado: (2026)
por: Shen, Weixiang, et al.
Publicado: (2026)
Evo-MedAgent: Beyond One-Shot Diagnosis with Agents That Remember, Reflect, and Improve
por: Shen, Weixiang, et al.
Publicado: (2026)
por: Shen, Weixiang, et al.
Publicado: (2026)
MedVH: Toward Systematic Evaluation of Hallucination for Large Vision Language Models in the Medical Context
por: Zishan Gu, et al.
Publicado: (2025)
por: Zishan Gu, et al.
Publicado: (2025)
BioMedArena: An Open-source Toolkit for Building and Evaluating Biomedical Deep Research Agents
por: Wu, Jinge, et al.
Publicado: (2026)
por: Wu, Jinge, et al.
Publicado: (2026)
How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study
por: Liu, Che, et al.
Publicado: (2025)
por: Liu, Che, et al.
Publicado: (2025)
DINO-R1: Incentivizing Reasoning Capability in Vision Foundation Models
por: Pan, Chenbin, et al.
Publicado: (2025)
por: Pan, Chenbin, et al.
Publicado: (2025)
Med-R2: An Adversarial Benchmark for Evidence-Grounded Reasoning in Medical VLMs
por: Ma, Wen, et al.
Publicado: (2026)
por: Ma, Wen, et al.
Publicado: (2026)
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
por: Gong, Haozhen, et al.
Publicado: (2025)
por: Gong, Haozhen, et al.
Publicado: (2025)
Disentangling Progress in Medical Image Registration: Beyond Trend-Driven Architectures towards Domain-Specific Strategies
por: Jian, Bailiang, et al.
Publicado: (2025)
por: Jian, Bailiang, et al.
Publicado: (2025)
SPA: Efficient User-Preference Alignment against Uncertainty in Medical Image Segmentation
por: Zhu, Jiayuan, et al.
Publicado: (2024)
por: Zhu, Jiayuan, et al.
Publicado: (2024)
Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning
por: Zhang, Xiaotian, et al.
Publicado: (2025)
por: Zhang, Xiaotian, et al.
Publicado: (2025)
MedVH: Towards Systematic Evaluation of Hallucination for Large Vision Language Models in the Medical Context
por: Gu, Zishan, et al.
Publicado: (2024)
por: Gu, Zishan, et al.
Publicado: (2024)
Git Context Controller: Manage the Context of LLM-based Agents like Git
por: Wu, Junde, et al.
Publicado: (2025)
por: Wu, Junde, et al.
Publicado: (2025)
Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL
por: Liu, Che, et al.
Publicado: (2025)
por: Liu, Che, et al.
Publicado: (2025)
DDX-TRACE: A Benchmark for Medical Diagnostic Trajectories in VLMs
por: Pan, Jiazhen, et al.
Publicado: (2026)
por: Pan, Jiazhen, et al.
Publicado: (2026)
DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
por: DeepSeek-AI, et al.
Publicado: (2025)
por: DeepSeek-AI, et al.
Publicado: (2025)
Agentic Reasoning: A Streamlined Framework for Enhancing LLM Reasoning with Agentic Tools
por: Wu, Junde, et al.
Publicado: (2025)
por: Wu, Junde, et al.
Publicado: (2025)
HiMed: Incentivizing Hindi Reasoning in Medical LLMs
por: Jiang, Dingfeng, et al.
Publicado: (2026)
por: Jiang, Dingfeng, et al.
Publicado: (2026)
MedCalc-Eval and MedCalc-Env: Advancing Medical Calculation Capabilities of Large Language Models
por: Mao, Kangkun, et al.
Publicado: (2025)
por: Mao, Kangkun, et al.
Publicado: (2025)
Empowering Small VLMs to Think with Dynamic Memorization and Exploration
por: Liu, Jiazhen, et al.
Publicado: (2025)
por: Liu, Jiazhen, et al.
Publicado: (2025)
One-Prompt to Segment All Medical Images
por: Wu, Junde, et al.
Publicado: (2023)
por: Wu, Junde, et al.
Publicado: (2023)
R-Log: Incentivizing Log Analysis Capability in LLMs via Reasoning-based Reinforcement Learning
por: Liu, Yilun, et al.
Publicado: (2025)
por: Liu, Yilun, et al.
Publicado: (2025)
Towards Cardiac MRI Foundation Models: Comprehensive Visual-Tabular Representations for Whole-Heart Assessment and Beyond
por: Zhang, Yundi, et al.
Publicado: (2025)
por: Zhang, Yundi, et al.
Publicado: (2025)
SWE Context Bench: A Benchmark for Context Learning in Coding
por: Zhu, Jiayuan, et al.
Publicado: (2026)
por: Zhu, Jiayuan, et al.
Publicado: (2026)
Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models
por: Lai, Yuxiang, et al.
Publicado: (2025)
por: Lai, Yuxiang, et al.
Publicado: (2025)
Decompose, Look, and Reason: Reinforced Latent Reasoning for VLMs
por: Zhu, Mengdan, et al.
Publicado: (2026)
por: Zhu, Mengdan, et al.
Publicado: (2026)
Segmentation as A Plug-and-Play Capability for Frozen Multimodal LLMs
por: Liu, Jiazhen, et al.
Publicado: (2025)
por: Liu, Jiazhen, et al.
Publicado: (2025)
Med3D-R1: Incentivizing Clinical Reasoning in 3D Medical Vision-Language Models for Abnormality Diagnosis
por: Lai, Haoran, et al.
Publicado: (2026)
por: Lai, Haoran, et al.
Publicado: (2026)
Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models
por: Huang, Wenxuan, et al.
Publicado: (2025)
por: Huang, Wenxuan, et al.
Publicado: (2025)
MedMASLab: A Unified Orchestration Framework for Benchmarking Multimodal Medical Multi-Agent Systems
por: Qian, Yunhang, et al.
Publicado: (2026)
por: Qian, Yunhang, et al.
Publicado: (2026)
MetaSpatial: Reinforcing 3D Spatial Reasoning in VLMs for the Metaverse
por: Pan, Zhenyu, et al.
Publicado: (2025)
por: Pan, Zhenyu, et al.
Publicado: (2025)
From Failure to Feedback: Group Revision Unlocks Hard Cases in Object-Level Grounding
por: Liu, Yuyuan, et al.
Publicado: (2026)
por: Liu, Yuyuan, et al.
Publicado: (2026)
rSIM: Incentivizing Reasoning Capabilities of LLMs via Reinforced Strategy Injection
por: Chen, Sijia, et al.
Publicado: (2025)
por: Chen, Sijia, et al.
Publicado: (2025)
Saliency-R1: Incentivizing Unified Saliency Reasoning Capability in MLLM with Confidence-Guided Reinforcement Learning
por: Li, Long, et al.
Publicado: (2025)
por: Li, Long, et al.
Publicado: (2025)
RiskAgent: Synergizing Language Models with Validated Tools for Evidence-Based Risk Prediction
por: Liu, Fenglin, et al.
Publicado: (2025)
por: Liu, Fenglin, et al.
Publicado: (2025)
Unsupervised whole-heart function assessment
por: Zhang, Yundi, et al.
Publicado: (2025)
por: Zhang, Yundi, et al.
Publicado: (2025)
Incentivizing Neuro-symbolic Language-based Reasoning in VLMs via Reinforcement Learning
por: Palaniappan, Karthic
Publicado: (2026)
por: Palaniappan, Karthic
Publicado: (2026)
Ejemplares similares
-
Ask Patients with Patience: Enabling LLMs for Human-Centric Medical Dialogue with Grounded Reasoning
por: Zhu, Jiayuan, et al.
Publicado: (2025) -
MedUHIP: Towards Human-In-the-Loop Medical Segmentation
por: Zhu, Jiayuan, et al.
Publicado: (2024) -
Beyond Benchmarks: Dynamic, Automatic And Systematic Red-Teaming Agents For Trustworthy Medical Language Models
por: Pan, Jiazhen, et al.
Publicado: (2025) -
MedOpenClaw and MedFlowBench: Auditing Medical Agents in Full-Study Workflows
por: Shen, Weixiang, et al.
Publicado: (2026) -
Evo-MedAgent: Beyond One-Shot Diagnosis with Agents That Remember, Reflect, and Improve
por: Shen, Weixiang, et al.
Publicado: (2026)