Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lai, Yuxiang, Zhong, Jike, Li, Ming, Zhao, Shitian, Li, Yuheng, Psounis, Konstantinos, Yang, Xiaofeng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Context Matters: Learning Global Semantics via Object-Centric Representation
par: Zhong, Jike, et autres
Publié: (2025)
par: Zhong, Jike, et autres
Publié: (2025)
Are Video Models Emerging as Zero-Shot Learners and Reasoners in Medical Imaging?
par: Lai, Yuxiang, et autres
Publié: (2025)
par: Lai, Yuxiang, et autres
Publié: (2025)
TIR-Bench: A Comprehensive Benchmark for Agentic Thinking-with-Images Reasoning
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
MedVista3D: Vision-Language Modeling for Reducing Diagnostic Errors in 3D CT Disease Detection, Understanding and Reporting
par: Li, Yuheng, et autres
Publié: (2025)
par: Li, Yuheng, et autres
Publié: (2025)
EEE-Bench: A Comprehensive Multimodal Electrical And Electronics Engineering Benchmark
par: Li, Ming, et autres
Publié: (2024)
par: Li, Ming, et autres
Publié: (2024)
VRIQ: Benchmarking and Analyzing Visual-Reasoning IQ of VLMs
par: Khezresmaeilzadeh, Tina, et autres
Publié: (2026)
par: Khezresmaeilzadeh, Tina, et autres
Publié: (2026)
Think or Not Think: A Study of Explicit Thinking in Rule-Based Visual Reinforcement Fine-Tuning
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
Patient-Specific Autoregressive Models for Organ Motion Prediction in Radiotherapy
par: Lai, Yuxiang, et autres
Publié: (2025)
par: Lai, Yuxiang, et autres
Publié: (2025)
MedDINOv3: How to adapt vision foundation models for medical image segmentation?
par: Li, Yuheng, et autres
Publié: (2025)
par: Li, Yuheng, et autres
Publié: (2025)
MedLVR: Latent Visual Reasoning for Reliable Medical Visual Question Answering
par: Xi, Suyang, et autres
Publié: (2026)
par: Xi, Suyang, et autres
Publié: (2026)
MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning
par: Pan, Jiazhen, et autres
Publié: (2025)
par: Pan, Jiazhen, et autres
Publié: (2025)
EchoVLM: Measurement-Grounded Multimodal Learning for Echocardiography
par: Li, Yuheng, et autres
Publié: (2025)
par: Li, Yuheng, et autres
Publié: (2025)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
par: Huang, Yu, et autres
Publié: (2025)
par: Huang, Yu, et autres
Publié: (2025)
Med3D-R1: Incentivizing Clinical Reasoning in 3D Medical Vision-Language Models for Abnormality Diagnosis
par: Lai, Haoran, et autres
Publié: (2026)
par: Lai, Haoran, et autres
Publié: (2026)
Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model
par: Wang, Hanqing, et autres
Publié: (2025)
par: Wang, Hanqing, et autres
Publié: (2025)
MedReason-R1: Learning to Reason for CT Diagnosis with Reinforcement Learning and Local Zoom
par: Li, Yifan, et autres
Publié: (2025)
par: Li, Yifan, et autres
Publié: (2025)
ManipLVM-R1: Reinforcement Learning for Reasoning in Embodied Manipulation with Large Vision-Language Models
par: Song, Zirui, et autres
Publié: (2025)
par: Song, Zirui, et autres
Publié: (2025)
Vision-Language Model Fine-Tuning via Simple Parameter-Efficient Modification
par: Li, Ming, et autres
Publié: (2024)
par: Li, Ming, et autres
Publié: (2024)
Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation
par: Yu, Wenjun, et autres
Publié: (2025)
par: Yu, Wenjun, et autres
Publié: (2025)
MedFact-R1: Towards Factual Medical Reasoning via Pseudo-Label Augmentation
par: Li, Gengliang, et autres
Publié: (2025)
par: Li, Gengliang, et autres
Publié: (2025)
MedCLIPSeg: Probabilistic Vision-Language Adaptation for Data-Efficient and Generalizable Medical Image Segmentation
par: Koleilat, Taha, et autres
Publié: (2026)
par: Koleilat, Taha, et autres
Publié: (2026)
On the Robustness of Medical Vision-Language Models: Are they Truly Generalizable?
par: Imam, Raza, et autres
Publié: (2025)
par: Imam, Raza, et autres
Publié: (2025)
PyVision-RL: Forging Open Agentic Vision Models via RL
par: Zhao, Shitian, et autres
Publié: (2026)
par: Zhao, Shitian, et autres
Publié: (2026)
TemMed-Bench: Evaluating Temporal Medical Image Reasoning in Vision-Language Models
par: Zhang, Junyi, et autres
Publié: (2025)
par: Zhang, Junyi, et autres
Publié: (2025)
Med-StepBench: A Hierarchical Reasoning Framework for Evaluating Hallucinations in Medical Vision-Language Models
par: Nguyen, Minh Khoi, et autres
Publié: (2026)
par: Nguyen, Minh Khoi, et autres
Publié: (2026)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
par: Tan, Huajie, et autres
Publié: (2025)
par: Tan, Huajie, et autres
Publié: (2025)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
par: Shao, Hao, et autres
Publié: (2025)
par: Shao, Hao, et autres
Publié: (2025)
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning
par: Yang, Senqiao, et autres
Publié: (2025)
par: Yang, Senqiao, et autres
Publié: (2025)
Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning
par: Zhan, Yufei, et autres
Publié: (2025)
par: Zhan, Yufei, et autres
Publié: (2025)
Hulu-Med: A Transparent Generalist Model towards Holistic Medical Vision-Language Understanding
par: Jiang, Songtao, et autres
Publié: (2025)
par: Jiang, Songtao, et autres
Publié: (2025)
VLA-R1: Enhancing Reasoning in Vision-Language-Action Models
par: Ye, Angen, et autres
Publié: (2025)
par: Ye, Angen, et autres
Publié: (2025)
PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning
par: Zhang, Yizhen, et autres
Publié: (2025)
par: Zhang, Yizhen, et autres
Publié: (2025)
MultiMedVision: Multi-Modal Medical Vision Framework
par: Li, Frank, et autres
Publié: (2026)
par: Li, Frank, et autres
Publié: (2026)
MedFoundationHub: A Lightweight and Secure Toolkit for Deploying Medical Vision Language Foundation Models
par: Li, Xiao, et autres
Publié: (2025)
par: Li, Xiao, et autres
Publié: (2025)
GMAI-VL-R1: Harnessing Reinforcement Learning for Multimodal Medical Reasoning
par: Su, Yanzhou, et autres
Publié: (2025)
par: Su, Yanzhou, et autres
Publié: (2025)
MedCLM: Learning to Localize and Reason via a CoT-Curriculum in Medical Vision-Language Models
par: Kim, Soo Yong, et autres
Publié: (2025)
par: Kim, Soo Yong, et autres
Publié: (2025)
Towards Universal Text-driven CT Image Segmentation
par: Li, Yuheng, et autres
Publié: (2025)
par: Li, Yuheng, et autres
Publié: (2025)
RL4Med-DDPO: Reinforcement Learning for Controlled Guidance Towards Diverse Medical Image Generation using Vision-Language Foundation Models
par: Saremi, Parham, et autres
Publié: (2025)
par: Saremi, Parham, et autres
Publié: (2025)
Boosting the Generalization and Reasoning of Vision Language Models with Curriculum Reinforcement Learning
par: Deng, Huilin, et autres
Publié: (2025)
par: Deng, Huilin, et autres
Publié: (2025)
Med-Evo: Test-time Self-evolution for Medical Multimodal Large Language Models
par: Xu, Dunyuan, et autres
Publié: (2026)
par: Xu, Dunyuan, et autres
Publié: (2026)
Documents similaires
-
Context Matters: Learning Global Semantics via Object-Centric Representation
par: Zhong, Jike, et autres
Publié: (2025) -
Are Video Models Emerging as Zero-Shot Learners and Reasoners in Medical Imaging?
par: Lai, Yuxiang, et autres
Publié: (2025) -
TIR-Bench: A Comprehensive Benchmark for Agentic Thinking-with-Images Reasoning
par: Li, Ming, et autres
Publié: (2025) -
MedVista3D: Vision-Language Modeling for Reducing Diagnostic Errors in 3D CT Disease Detection, Understanding and Reporting
par: Li, Yuheng, et autres
Publié: (2025) -
EEE-Bench: A Comprehensive Multimodal Electrical And Electronics Engineering Benchmark
par: Li, Ming, et autres
Publié: (2024)