Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Lai, Yuxiang, Zhong, Jike, Li, Ming, Zhao, Shitian, Li, Yuheng, Psounis, Konstantinos, Yang, Xiaofeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Context Matters: Learning Global Semantics via Object-Centric Representation
di: Zhong, Jike, et al.
Pubblicazione: (2025)
di: Zhong, Jike, et al.
Pubblicazione: (2025)
Are Video Models Emerging as Zero-Shot Learners and Reasoners in Medical Imaging?
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
TIR-Bench: A Comprehensive Benchmark for Agentic Thinking-with-Images Reasoning
di: Li, Ming, et al.
Pubblicazione: (2025)
di: Li, Ming, et al.
Pubblicazione: (2025)
MedVista3D: Vision-Language Modeling for Reducing Diagnostic Errors in 3D CT Disease Detection, Understanding and Reporting
di: Li, Yuheng, et al.
Pubblicazione: (2025)
di: Li, Yuheng, et al.
Pubblicazione: (2025)
EEE-Bench: A Comprehensive Multimodal Electrical And Electronics Engineering Benchmark
di: Li, Ming, et al.
Pubblicazione: (2024)
di: Li, Ming, et al.
Pubblicazione: (2024)
VRIQ: Benchmarking and Analyzing Visual-Reasoning IQ of VLMs
di: Khezresmaeilzadeh, Tina, et al.
Pubblicazione: (2026)
di: Khezresmaeilzadeh, Tina, et al.
Pubblicazione: (2026)
Think or Not Think: A Study of Explicit Thinking in Rule-Based Visual Reinforcement Fine-Tuning
di: Li, Ming, et al.
Pubblicazione: (2025)
di: Li, Ming, et al.
Pubblicazione: (2025)
Patient-Specific Autoregressive Models for Organ Motion Prediction in Radiotherapy
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
MedDINOv3: How to adapt vision foundation models for medical image segmentation?
di: Li, Yuheng, et al.
Pubblicazione: (2025)
di: Li, Yuheng, et al.
Pubblicazione: (2025)
MedLVR: Latent Visual Reasoning for Reliable Medical Visual Question Answering
di: Xi, Suyang, et al.
Pubblicazione: (2026)
di: Xi, Suyang, et al.
Pubblicazione: (2026)
MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning
di: Pan, Jiazhen, et al.
Pubblicazione: (2025)
di: Pan, Jiazhen, et al.
Pubblicazione: (2025)
EchoVLM: Measurement-Grounded Multimodal Learning for Echocardiography
di: Li, Yuheng, et al.
Pubblicazione: (2025)
di: Li, Yuheng, et al.
Pubblicazione: (2025)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
di: Huang, Yu, et al.
Pubblicazione: (2025)
di: Huang, Yu, et al.
Pubblicazione: (2025)
Med3D-R1: Incentivizing Clinical Reasoning in 3D Medical Vision-Language Models for Abnormality Diagnosis
di: Lai, Haoran, et al.
Pubblicazione: (2026)
di: Lai, Haoran, et al.
Pubblicazione: (2026)
Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model
di: Wang, Hanqing, et al.
Pubblicazione: (2025)
di: Wang, Hanqing, et al.
Pubblicazione: (2025)
MedReason-R1: Learning to Reason for CT Diagnosis with Reinforcement Learning and Local Zoom
di: Li, Yifan, et al.
Pubblicazione: (2025)
di: Li, Yifan, et al.
Pubblicazione: (2025)
ManipLVM-R1: Reinforcement Learning for Reasoning in Embodied Manipulation with Large Vision-Language Models
di: Song, Zirui, et al.
Pubblicazione: (2025)
di: Song, Zirui, et al.
Pubblicazione: (2025)
Vision-Language Model Fine-Tuning via Simple Parameter-Efficient Modification
di: Li, Ming, et al.
Pubblicazione: (2024)
di: Li, Ming, et al.
Pubblicazione: (2024)
Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation
di: Yu, Wenjun, et al.
Pubblicazione: (2025)
di: Yu, Wenjun, et al.
Pubblicazione: (2025)
MedFact-R1: Towards Factual Medical Reasoning via Pseudo-Label Augmentation
di: Li, Gengliang, et al.
Pubblicazione: (2025)
di: Li, Gengliang, et al.
Pubblicazione: (2025)
MedCLIPSeg: Probabilistic Vision-Language Adaptation for Data-Efficient and Generalizable Medical Image Segmentation
di: Koleilat, Taha, et al.
Pubblicazione: (2026)
di: Koleilat, Taha, et al.
Pubblicazione: (2026)
On the Robustness of Medical Vision-Language Models: Are they Truly Generalizable?
di: Imam, Raza, et al.
Pubblicazione: (2025)
di: Imam, Raza, et al.
Pubblicazione: (2025)
PyVision-RL: Forging Open Agentic Vision Models via RL
di: Zhao, Shitian, et al.
Pubblicazione: (2026)
di: Zhao, Shitian, et al.
Pubblicazione: (2026)
TemMed-Bench: Evaluating Temporal Medical Image Reasoning in Vision-Language Models
di: Zhang, Junyi, et al.
Pubblicazione: (2025)
di: Zhang, Junyi, et al.
Pubblicazione: (2025)
Med-StepBench: A Hierarchical Reasoning Framework for Evaluating Hallucinations in Medical Vision-Language Models
di: Nguyen, Minh Khoi, et al.
Pubblicazione: (2026)
di: Nguyen, Minh Khoi, et al.
Pubblicazione: (2026)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
di: Tan, Huajie, et al.
Pubblicazione: (2025)
di: Tan, Huajie, et al.
Pubblicazione: (2025)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
di: Shao, Hao, et al.
Pubblicazione: (2025)
di: Shao, Hao, et al.
Pubblicazione: (2025)
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning
di: Yang, Senqiao, et al.
Pubblicazione: (2025)
di: Yang, Senqiao, et al.
Pubblicazione: (2025)
Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning
di: Zhan, Yufei, et al.
Pubblicazione: (2025)
di: Zhan, Yufei, et al.
Pubblicazione: (2025)
Hulu-Med: A Transparent Generalist Model towards Holistic Medical Vision-Language Understanding
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
VLA-R1: Enhancing Reasoning in Vision-Language-Action Models
di: Ye, Angen, et al.
Pubblicazione: (2025)
di: Ye, Angen, et al.
Pubblicazione: (2025)
PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning
di: Zhang, Yizhen, et al.
Pubblicazione: (2025)
di: Zhang, Yizhen, et al.
Pubblicazione: (2025)
MultiMedVision: Multi-Modal Medical Vision Framework
di: Li, Frank, et al.
Pubblicazione: (2026)
di: Li, Frank, et al.
Pubblicazione: (2026)
MedFoundationHub: A Lightweight and Secure Toolkit for Deploying Medical Vision Language Foundation Models
di: Li, Xiao, et al.
Pubblicazione: (2025)
di: Li, Xiao, et al.
Pubblicazione: (2025)
GMAI-VL-R1: Harnessing Reinforcement Learning for Multimodal Medical Reasoning
di: Su, Yanzhou, et al.
Pubblicazione: (2025)
di: Su, Yanzhou, et al.
Pubblicazione: (2025)
MedCLM: Learning to Localize and Reason via a CoT-Curriculum in Medical Vision-Language Models
di: Kim, Soo Yong, et al.
Pubblicazione: (2025)
di: Kim, Soo Yong, et al.
Pubblicazione: (2025)
Towards Universal Text-driven CT Image Segmentation
di: Li, Yuheng, et al.
Pubblicazione: (2025)
di: Li, Yuheng, et al.
Pubblicazione: (2025)
RL4Med-DDPO: Reinforcement Learning for Controlled Guidance Towards Diverse Medical Image Generation using Vision-Language Foundation Models
di: Saremi, Parham, et al.
Pubblicazione: (2025)
di: Saremi, Parham, et al.
Pubblicazione: (2025)
Boosting the Generalization and Reasoning of Vision Language Models with Curriculum Reinforcement Learning
di: Deng, Huilin, et al.
Pubblicazione: (2025)
di: Deng, Huilin, et al.
Pubblicazione: (2025)
Med-Evo: Test-time Self-evolution for Medical Multimodal Large Language Models
di: Xu, Dunyuan, et al.
Pubblicazione: (2026)
di: Xu, Dunyuan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Context Matters: Learning Global Semantics via Object-Centric Representation
di: Zhong, Jike, et al.
Pubblicazione: (2025) -
Are Video Models Emerging as Zero-Shot Learners and Reasoners in Medical Imaging?
di: Lai, Yuxiang, et al.
Pubblicazione: (2025) -
TIR-Bench: A Comprehensive Benchmark for Agentic Thinking-with-Images Reasoning
di: Li, Ming, et al.
Pubblicazione: (2025) -
MedVista3D: Vision-Language Modeling for Reducing Diagnostic Errors in 3D CT Disease Detection, Understanding and Reporting
di: Li, Yuheng, et al.
Pubblicazione: (2025) -
EEE-Bench: A Comprehensive Multimodal Electrical And Electronics Engineering Benchmark
di: Li, Ming, et al.
Pubblicazione: (2024)