Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Lai, Yuxiang, Zhong, Jike, Li, Ming, Zhao, Shitian, Li, Yuheng, Psounis, Konstantinos, Yang, Xiaofeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Context Matters: Learning Global Semantics via Object-Centric Representation
por: Zhong, Jike, et al.
Publicado: (2025)
por: Zhong, Jike, et al.
Publicado: (2025)
Are Video Models Emerging as Zero-Shot Learners and Reasoners in Medical Imaging?
por: Lai, Yuxiang, et al.
Publicado: (2025)
por: Lai, Yuxiang, et al.
Publicado: (2025)
TIR-Bench: A Comprehensive Benchmark for Agentic Thinking-with-Images Reasoning
por: Li, Ming, et al.
Publicado: (2025)
por: Li, Ming, et al.
Publicado: (2025)
MedVista3D: Vision-Language Modeling for Reducing Diagnostic Errors in 3D CT Disease Detection, Understanding and Reporting
por: Li, Yuheng, et al.
Publicado: (2025)
por: Li, Yuheng, et al.
Publicado: (2025)
EEE-Bench: A Comprehensive Multimodal Electrical And Electronics Engineering Benchmark
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
VRIQ: Benchmarking and Analyzing Visual-Reasoning IQ of VLMs
por: Khezresmaeilzadeh, Tina, et al.
Publicado: (2026)
por: Khezresmaeilzadeh, Tina, et al.
Publicado: (2026)
Think or Not Think: A Study of Explicit Thinking in Rule-Based Visual Reinforcement Fine-Tuning
por: Li, Ming, et al.
Publicado: (2025)
por: Li, Ming, et al.
Publicado: (2025)
Patient-Specific Autoregressive Models for Organ Motion Prediction in Radiotherapy
por: Lai, Yuxiang, et al.
Publicado: (2025)
por: Lai, Yuxiang, et al.
Publicado: (2025)
MedDINOv3: How to adapt vision foundation models for medical image segmentation?
por: Li, Yuheng, et al.
Publicado: (2025)
por: Li, Yuheng, et al.
Publicado: (2025)
MedLVR: Latent Visual Reasoning for Reliable Medical Visual Question Answering
por: Xi, Suyang, et al.
Publicado: (2026)
por: Xi, Suyang, et al.
Publicado: (2026)
MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning
por: Pan, Jiazhen, et al.
Publicado: (2025)
por: Pan, Jiazhen, et al.
Publicado: (2025)
EchoVLM: Measurement-Grounded Multimodal Learning for Echocardiography
por: Li, Yuheng, et al.
Publicado: (2025)
por: Li, Yuheng, et al.
Publicado: (2025)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
por: Huang, Yu, et al.
Publicado: (2025)
por: Huang, Yu, et al.
Publicado: (2025)
Med3D-R1: Incentivizing Clinical Reasoning in 3D Medical Vision-Language Models for Abnormality Diagnosis
por: Lai, Haoran, et al.
Publicado: (2026)
por: Lai, Haoran, et al.
Publicado: (2026)
Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model
por: Wang, Hanqing, et al.
Publicado: (2025)
por: Wang, Hanqing, et al.
Publicado: (2025)
MedReason-R1: Learning to Reason for CT Diagnosis with Reinforcement Learning and Local Zoom
por: Li, Yifan, et al.
Publicado: (2025)
por: Li, Yifan, et al.
Publicado: (2025)
ManipLVM-R1: Reinforcement Learning for Reasoning in Embodied Manipulation with Large Vision-Language Models
por: Song, Zirui, et al.
Publicado: (2025)
por: Song, Zirui, et al.
Publicado: (2025)
Vision-Language Model Fine-Tuning via Simple Parameter-Efficient Modification
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation
por: Yu, Wenjun, et al.
Publicado: (2025)
por: Yu, Wenjun, et al.
Publicado: (2025)
MedFact-R1: Towards Factual Medical Reasoning via Pseudo-Label Augmentation
por: Li, Gengliang, et al.
Publicado: (2025)
por: Li, Gengliang, et al.
Publicado: (2025)
MedCLIPSeg: Probabilistic Vision-Language Adaptation for Data-Efficient and Generalizable Medical Image Segmentation
por: Koleilat, Taha, et al.
Publicado: (2026)
por: Koleilat, Taha, et al.
Publicado: (2026)
On the Robustness of Medical Vision-Language Models: Are they Truly Generalizable?
por: Imam, Raza, et al.
Publicado: (2025)
por: Imam, Raza, et al.
Publicado: (2025)
PyVision-RL: Forging Open Agentic Vision Models via RL
por: Zhao, Shitian, et al.
Publicado: (2026)
por: Zhao, Shitian, et al.
Publicado: (2026)
TemMed-Bench: Evaluating Temporal Medical Image Reasoning in Vision-Language Models
por: Zhang, Junyi, et al.
Publicado: (2025)
por: Zhang, Junyi, et al.
Publicado: (2025)
Med-StepBench: A Hierarchical Reasoning Framework for Evaluating Hallucinations in Medical Vision-Language Models
por: Nguyen, Minh Khoi, et al.
Publicado: (2026)
por: Nguyen, Minh Khoi, et al.
Publicado: (2026)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
por: Tan, Huajie, et al.
Publicado: (2025)
por: Tan, Huajie, et al.
Publicado: (2025)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
por: Shao, Hao, et al.
Publicado: (2025)
por: Shao, Hao, et al.
Publicado: (2025)
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning
por: Yang, Senqiao, et al.
Publicado: (2025)
por: Yang, Senqiao, et al.
Publicado: (2025)
Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning
por: Zhan, Yufei, et al.
Publicado: (2025)
por: Zhan, Yufei, et al.
Publicado: (2025)
Hulu-Med: A Transparent Generalist Model towards Holistic Medical Vision-Language Understanding
por: Jiang, Songtao, et al.
Publicado: (2025)
por: Jiang, Songtao, et al.
Publicado: (2025)
VLA-R1: Enhancing Reasoning in Vision-Language-Action Models
por: Ye, Angen, et al.
Publicado: (2025)
por: Ye, Angen, et al.
Publicado: (2025)
PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning
por: Zhang, Yizhen, et al.
Publicado: (2025)
por: Zhang, Yizhen, et al.
Publicado: (2025)
MultiMedVision: Multi-Modal Medical Vision Framework
por: Li, Frank, et al.
Publicado: (2026)
por: Li, Frank, et al.
Publicado: (2026)
MedFoundationHub: A Lightweight and Secure Toolkit for Deploying Medical Vision Language Foundation Models
por: Li, Xiao, et al.
Publicado: (2025)
por: Li, Xiao, et al.
Publicado: (2025)
GMAI-VL-R1: Harnessing Reinforcement Learning for Multimodal Medical Reasoning
por: Su, Yanzhou, et al.
Publicado: (2025)
por: Su, Yanzhou, et al.
Publicado: (2025)
MedCLM: Learning to Localize and Reason via a CoT-Curriculum in Medical Vision-Language Models
por: Kim, Soo Yong, et al.
Publicado: (2025)
por: Kim, Soo Yong, et al.
Publicado: (2025)
Towards Universal Text-driven CT Image Segmentation
por: Li, Yuheng, et al.
Publicado: (2025)
por: Li, Yuheng, et al.
Publicado: (2025)
RL4Med-DDPO: Reinforcement Learning for Controlled Guidance Towards Diverse Medical Image Generation using Vision-Language Foundation Models
por: Saremi, Parham, et al.
Publicado: (2025)
por: Saremi, Parham, et al.
Publicado: (2025)
Boosting the Generalization and Reasoning of Vision Language Models with Curriculum Reinforcement Learning
por: Deng, Huilin, et al.
Publicado: (2025)
por: Deng, Huilin, et al.
Publicado: (2025)
Med-Evo: Test-time Self-evolution for Medical Multimodal Large Language Models
por: Xu, Dunyuan, et al.
Publicado: (2026)
por: Xu, Dunyuan, et al.
Publicado: (2026)
Ejemplares similares
-
Context Matters: Learning Global Semantics via Object-Centric Representation
por: Zhong, Jike, et al.
Publicado: (2025) -
Are Video Models Emerging as Zero-Shot Learners and Reasoners in Medical Imaging?
por: Lai, Yuxiang, et al.
Publicado: (2025) -
TIR-Bench: A Comprehensive Benchmark for Agentic Thinking-with-Images Reasoning
por: Li, Ming, et al.
Publicado: (2025) -
MedVista3D: Vision-Language Modeling for Reducing Diagnostic Errors in 3D CT Disease Detection, Understanding and Reporting
por: Li, Yuheng, et al.
Publicado: (2025) -
EEE-Bench: A Comprehensive Multimodal Electrical And Electronics Engineering Benchmark
por: Li, Ming, et al.
Publicado: (2024)