Med3D-R1: Incentivizing Clinical Reasoning in 3D Medical Vision-Language Models for Abnormality Diagnosis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lai, Haoran, Jiang, Zihang, Zhang, Kun, Yao, Qingsong, Wang, Rongsheng, He, Zhiyang, Tao, Xiaodong, Wei, Wei, Zhou, Shaohua Kevin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Bridged Semantic Alignment for Zero-shot 3D Medical Image Diagnosis
par: Lai, Haoran, et autres
Publié: (2025)
par: Lai, Haoran, et autres
Publié: (2025)
E3D-GPT: Enhanced 3D Visual Foundation for Medical Vision-Language Model
par: Lai, Haoran, et autres
Publié: (2024)
par: Lai, Haoran, et autres
Publié: (2024)
ECAMP: Entity-centered Context-aware Medical Vision Language Pre-training
par: Wang, Rongsheng, et autres
Publié: (2023)
par: Wang, Rongsheng, et autres
Publié: (2023)
CARZero: Cross-Attention Alignment for Radiology Zero-Shot Classification
par: Lai, Haoran, et autres
Publié: (2024)
par: Lai, Haoran, et autres
Publié: (2024)
ASAP: Advancing Medical Volumetric Representation Learning with Anatomy-aware Semantically-adaptive Pre-training
par: Wang, Rongsheng, et autres
Publié: (2026)
par: Wang, Rongsheng, et autres
Publié: (2026)
SimCroP: Radiograph Representation Learning with Similarity-driven Cross-granularity Pre-training
par: Wang, Rongsheng, et autres
Publié: (2025)
par: Wang, Rongsheng, et autres
Publié: (2025)
MedReason-R1: Learning to Reason for CT Diagnosis with Reinforcement Learning and Local Zoom
par: Li, Yifan, et autres
Publié: (2025)
par: Li, Yifan, et autres
Publié: (2025)
MedFact: Benchmarking the Fact-Checking Capabilities of Large Language Models on Chinese Medical Texts
par: He, Jiayi, et autres
Publié: (2025)
par: He, Jiayi, et autres
Publié: (2025)
Med3DVLM: An Efficient Vision-Language Model for 3D Medical Image Analysis
par: Xin, Yu, et autres
Publié: (2025)
par: Xin, Yu, et autres
Publié: (2025)
MedScope: Incentivizing "Think with Videos" for Clinical Reasoning via Coarse-to-Fine Tool Calling
par: Li, Wenjie, et autres
Publié: (2026)
par: Li, Wenjie, et autres
Publié: (2026)
MedAtlas: Evaluating LLMs for Multi-Round, Multi-Task Medical Reasoning Across Diverse Imaging Modalities and Clinical Text
par: Xu, Ronghao, et autres
Publié: (2025)
par: Xu, Ronghao, et autres
Publié: (2025)
MedOrch: Medical Diagnosis with Tool-Augmented Reasoning Agents for Flexible Extensibility
par: He, Yexiao, et autres
Publié: (2025)
par: He, Yexiao, et autres
Publié: (2025)
HiMed: Incentivizing Hindi Reasoning in Medical LLMs
par: Jiang, Dingfeng, et autres
Publié: (2026)
par: Jiang, Dingfeng, et autres
Publié: (2026)
From Documents to Spans: Scalable Supervision for Evidence-Based ICD Coding with LLMs
par: Zhang, Xu, et autres
Publié: (2026)
par: Zhang, Xu, et autres
Publié: (2026)
MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning
par: Pan, Jiazhen, et autres
Publié: (2025)
par: Pan, Jiazhen, et autres
Publié: (2025)
MVP-CBM:Multi-layer Visual Preference-enhanced Concept Bottleneck Model for Explainable Medical Image Classification
par: Wang, Chunjiang, et autres
Publié: (2025)
par: Wang, Chunjiang, et autres
Publié: (2025)
Pre-Trained LLM is a Semantic-Aware and Generalizable Segmentation Booster
par: Tang, Fenghe, et autres
Publié: (2025)
par: Tang, Fenghe, et autres
Publié: (2025)
MACD: Multi-Agent Clinical Diagnosis with Self-Learned Knowledge for LLM
par: Li, Wenliang, et autres
Publié: (2025)
par: Li, Wenliang, et autres
Publié: (2025)
Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models
par: Lai, Yuxiang, et autres
Publié: (2025)
par: Lai, Yuxiang, et autres
Publié: (2025)
3D MedDiffusion: A 3D Medical Latent Diffusion Model for Controllable and High-quality Medical Image Generation
par: Wang, Haoshen, et autres
Publié: (2024)
par: Wang, Haoshen, et autres
Publié: (2024)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
par: Shao, Hao, et autres
Publié: (2025)
par: Shao, Hao, et autres
Publié: (2025)
H3DE-Net: Efficient and Accurate 3D Landmark Detection in Medical Imaging
par: Huang, Zhen, et autres
Publié: (2025)
par: Huang, Zhen, et autres
Publié: (2025)
MedTVT-R1: A Multimodal LLM Empowering Medical Reasoning and Diagnosis
par: Zhang, Yuting, et autres
Publié: (2025)
par: Zhang, Yuting, et autres
Publié: (2025)
ProMedical: Hierarchical Fine-Grained Criteria Modeling for Medical LLM Alignment via Explicit Injection
par: Geng, He, et autres
Publié: (2026)
par: Geng, He, et autres
Publié: (2026)
DiffVP: Differential Visual Semantic Prompting for LLM-Based CT Report Generation
par: Tian, Yuhe, et autres
Publié: (2026)
par: Tian, Yuhe, et autres
Publié: (2026)
MedMIX: Modality-Internal Expert Fusion for Multimodal Medical Diagnosis
par: Cho, Seungik, et autres
Publié: (2026)
par: Cho, Seungik, et autres
Publié: (2026)
GreenRFM: Toward a resource-efficient radiology foundation model
par: Li, Yingtai, et autres
Publié: (2026)
par: Li, Yingtai, et autres
Publié: (2026)
DINO-R1: Incentivizing Reasoning Capability in Vision Foundation Models
par: Pan, Chenbin, et autres
Publié: (2025)
par: Pan, Chenbin, et autres
Publié: (2025)
MedVista3D: Vision-Language Modeling for Reducing Diagnostic Errors in 3D CT Disease Detection, Understanding and Reporting
par: Li, Yuheng, et autres
Publié: (2025)
par: Li, Yuheng, et autres
Publié: (2025)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
par: Huang, Yu, et autres
Publié: (2025)
par: Huang, Yu, et autres
Publié: (2025)
Medical Vision-Language Pre-Training for Brain Abnormalities
par: Monajatipoor, Masoud, et autres
Publié: (2024)
par: Monajatipoor, Masoud, et autres
Publié: (2024)
MedShapeNet -- A Large-Scale Dataset of 3D Medical Shapes for Computer Vision
par: Li, Jianning, et autres
Publié: (2023)
par: Li, Jianning, et autres
Publié: (2023)
Loc3R-VLM: Language-based Localization and 3D Reasoning with Vision-Language Models
par: Qu, Kevin, et autres
Publié: (2026)
par: Qu, Kevin, et autres
Publié: (2026)
Chromosomal Structural Abnormality Diagnosis by Homologous Similarity
par: Li, Juren, et autres
Publié: (2024)
par: Li, Juren, et autres
Publié: (2024)
Wonder3D++: Cross-domain Diffusion for High-fidelity 3D Generation from a Single Image
par: Yang, Yuxiao, et autres
Publié: (2025)
par: Yang, Yuxiao, et autres
Publié: (2025)
R2G: Reasoning to Ground in 3D Scenes
par: Li, Yixuan, et autres
Publié: (2024)
par: Li, Yixuan, et autres
Publié: (2024)
RJUA-MedDQA: A Multimodal Benchmark for Medical Document Question Answering and Clinical Reasoning
par: Jin, Congyun, et autres
Publié: (2024)
par: Jin, Congyun, et autres
Publié: (2024)
Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning
par: Zhang, Xiaotian, et autres
Publié: (2025)
par: Zhang, Xiaotian, et autres
Publié: (2025)
Dynamic Point Maps: A Versatile Representation for Dynamic 3D Reconstruction
par: Sucar, Edgar, et autres
Publié: (2025)
par: Sucar, Edgar, et autres
Publié: (2025)
Are Vision Language Models Ready for Clinical Diagnosis? A 3D Medical Benchmark for Tumor-centric Visual Question Answering
par: Chen, Yixiong, et autres
Publié: (2025)
par: Chen, Yixiong, et autres
Publié: (2025)
Documents similaires
-
Bridged Semantic Alignment for Zero-shot 3D Medical Image Diagnosis
par: Lai, Haoran, et autres
Publié: (2025) -
E3D-GPT: Enhanced 3D Visual Foundation for Medical Vision-Language Model
par: Lai, Haoran, et autres
Publié: (2024) -
ECAMP: Entity-centered Context-aware Medical Vision Language Pre-training
par: Wang, Rongsheng, et autres
Publié: (2023) -
CARZero: Cross-Attention Alignment for Radiology Zero-Shot Classification
par: Lai, Haoran, et autres
Publié: (2024) -
ASAP: Advancing Medical Volumetric Representation Learning with Anatomy-aware Semantically-adaptive Pre-training
par: Wang, Rongsheng, et autres
Publié: (2026)