MedLoc-R1: Performance-Aware Curriculum Reward Scheduling for GRPO-Based Medical Visual Grounding
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Guangjing, Qin, Ziyuan, Zhang, Chaoran, Du, Chenlin, Wang, Jinlin, Sun, Wanran, Zhang, Zhenyu, Ji, Bing, Lao, Qicheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Medical Visual Reinforcement Fine-Tuning via Perception and Reasoning Augmentation
di: Yang, Guangjing, et al.
Pubblicazione: (2026)
di: Yang, Guangjing, et al.
Pubblicazione: (2026)
Guiding Medical Vision-Language Models with Explicit Visual Prompts: Framework Design and Comprehensive Exploration of Prompt Variations
di: Zhu, Kangyu, et al.
Pubblicazione: (2025)
di: Zhu, Kangyu, et al.
Pubblicazione: (2025)
Curriculum Prompting Foundation Models for Medical Image Segmentation
di: Zheng, Xiuqi, et al.
Pubblicazione: (2024)
di: Zheng, Xiuqi, et al.
Pubblicazione: (2024)
MLAE: Masked LoRA Experts for Visual Parameter-Efficient Fine-Tuning
di: Wang, Junjie, et al.
Pubblicazione: (2024)
di: Wang, Junjie, et al.
Pubblicazione: (2024)
Scheduled trips for various bus types
di: Zhou, Guangjing
Pubblicazione: (2025)
di: Zhou, Guangjing
Pubblicazione: (2025)
iDPA: Instance Decoupled Prompt Attention for Incremental Medical Object Detection
di: Yi, Huahui, et al.
Pubblicazione: (2025)
di: Yi, Huahui, et al.
Pubblicazione: (2025)
Confounder-Aware Medical Data Selection for Fine-Tuning Pretrained Vision Models
di: Ji, Anyang, et al.
Pubblicazione: (2025)
di: Ji, Anyang, et al.
Pubblicazione: (2025)
Improving Generalization in Intent Detection: GRPO with Reward-Based Curriculum Sampling
di: Feng, Zihao, et al.
Pubblicazione: (2025)
di: Feng, Zihao, et al.
Pubblicazione: (2025)
Overthinking Reduction with Decoupled Rewards and Curriculum Data Scheduling
di: Jiang, Shuyang, et al.
Pubblicazione: (2025)
di: Jiang, Shuyang, et al.
Pubblicazione: (2025)
MMR-GRPO: Accelerating GRPO-Style Training through Diversity-Aware Reward Reweighting
di: Wei, Kangda, et al.
Pubblicazione: (2026)
di: Wei, Kangda, et al.
Pubblicazione: (2026)
MedCRP-CL: Continual Medical Image Segmentation via Bayesian Nonparametric Semantic Modality Discovery
di: Gao, Ziyuan
Pubblicazione: (2026)
di: Gao, Ziyuan
Pubblicazione: (2026)
MedPRMBench: A Fine-grained Benchmark for Process Reward Models in Medical Reasoning
di: Wu, Lingyan, et al.
Pubblicazione: (2026)
di: Wu, Lingyan, et al.
Pubblicazione: (2026)
MedGRPO: Multi-Task Reinforcement Learning for Heterogeneous Medical Video Understanding
di: Su, Yuhao, et al.
Pubblicazione: (2025)
di: Su, Yuhao, et al.
Pubblicazione: (2025)
MedPEFT-CL: Dual-Phase Parameter-Efficient Continual Learning with Medical Semantic Adapter and Bidirectional Memory Consolidation
di: Gao, Ziyuan
Pubblicazione: (2025)
di: Gao, Ziyuan
Pubblicazione: (2025)
One-to-Normal: Anomaly Personalization for Few-shot Anomaly Detection
di: Li, Yiyue, et al.
Pubblicazione: (2025)
di: Li, Yiyue, et al.
Pubblicazione: (2025)
Curriculum Learning for Efficient Chain-of-Thought Distillation via Structure-Aware Masking and GRPO
di: Yu, Bowen, et al.
Pubblicazione: (2026)
di: Yu, Bowen, et al.
Pubblicazione: (2026)
LaF-GRPO: In-Situ Navigation Instruction Generation for the Visually Impaired via GRPO with LLM-as-Follower Reward
di: Zhao, Yi, et al.
Pubblicazione: (2025)
di: Zhao, Yi, et al.
Pubblicazione: (2025)
Evaluating Hallucination in Text-to-Image Diffusion Models with Scene-Graph based Question-Answering Agent
di: Qin, Ziyuan, et al.
Pubblicazione: (2024)
di: Qin, Ziyuan, et al.
Pubblicazione: (2024)
MedGround-R1: Advancing Medical Image Grounding via Spatial-Semantic Rewarded Group Relative Policy Optimization
di: Xu, Huihui, et al.
Pubblicazione: (2025)
di: Xu, Huihui, et al.
Pubblicazione: (2025)
GanitLLM: Difficulty-Aware Bengali Mathematical Reasoning through Curriculum-GRPO
di: Dipta, Shubhashis Roy, et al.
Pubblicazione: (2026)
di: Dipta, Shubhashis Roy, et al.
Pubblicazione: (2026)
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
di: Ding, Meidan, et al.
Pubblicazione: (2025)
di: Ding, Meidan, et al.
Pubblicazione: (2025)
Data Uncertainty-Aware Learning for Multimodal Aspect-based Sentiment Analysis
di: Yang, Hao, et al.
Pubblicazione: (2024)
di: Yang, Hao, et al.
Pubblicazione: (2024)
Development and External Validation of an Efficient Deep Learning Model for Lesion Segmentation and Subtyping of Hepatic Echinococcosis in Ultrasound Imaging
di: Zhu He, et al.
Pubblicazione: (2026)
di: Zhu He, et al.
Pubblicazione: (2026)
QoQ-Med: Building Multimodal Clinical Foundation Models with Domain-Aware GRPO Training
di: Dai, Wei, et al.
Pubblicazione: (2025)
di: Dai, Wei, et al.
Pubblicazione: (2025)
MedGround: Bridging the Evidence Gap in Medical Vision-Language Models with Verified Grounding Data
di: Zhang, Mengmeng, et al.
Pubblicazione: (2026)
di: Zhang, Mengmeng, et al.
Pubblicazione: (2026)
DiverseGRPO: Mitigating Mode Collapse in Image Generation via Diversity-Aware GRPO
di: Liu, Henglin, et al.
Pubblicazione: (2025)
di: Liu, Henglin, et al.
Pubblicazione: (2025)
DanceGRPO: Unleashing GRPO on Visual Generation
di: Xue, Zeyue, et al.
Pubblicazione: (2025)
di: Xue, Zeyue, et al.
Pubblicazione: (2025)
MedSG-Bench: A Benchmark for Medical Image Sequences Grounding
di: Yue, Jingkun, et al.
Pubblicazione: (2025)
di: Yue, Jingkun, et al.
Pubblicazione: (2025)
Hear the Heartbeat in Phases: Physiologically Grounded Phase-Aware ECG Biometrics
di: Huang, Jintao, et al.
Pubblicazione: (2026)
di: Huang, Jintao, et al.
Pubblicazione: (2026)
MedLA: A Logic-Driven Multi-Agent Framework for Complex Medical Reasoning with Large Language Models
di: Ma, Siqi, et al.
Pubblicazione: (2025)
di: Ma, Siqi, et al.
Pubblicazione: (2025)
MultiLoc: Multi-view Guided Relative Pose Regression for Fast and Robust Visual Re-Localization
di: Dang, Nobel, et al.
Pubblicazione: (2026)
di: Dang, Nobel, et al.
Pubblicazione: (2026)
CURE-Med: Curriculum-Informed Reinforcement Learning for Multilingual Medical Reasoning
di: Onyame, Eric, et al.
Pubblicazione: (2026)
di: Onyame, Eric, et al.
Pubblicazione: (2026)
GRPO is Secretly a Process Reward Model
di: Sullivan, Michael, et al.
Pubblicazione: (2025)
di: Sullivan, Michael, et al.
Pubblicazione: (2025)
TV-SAM: Increasing Zero-Shot Segmentation Performance on Multimodal Medical Images Using GPT-4 Generated Descriptive Prompts Without Human Annotation
di: Jiang, Zekun, et al.
Pubblicazione: (2024)
di: Jiang, Zekun, et al.
Pubblicazione: (2024)
Rethinking Reward Signals in Video GRPO: When Scores Become Targets
di: Li, Rui, et al.
Pubblicazione: (2025)
di: Li, Rui, et al.
Pubblicazione: (2025)
Pref-GRPO: Pairwise Preference Reward-based GRPO for Stable Text-to-Image Reinforcement Learning
di: Wang, Yibin, et al.
Pubblicazione: (2025)
di: Wang, Yibin, et al.
Pubblicazione: (2025)
Stabilized Fine-Tuning with LoRA in Federated Learning: Mitigating the Side Effect of Client Size and Rank via the Scaling Factor
di: Huang, Jiayu, et al.
Pubblicazione: (2026)
di: Huang, Jiayu, et al.
Pubblicazione: (2026)
GRPO-TTA: Test-Time Visual Tuning for Vision-Language Models via GRPO-Driven Reinforcement Learning
di: Li, Yujun, et al.
Pubblicazione: (2026)
di: Li, Yujun, et al.
Pubblicazione: (2026)
GeoViS: Geospatially Rewarded Visual Search for Remote Sensing Visual Grounding
di: Zhang, Peirong, et al.
Pubblicazione: (2025)
di: Zhang, Peirong, et al.
Pubblicazione: (2025)
SemLoc: Structured Grounding of Free-Form LLM Reasoning for Fault Localization
di: Yang, Zhaorui, et al.
Pubblicazione: (2026)
di: Yang, Zhaorui, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Improving Medical Visual Reinforcement Fine-Tuning via Perception and Reasoning Augmentation
di: Yang, Guangjing, et al.
Pubblicazione: (2026) -
Guiding Medical Vision-Language Models with Explicit Visual Prompts: Framework Design and Comprehensive Exploration of Prompt Variations
di: Zhu, Kangyu, et al.
Pubblicazione: (2025) -
Curriculum Prompting Foundation Models for Medical Image Segmentation
di: Zheng, Xiuqi, et al.
Pubblicazione: (2024) -
MLAE: Masked LoRA Experts for Visual Parameter-Efficient Fine-Tuning
di: Wang, Junjie, et al.
Pubblicazione: (2024) -
Scheduled trips for various bus types
di: Zhou, Guangjing
Pubblicazione: (2025)