Med-R$^3$: Enhancing Medical Retrieval-Augmented Reasoning of LLMs via Progressive Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Lu, Keer, Liang, Zheng, Li, Youquan, Tan, Jiejun, Wang, Xili, Pan, Da, Zhang, Shusen, Dong, Guosheng, Cui, Bin, Liu, Yunhuai, Zhang, Wentao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Med-R$^2$: Crafting Trustworthy LLM Physicians via Retrieval and Reasoning of Evidence-Based Medicine
di: Lu, Keer, et al.
Pubblicazione: (2025)
di: Lu, Keer, et al.
Pubblicazione: (2025)
PilotRL: Training Language Model Agents via Global Planning-Guided Progressive Reinforcement Learning
di: Lu, Keer, et al.
Pubblicazione: (2025)
di: Lu, Keer, et al.
Pubblicazione: (2025)
VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs
di: Lu, Keer, et al.
Pubblicazione: (2024)
di: Lu, Keer, et al.
Pubblicazione: (2024)
DataSculpt: Crafting Data Landscapes for Long-Context LLMs through Multi-Objective Partitioning
di: Lu, Keer, et al.
Pubblicazione: (2024)
di: Lu, Keer, et al.
Pubblicazione: (2024)
FB-Bench: A Fine-Grained Multi-Task Benchmark for Evaluating LLMs' Responsiveness to Human Feedback
di: Li, Youquan, et al.
Pubblicazione: (2024)
di: Li, Youquan, et al.
Pubblicazione: (2024)
MedFact-R1: Towards Factual Medical Reasoning via Pseudo-Label Augmentation
di: Li, Gengliang, et al.
Pubblicazione: (2025)
di: Li, Gengliang, et al.
Pubblicazione: (2025)
Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning
di: Wong, Zhen Hao, et al.
Pubblicazione: (2025)
di: Wong, Zhen Hao, et al.
Pubblicazione: (2025)
HiMed: Incentivizing Hindi Reasoning in Medical LLMs
di: Jiang, Dingfeng, et al.
Pubblicazione: (2026)
di: Jiang, Dingfeng, et al.
Pubblicazione: (2026)
MedCEG: Reinforcing Verifiable Medical Reasoning with Critical Evidence Graph
di: Mu, Linjie, et al.
Pubblicazione: (2025)
di: Mu, Linjie, et al.
Pubblicazione: (2025)
From Sufficiency to Reflection: Reinforcement-Guided Thinking Quality in Retrieval-Augmented Reasoning for LLMs
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning
di: Chen, Mingyang, et al.
Pubblicazione: (2024)
di: Chen, Mingyang, et al.
Pubblicazione: (2024)
Data Proportion Detection for Optimized Data Management for Large Language Models
di: Liang, Hao, et al.
Pubblicazione: (2024)
di: Liang, Hao, et al.
Pubblicazione: (2024)
BAFNet: Bilateral Attention Fusion Network for Lightweight Semantic Segmentation of Urban Remote Sensing Images
di: Wang, Wentao, et al.
Pubblicazione: (2024)
di: Wang, Wentao, et al.
Pubblicazione: (2024)
Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
MemSifter: Offloading LLM Memory Retrieval via Outcome-Driven Proxy Reasoning
di: Tan, Jiejun, et al.
Pubblicazione: (2026)
di: Tan, Jiejun, et al.
Pubblicazione: (2026)
MedAD-R1: Eliciting Consistent Reasoning in Interpretible Medical Anomaly Detection via Consistency-Reinforced Policy Optimization
di: Zhang, Haitao, et al.
Pubblicazione: (2026)
di: Zhang, Haitao, et al.
Pubblicazione: (2026)
MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning
di: Pan, Jiazhen, et al.
Pubblicazione: (2025)
di: Pan, Jiazhen, et al.
Pubblicazione: (2025)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
di: Shao, Hao, et al.
Pubblicazione: (2025)
di: Shao, Hao, et al.
Pubblicazione: (2025)
MedTVT-R1: A Multimodal LLM Empowering Medical Reasoning and Diagnosis
di: Zhang, Yuting, et al.
Pubblicazione: (2025)
di: Zhang, Yuting, et al.
Pubblicazione: (2025)
M2IO-R1: An Efficient RL-Enhanced Reasoning Framework for Multimodal Retrieval Augmented Multimodal Generation
di: Xiao, Zhiyou, et al.
Pubblicazione: (2025)
di: Xiao, Zhiyou, et al.
Pubblicazione: (2025)
RARE: Retrieval-Augmented Reasoning Modeling
di: Wang, Zhengren, et al.
Pubblicazione: (2025)
di: Wang, Zhengren, et al.
Pubblicazione: (2025)
OctoMed: Data Recipes for State-of-the-Art Multimodal Medical Reasoning
di: Ossowski, Timothy, et al.
Pubblicazione: (2025)
di: Ossowski, Timothy, et al.
Pubblicazione: (2025)
MedREK: Retrieval-Based Editing for Medical LLMs with Key-Aware Prompts
di: Xia, Shujun, et al.
Pubblicazione: (2025)
di: Xia, Shujun, et al.
Pubblicazione: (2025)
MedReason: Eliciting Factual Medical Reasoning Steps in LLMs via Knowledge Graphs
di: Wu, Juncheng, et al.
Pubblicazione: (2025)
di: Wu, Juncheng, et al.
Pubblicazione: (2025)
CURE-Med: Curriculum-Informed Reinforcement Learning for Multilingual Medical Reasoning
di: Onyame, Eric, et al.
Pubblicazione: (2026)
di: Onyame, Eric, et al.
Pubblicazione: (2026)
R3-REC: Reasoning-Driven Recommendation via Retrieval-Augmented LLMs over Multi-Granular Interest Signals
di: Miao, Yuchen, et al.
Pubblicazione: (2026)
di: Miao, Yuchen, et al.
Pubblicazione: (2026)
Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models
di: Yang, Ling, et al.
Pubblicazione: (2024)
di: Yang, Ling, et al.
Pubblicazione: (2024)
MedForge: Interpretable Medical Deepfake Detection via Forgery-aware Reasoning
di: Chen, Zhihui, et al.
Pubblicazione: (2026)
di: Chen, Zhihui, et al.
Pubblicazione: (2026)
MedOrch: Medical Diagnosis with Tool-Augmented Reasoning Agents for Flexible Extensibility
di: He, Yexiao, et al.
Pubblicazione: (2025)
di: He, Yexiao, et al.
Pubblicazione: (2025)
MedTutor: A Retrieval-Augmented LLM System for Case-Based Medical Education
di: Jang, Dongsuk, et al.
Pubblicazione: (2026)
di: Jang, Dongsuk, et al.
Pubblicazione: (2026)
SafeMed-R1: Adversarial Reinforcement Learning for Generalizable and Robust Medical Reasoning in Vision-Language Models
di: Pramana, A. A. Gde Yogi, et al.
Pubblicazione: (2025)
di: Pramana, A. A. Gde Yogi, et al.
Pubblicazione: (2025)
Retrieval-Augmented Generation for AI-Generated Content: A Survey
di: Zhao, Penghao, et al.
Pubblicazione: (2024)
di: Zhao, Penghao, et al.
Pubblicazione: (2024)
Retrieval-Augmented Generation by Evidence Retroactivity in LLMs
di: Xiao, Liang, et al.
Pubblicazione: (2025)
di: Xiao, Liang, et al.
Pubblicazione: (2025)
Small Models, Big Insights: Leveraging Slim Proxy Models To Decide When and What to Retrieve for LLMs
di: Tan, Jiejun, et al.
Pubblicazione: (2024)
di: Tan, Jiejun, et al.
Pubblicazione: (2024)
Progressive Multimodal Reasoning via Active Retrieval
di: Dong, Guanting, et al.
Pubblicazione: (2024)
di: Dong, Guanting, et al.
Pubblicazione: (2024)
Zero-shot Graph Reasoning via Retrieval Augmented Framework with LLMs
di: Li, Hanqing, et al.
Pubblicazione: (2025)
di: Li, Hanqing, et al.
Pubblicazione: (2025)
Med-REFL: Medical Reasoning Enhancement via Self-Corrected Fine-grained Reflection
di: Yang, Zongxian, et al.
Pubblicazione: (2025)
di: Yang, Zongxian, et al.
Pubblicazione: (2025)
R2MED: A Benchmark for Reasoning-Driven Medical Retrieval
di: Zhang, Xiangxu, et al.
Pubblicazione: (2025)
di: Zhang, Xiangxu, et al.
Pubblicazione: (2025)
CRAB: A Benchmark for Evaluating Curation of Retrieval-Augmented LLMs in Biomedicine
di: Zhong, Hanmeng, et al.
Pubblicazione: (2025)
di: Zhong, Hanmeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Med-R$^2$: Crafting Trustworthy LLM Physicians via Retrieval and Reasoning of Evidence-Based Medicine
di: Lu, Keer, et al.
Pubblicazione: (2025) -
PilotRL: Training Language Model Agents via Global Planning-Guided Progressive Reinforcement Learning
di: Lu, Keer, et al.
Pubblicazione: (2025) -
VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs
di: Lu, Keer, et al.
Pubblicazione: (2024) -
DataSculpt: Crafting Data Landscapes for Long-Context LLMs through Multi-Objective Partitioning
di: Lu, Keer, et al.
Pubblicazione: (2024) -
FB-Bench: A Fine-Grained Multi-Task Benchmark for Evaluating LLMs' Responsiveness to Human Feedback
di: Li, Youquan, et al.
Pubblicazione: (2024)