Scaling Medical Reasoning Verification via Tool-Integrated Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Hang, Wang, Ruheng, Ji, Yuelyu, Kwak, Mingu, Wu, Xizhi, Li, Chenyu, Zhang, Li, Shi, Wenqi, Peng, Yifan, Wang, Yanshan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MedRAGChecker: Claim-Level Verification for Biomedical Retrieval-Augmented Generation
di: Ji, Yuelyu, et al.
Pubblicazione: (2026)
di: Ji, Yuelyu, et al.
Pubblicazione: (2026)
What Makes a Medical Checker Trainable? Diagnosing Signal Collapse and Reward Hacking in Checker-Guided RAG for Biomedical QA
di: Ji, Yuelyu, et al.
Pubblicazione: (2026)
di: Ji, Yuelyu, et al.
Pubblicazione: (2026)
Bias Evaluation and Mitigation in Retrieval-Augmented Medical Question-Answering Systems
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)
Generative Foundation Model for Structured and Unstructured Electronic Health Records
di: Sivarajkumar, Sonish, et al.
Pubblicazione: (2025)
di: Sivarajkumar, Sonish, et al.
Pubblicazione: (2025)
DeepRAG: Integrating Hierarchical Reasoning and Process Supervision for Biomedical Multi-Hop QA
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)
Assertion Detection Large Language Model In-context Learning LoRA Fine-tuning
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
Orchestrator Multi-Agent Clinical Decision Support System for Secondary Headache Diagnosis in Primary Care
di: Wu, Xizhi, et al.
Pubblicazione: (2025)
di: Wu, Xizhi, et al.
Pubblicazione: (2025)
Mitigating the Risk of Health Inequity Exacerbated by Large Language Models
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
A Scoping Review of LLM-as-a-Judge in Healthcare and the MedJUDGE Framework
di: Li, Chenyu, et al.
Pubblicazione: (2026)
di: Li, Chenyu, et al.
Pubblicazione: (2026)
Automated Extraction of Fluoropyrimidine Treatment and Treatment-Related Toxicities from Clinical Notes Using Natural Language Processing
di: Wu, Xizhi, et al.
Pubblicazione: (2025)
di: Wu, Xizhi, et al.
Pubblicazione: (2025)
Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs
di: Lu, Meng, et al.
Pubblicazione: (2025)
di: Lu, Meng, et al.
Pubblicazione: (2025)
AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning
di: Wei, Yifan, et al.
Pubblicazione: (2025)
di: Wei, Yifan, et al.
Pubblicazione: (2025)
ReasoningRank: Teaching Student Models to Rank through Reasoning-Based Knowledge Distillation
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
MEDVISTAGYM: A Scalable Training Environment for Thinking with Medical Images via Tool-Integrated Reinforcement Learning
di: Lu, Meng, et al.
Pubblicazione: (2026)
di: Lu, Meng, et al.
Pubblicazione: (2026)
RAG-RLRC-LaySum at BioLaySumm: Integrating Retrieval-Augmented Generation and Readability Control for Layman Summarization of Biomedical Texts
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning
di: Wang, Jianing, et al.
Pubblicazione: (2026)
di: Wang, Jianing, et al.
Pubblicazione: (2026)
Towards Safe AI Clinicians: A Comprehensive Study on Large Language Model Jailbreaking in Healthcare
di: Zhang, Hang, et al.
Pubblicazione: (2025)
di: Zhang, Hang, et al.
Pubblicazione: (2025)
Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)
Learning from Committee: Reasoning Distillation from a Mixture of Teachers with Peer-Review
di: Li, Zhuochun, et al.
Pubblicazione: (2024)
di: Li, Zhuochun, et al.
Pubblicazione: (2024)
Retrieval--Reasoning Processes for Multi-hop Question Answering: A Four-Axis Design Framework and Empirical Trends
di: Ji, Yuelyu, et al.
Pubblicazione: (2026)
di: Ji, Yuelyu, et al.
Pubblicazione: (2026)
DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning
di: He, Yang, et al.
Pubblicazione: (2026)
di: He, Yang, et al.
Pubblicazione: (2026)
PepThink-R1: LLM for Interpretable Cyclic Peptide Optimization with CoT SFT and Reinforcement Learning
di: Wang, Ruheng, et al.
Pubblicazione: (2025)
di: Wang, Ruheng, et al.
Pubblicazione: (2025)
When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning
di: Xu, Ruotao, et al.
Pubblicazione: (2026)
di: Xu, Ruotao, et al.
Pubblicazione: (2026)
VisReason: A Large-Scale Dataset for Visual Chain-of-Thought Reasoning
di: Li, Lingxiao, et al.
Pubblicazione: (2025)
di: Li, Lingxiao, et al.
Pubblicazione: (2025)
Effect of Mind Mapping Combined With Behavior Rating Scale on Medical Compliance Behavior of Atrial Fibrillation Patients Underwent Radiofrequency Ablation
di: Huan Xu, et al.
Pubblicazione: (2025)
di: Huan Xu, et al.
Pubblicazione: (2025)
Discovery and Reinforcement of Tool-Integrated Reasoning Chains via Rollout Trees
di: Li, Kun, et al.
Pubblicazione: (2026)
di: Li, Kun, et al.
Pubblicazione: (2026)
StepGap: A Hybrid NLI-LLM Checker for Step-Level Evidence-Gap Detectionin Multi-Hop Question Answering
di: Ji, Yuelyu, et al.
Pubblicazione: (2026)
di: Ji, Yuelyu, et al.
Pubblicazione: (2026)
CharTool: Tool-Integrated Visual Reasoning for Chart Understanding
di: Zhang, Situo, et al.
Pubblicazione: (2026)
di: Zhang, Situo, et al.
Pubblicazione: (2026)
Tool Verification for Test-Time Reinforcement Learning
di: Liao, Ruotong, et al.
Pubblicazione: (2026)
di: Liao, Ruotong, et al.
Pubblicazione: (2026)
Reason2Attack: Jailbreaking Text-to-Image Models via LLM Reasoning
di: Zhang, Chenyu, et al.
Pubblicazione: (2025)
di: Zhang, Chenyu, et al.
Pubblicazione: (2025)
Implicit Hierarchical GRPO: Decoupling Tool Invocation from Execution for Tool-Integrated Mathematical Reasoning
di: Wang, Li, et al.
Pubblicazione: (2026)
di: Wang, Li, et al.
Pubblicazione: (2026)
WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
MedAdapter: Efficient Test-Time Adaptation of Large Language Models towards Medical Reasoning
di: Shi, Wenqi, et al.
Pubblicazione: (2024)
di: Shi, Wenqi, et al.
Pubblicazione: (2024)
Enhancing Large Language Models for Clinical Decision Support by Incorporating Clinical Practice Guidelines
di: Oniani, David, et al.
Pubblicazione: (2024)
di: Oniani, David, et al.
Pubblicazione: (2024)
Tool-Augmented Policy Optimization: Synergizing Reasoning and Adaptive Tool Use with Reinforcement Learning
di: Wu, Wenxun, et al.
Pubblicazione: (2025)
di: Wu, Wenxun, et al.
Pubblicazione: (2025)
SDoH-GPT: Using Large Language Models to Extract Social Determinants of Health (SDoH)
di: Consoli, Bernardo, et al.
Pubblicazione: (2024)
di: Consoli, Bernardo, et al.
Pubblicazione: (2024)
CamReasoner: Reinforcing Camera Movement Understanding via Structured Spatial Reasoning
di: Wu, Hang, et al.
Pubblicazione: (2026)
di: Wu, Hang, et al.
Pubblicazione: (2026)
Memory-Aware and Uncertainty-Guided Retrieval for Multi-Hop Question Answering
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)
CoVe: Training Interactive Tool-Use Agents via Constraint-Guided Verification
di: Chen, Jinpeng, et al.
Pubblicazione: (2026)
di: Chen, Jinpeng, et al.
Pubblicazione: (2026)
Agentic Reasoning and Tool Integration for LLMs via Reinforcement Learning
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MedRAGChecker: Claim-Level Verification for Biomedical Retrieval-Augmented Generation
di: Ji, Yuelyu, et al.
Pubblicazione: (2026) -
What Makes a Medical Checker Trainable? Diagnosing Signal Collapse and Reward Hacking in Checker-Guided RAG for Biomedical QA
di: Ji, Yuelyu, et al.
Pubblicazione: (2026) -
Bias Evaluation and Mitigation in Retrieval-Augmented Medical Question-Answering Systems
di: Ji, Yuelyu, et al.
Pubblicazione: (2025) -
Generative Foundation Model for Structured and Unstructured Electronic Health Records
di: Sivarajkumar, Sonish, et al.
Pubblicazione: (2025) -
DeepRAG: Integrating Hierarchical Reasoning and Process Supervision for Biomedical Multi-Hop QA
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)