O1 Replication Journey -- Part 3: Inference-time Scaling for Medical Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Zhongzhen, Geng, Gui, Hua, Shengyi, Huang, Zhen, Zou, Haoyang, Zhang, Shaoting, Liu, Pengfei, Zhang, Xiaofan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Elicit and Enhance: Advancing Multimodal Reasoning in Medical Scenarios
di: Huang, Zhongzhen, et al.
Pubblicazione: (2025)
di: Huang, Zhongzhen, et al.
Pubblicazione: (2025)
O1 Replication Journey: A Strategic Progress Report -- Part 1
di: Qin, Yiwei, et al.
Pubblicazione: (2024)
di: Qin, Yiwei, et al.
Pubblicazione: (2024)
O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?
di: Huang, Zhen, et al.
Pubblicazione: (2024)
di: Huang, Zhen, et al.
Pubblicazione: (2024)
DiagnosisArena: Benchmarking Diagnostic Reasoning for Large Language Models
di: Zhu, Yakun, et al.
Pubblicazione: (2025)
di: Zhu, Yakun, et al.
Pubblicazione: (2025)
CURE: A Multimodal Benchmark for Clinical Understanding and Retrieval Evaluation
di: Gu, Yannian, et al.
Pubblicazione: (2026)
di: Gu, Yannian, et al.
Pubblicazione: (2026)
Tool Calling: Enhancing Medication Consultation via Retrieval-Augmented Large Language Models
di: Huang, Zhongzhen, et al.
Pubblicazione: (2024)
di: Huang, Zhongzhen, et al.
Pubblicazione: (2024)
MedCEG: Reinforcing Verifiable Medical Reasoning with Critical Evidence Graph
di: Mu, Linjie, et al.
Pubblicazione: (2025)
di: Mu, Linjie, et al.
Pubblicazione: (2025)
Modality-Aware and Shift Mixer for Multi-modal Brain Tumor Segmentation
di: Huang, Zhongzhen, et al.
Pubblicazione: (2024)
di: Huang, Zhongzhen, et al.
Pubblicazione: (2024)
MedMCP-Calc: Benchmarking LLMs for Realistic Medical Calculator Scenarios via MCP Integration
di: Zhu, Yakun, et al.
Pubblicazione: (2026)
di: Zhu, Yakun, et al.
Pubblicazione: (2026)
Surgical Action Planning with Large Language Models
di: Xu, Mengya, et al.
Pubblicazione: (2025)
di: Xu, Mengya, et al.
Pubblicazione: (2025)
EHRWorld: A Patient-Centric Medical World Model for Long-Horizon Clinical Trajectories
di: Mu, Linjie, et al.
Pubblicazione: (2026)
di: Mu, Linjie, et al.
Pubblicazione: (2026)
DeReStainer: H&E to IHC Pathological Image Translation via Decoupled Staining Channels
di: Wei, Linda, et al.
Pubblicazione: (2024)
di: Wei, Linda, et al.
Pubblicazione: (2024)
ZePT: Zero-Shot Pan-Tumor Segmentation via Query-Disentangling and Self-Prompting
di: Jiang, Yankai, et al.
Pubblicazione: (2023)
di: Jiang, Yankai, et al.
Pubblicazione: (2023)
CAT: Coordinating Anatomical-Textual Prompts for Multi-Organ and Tumor Segmentation
di: Huang, Zhongzhen, et al.
Pubblicazione: (2024)
di: Huang, Zhongzhen, et al.
Pubblicazione: (2024)
Human-AI Co-reasoning for Clinical Diagnosis with Evidence-Integrated Language Agent
di: Huang, Zhongzhen, et al.
Pubblicazione: (2026)
di: Huang, Zhongzhen, et al.
Pubblicazione: (2026)
Radiologist Copilot: An Agentic Framework Orchestrating Specialized Tools for Reliable Radiology Reporting
di: Yu, Yongrui, et al.
Pubblicazione: (2025)
di: Yu, Yongrui, et al.
Pubblicazione: (2025)
ToRL: Scaling Tool-Integrated RL
di: Li, Xuefeng, et al.
Pubblicazione: (2025)
di: Li, Xuefeng, et al.
Pubblicazione: (2025)
MedOdyssey: A Medical Domain Benchmark for Long Context Evaluation Up to 200K Tokens
di: Fan, Yongqi, et al.
Pubblicazione: (2024)
di: Fan, Yongqi, et al.
Pubblicazione: (2024)
MeNTi: Bridging Medical Calculator and LLM Agent with Nested Tool Calling
di: Zhu, Yakun, et al.
Pubblicazione: (2024)
di: Zhu, Yakun, et al.
Pubblicazione: (2024)
LIMR: Less is More for RL Scaling
di: Li, Xuefeng, et al.
Pubblicazione: (2025)
di: Li, Xuefeng, et al.
Pubblicazione: (2025)
SAP-Bench: Benchmarking Multimodal Large Language Models in Surgical Action Planning
di: Xu, Mengya, et al.
Pubblicazione: (2025)
di: Xu, Mengya, et al.
Pubblicazione: (2025)
MMXU: A Multi-Modal and Multi-X-ray Understanding Dataset for Disease Progression
di: Mu, Linjie, et al.
Pubblicazione: (2025)
di: Mu, Linjie, et al.
Pubblicazione: (2025)
CT-Flow: Orchestrating CT Interpretation Workflow with Model Context Protocol Servers
di: Gu, Yannian, et al.
Pubblicazione: (2026)
di: Gu, Yannian, et al.
Pubblicazione: (2026)
UCAgents: Unidirectional Convergence for Visual Evidence Anchored Multi-Agent Medical Decision-Making
di: Feng, Qianhan, et al.
Pubblicazione: (2025)
di: Feng, Qianhan, et al.
Pubblicazione: (2025)
ReasoningGuard: Safeguarding Large Reasoning Models with Inference-time Safety Aha Moments
di: Wang, Yuquan, et al.
Pubblicazione: (2025)
di: Wang, Yuquan, et al.
Pubblicazione: (2025)
Towards Inference-time Scaling for Continuous Space Reasoning
di: Wang, Minghan, et al.
Pubblicazione: (2025)
di: Wang, Minghan, et al.
Pubblicazione: (2025)
CP-Env: Evaluating Large Language Models on Clinical Pathways in a Controllable Hospital Environment
di: Zhu, Yakun, et al.
Pubblicazione: (2025)
di: Zhu, Yakun, et al.
Pubblicazione: (2025)
QwenLong-L1: Towards Long-Context Large Reasoning Models with Reinforcement Learning
di: Wan, Fanqi, et al.
Pubblicazione: (2025)
di: Wan, Fanqi, et al.
Pubblicazione: (2025)
m1: Unleash the Potential of Test-Time Scaling for Medical Reasoning with Large Language Models
di: Huang, Xiaoke, et al.
Pubblicazione: (2025)
di: Huang, Xiaoke, et al.
Pubblicazione: (2025)
Detecting Knowledge Boundary of Vision Large Language Models by Sampling-Based Inference
di: Chen, Zhuo, et al.
Pubblicazione: (2025)
di: Chen, Zhuo, et al.
Pubblicazione: (2025)
MedBench: A Comprehensive, Standardized, and Reliable Benchmarking System for Evaluating Chinese Medical Large Language Models
di: Liu, Mianxin, et al.
Pubblicazione: (2024)
di: Liu, Mianxin, et al.
Pubblicazione: (2024)
Part I: Tricks or Traps? A Deep Dive into RL for LLM Reasoning
di: Liu, Zihe, et al.
Pubblicazione: (2025)
di: Liu, Zihe, et al.
Pubblicazione: (2025)
LIMO: Less is More for Reasoning
di: Ye, Yixin, et al.
Pubblicazione: (2025)
di: Ye, Yixin, et al.
Pubblicazione: (2025)
PathFound: An Agentic Multimodal Model Activating Evidence-seeking Pathological Diagnosis
di: Hua, Shengyi, et al.
Pubblicazione: (2025)
di: Hua, Shengyi, et al.
Pubblicazione: (2025)
Table-R1: Inference-Time Scaling for Table Reasoning
di: Yang, Zheyuan, et al.
Pubblicazione: (2025)
di: Yang, Zheyuan, et al.
Pubblicazione: (2025)
LAMMI-Pathology: A Tool-Centric Bottom-Up LVLM-Agent Framework for Molecularly Informed Medical Intelligence in Pathology
di: Su, Haoyang, et al.
Pubblicazione: (2026)
di: Su, Haoyang, et al.
Pubblicazione: (2026)
MedDiff-FM: A Diffusion-based Foundation Model for Versatile Medical Image Applications
di: Yu, Yongrui, et al.
Pubblicazione: (2024)
di: Yu, Yongrui, et al.
Pubblicazione: (2024)
LIMOPro: Reasoning Refinement for Efficient and Effective Test-time Scaling
di: Xiao, Yang, et al.
Pubblicazione: (2025)
di: Xiao, Yang, et al.
Pubblicazione: (2025)
T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling
di: Hou, Zhenyu, et al.
Pubblicazione: (2025)
di: Hou, Zhenyu, et al.
Pubblicazione: (2025)
OlympicArena: Benchmarking Multi-discipline Cognitive Reasoning for Superintelligent AI
di: Huang, Zhen, et al.
Pubblicazione: (2024)
di: Huang, Zhen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Elicit and Enhance: Advancing Multimodal Reasoning in Medical Scenarios
di: Huang, Zhongzhen, et al.
Pubblicazione: (2025) -
O1 Replication Journey: A Strategic Progress Report -- Part 1
di: Qin, Yiwei, et al.
Pubblicazione: (2024) -
O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?
di: Huang, Zhen, et al.
Pubblicazione: (2024) -
DiagnosisArena: Benchmarking Diagnostic Reasoning for Large Language Models
di: Zhu, Yakun, et al.
Pubblicazione: (2025) -
CURE: A Multimodal Benchmark for Clinical Understanding and Retrieval Evaluation
di: Gu, Yannian, et al.
Pubblicazione: (2026)