Medical Reasoning with Large Language Models: A Survey and MR-Bench
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ren, Xiaohan, Fan, Chenxiao, Ma, Wenyin, He, Hongliang, Gao, Chongming, Zhao, Xiaoyan, Feng, Fuli |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Medical Reasoning With Large Language Models: A Systematic Review and Evaluation
par: Xiaohan Ren, et autres
Publié: (2026)
par: Xiaohan Ren, et autres
Publié: (2026)
Large Language Models are Learnable Planners for Long-Term Recommendation
par: Shi, Wentao, et autres
Publié: (2024)
par: Shi, Wentao, et autres
Publié: (2024)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
par: Xu, Fengli, et autres
Publié: (2025)
par: Xu, Fengli, et autres
Publié: (2025)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
par: Li, Yuangang, et autres
Publié: (2025)
par: Li, Yuangang, et autres
Publié: (2025)
Evaluating Mathematical Reasoning of Large Language Models: A Focus on Error Identification and Correction
par: Li, Xiaoyuan, et autres
Publié: (2024)
par: Li, Xiaoyuan, et autres
Publié: (2024)
MedCalc-Bench: Evaluating Large Language Models for Medical Calculations
par: Khandekar, Nikhil, et autres
Publié: (2024)
par: Khandekar, Nikhil, et autres
Publié: (2024)
FoundaBench: Evaluating Chinese Fundamental Knowledge Capabilities of Large Language Models
par: Li, Wei, et autres
Publié: (2024)
par: Li, Wei, et autres
Publié: (2024)
Implicit Reasoning in Large Language Models: A Comprehensive Survey
par: Li, Jindong, et autres
Publié: (2025)
par: Li, Jindong, et autres
Publié: (2025)
Towards More Accurate US Presidential Election via Multi-step Reasoning with Large Language Models
par: Yu, Chenxiao, et autres
Publié: (2024)
par: Yu, Chenxiao, et autres
Publié: (2024)
A Survey of Inductive Reasoning for Large Language Models
par: Chen, Kedi, et autres
Publié: (2025)
par: Chen, Kedi, et autres
Publié: (2025)
Characteristic AI Agents via Large Language Models
par: Wang, Xi, et autres
Publié: (2024)
par: Wang, Xi, et autres
Publié: (2024)
BrainBench: Exposing the Commonsense Reasoning Gap in Large Language Models
par: Tang, Yuzhe
Publié: (2026)
par: Tang, Yuzhe
Publié: (2026)
BiMark: Unbiased Multilayer Watermarking for Large Language Models
par: Feng, Xiaoyan, et autres
Publié: (2025)
par: Feng, Xiaoyan, et autres
Publié: (2025)
Disentangling Reasoning and Knowledge in Medical Large Language Models
par: Thapa, Rahul, et autres
Publié: (2025)
par: Thapa, Rahul, et autres
Publié: (2025)
From Reasoning to Learning: A Survey on Hypothesis Discovery and Rule Learning with Large Language Models
par: He, Kaiyu, et autres
Publié: (2025)
par: He, Kaiyu, et autres
Publié: (2025)
Efficient Reasoning Models: A Survey
par: Feng, Sicheng, et autres
Publié: (2025)
par: Feng, Sicheng, et autres
Publié: (2025)
Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models
par: Chen, Qiguang, et autres
Publié: (2025)
par: Chen, Qiguang, et autres
Publié: (2025)
A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models
par: Wang, Yanbo, et autres
Publié: (2025)
par: Wang, Yanbo, et autres
Publié: (2025)
A Survey on Large Language Models for Mathematical Reasoning
par: Wang, Peng-Yuan, et autres
Publié: (2025)
par: Wang, Peng-Yuan, et autres
Publié: (2025)
Logical Reasoning in Large Language Models: A Survey
par: Liu, Hanmeng, et autres
Publié: (2025)
par: Liu, Hanmeng, et autres
Publié: (2025)
MedAgents: Large Language Models as Collaborators for Zero-shot Medical Reasoning
par: Tang, Xiangru, et autres
Publié: (2023)
par: Tang, Xiangru, et autres
Publié: (2023)
EssayBench: Evaluating Large Language Models in Multi-Genre Chinese Essay Writing
par: Gao, Fan, et autres
Publié: (2025)
par: Gao, Fan, et autres
Publié: (2025)
TAT-LLM: A Specialized Language Model for Discrete Reasoning over Tabular and Textual Data
par: Zhu, Fengbin, et autres
Publié: (2024)
par: Zhu, Fengbin, et autres
Publié: (2024)
GIVE: Structured Reasoning of Large Language Models with Knowledge Graph Inspired Veracity Extrapolation
par: He, Jiashu, et autres
Publié: (2024)
par: He, Jiashu, et autres
Publié: (2024)
Robust Prompt Optimization for Large Language Models Against Distribution Shifts
par: Li, Moxin, et autres
Publié: (2023)
par: Li, Moxin, et autres
Publié: (2023)
Multilingual Medical Reasoning for Question Answering with Large Language Models
par: Ferrazzi, Pietro, et autres
Publié: (2025)
par: Ferrazzi, Pietro, et autres
Publié: (2025)
Efficient Fine-Tuning of Large Language Models for Automated Medical Documentation
par: Leong, Hui Yi, et autres
Publié: (2024)
par: Leong, Hui Yi, et autres
Publié: (2024)
Tracing Moral Foundations in Large Language Models
par: Yu, Chenxiao, et autres
Publié: (2026)
par: Yu, Chenxiao, et autres
Publié: (2026)
MedAgentsBench: Benchmarking Thinking Models and Agent Frameworks for Complex Medical Reasoning
par: Tang, Xiangru, et autres
Publié: (2025)
par: Tang, Xiangru, et autres
Publié: (2025)
EMRModel: A Large Language Model for Extracting Medical Consultation Dialogues into Structured Medical Records
par: Zhao, Shuguang, et autres
Publié: (2025)
par: Zhao, Shuguang, et autres
Publié: (2025)
TaskBench: Benchmarking Large Language Models for Task Automation
par: Shen, Yongliang, et autres
Publié: (2023)
par: Shen, Yongliang, et autres
Publié: (2023)
Harnessing the Reasoning Economy: A Survey of Efficient Reasoning for Large Language Models
par: Wang, Rui, et autres
Publié: (2025)
par: Wang, Rui, et autres
Publié: (2025)
Reasoning in Action: MCTS-Driven Knowledge Retrieval for Large Language Models
par: Liu, Shuqi, et autres
Publié: (2025)
par: Liu, Shuqi, et autres
Publié: (2025)
MedHallBench: A New Benchmark for Assessing Hallucination in Medical Large Language Models
par: Zuo, Kaiwen, et autres
Publié: (2024)
par: Zuo, Kaiwen, et autres
Publié: (2024)
LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models
par: Parmar, Mihir, et autres
Publié: (2024)
par: Parmar, Mihir, et autres
Publié: (2024)
VLegal-Bench: Cognitively Grounded Benchmark for Vietnamese Legal Reasoning of Large Language Models
par: Dong, Nguyen Tien, et autres
Publié: (2025)
par: Dong, Nguyen Tien, et autres
Publié: (2025)
TimeBench: A Comprehensive Evaluation of Temporal Reasoning Abilities in Large Language Models
par: Chu, Zheng, et autres
Publié: (2023)
par: Chu, Zheng, et autres
Publié: (2023)
Reviewing Clinical Knowledge in Medical Large Language Models: Training and Beyond
par: Li, Qiyuan, et autres
Publié: (2025)
par: Li, Qiyuan, et autres
Publié: (2025)
Causal Inference with Large Language Model: A Survey
par: Ma, Jing
Publié: (2024)
par: Ma, Jing
Publié: (2024)
HintMR: Eliciting Stronger Mathematical Reasoning in Small Language Models
par: Hossain, Jawad, et autres
Publié: (2026)
par: Hossain, Jawad, et autres
Publié: (2026)
Documents similaires
-
Medical Reasoning With Large Language Models: A Systematic Review and Evaluation
par: Xiaohan Ren, et autres
Publié: (2026) -
Large Language Models are Learnable Planners for Long-Term Recommendation
par: Shi, Wentao, et autres
Publié: (2024) -
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
par: Xu, Fengli, et autres
Publié: (2025) -
Mitigating Hallucinations in Large Language Models via Causal Reasoning
par: Li, Yuangang, et autres
Publié: (2025) -
Evaluating Mathematical Reasoning of Large Language Models: A Focus on Error Identification and Correction
par: Li, Xiaoyuan, et autres
Publié: (2024)