TCM-5CEval: Extended Deep Evaluation Benchmark for LLM's Comprehensive Clinical Research Competence in Traditional Chinese Medicine
Fuente:
arXiv
Saved in:
| Main Authors: | Huang, Tianai, Chen, Jiayuan, Lu, Lu, Chen, Pengcheng, Li, Tianbin, Han, Bing, Tang, Wenchao, Xu, Jie, Li, Ming |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
TCM-3CEval: A Triaxial Benchmark for Assessing Responses from Large Language Models in Traditional Chinese Medicine
by: Huang, Tianai, et al.
Published: (2025)
by: Huang, Tianai, et al.
Published: (2025)
TCM-Eval: An Expert-Level Dynamic and Extensible Benchmark for Traditional Chinese Medicine
by: Cheng, Zihao, et al.
Published: (2025)
by: Cheng, Zihao, et al.
Published: (2025)
TCM-Ladder: A Benchmark for Multimodal Question Answering on Traditional Chinese Medicine
by: Xie, Jiacheng, et al.
Published: (2025)
by: Xie, Jiacheng, et al.
Published: (2025)
GUI-CEval: A Hierarchical and Comprehensive Chinese Benchmark for Mobile GUI Agents
by: Li, Yang, et al.
Published: (2026)
by: Li, Yang, et al.
Published: (2026)
An Integrated Strategy for Comprehensive Characterization of Traditional Chinese Medicine (TCM) Formulas: A Case Study of Gegen‐Qinlian Decoction
by: Zhitian Peng, et al.
Published: (2025)
by: Zhitian Peng, et al.
Published: (2025)
OpenTCM: A GraphRAG-Empowered LLM-based System for Traditional Chinese Medicine Knowledge Retrieval and Diagnosis
by: He, Jinglin, et al.
Published: (2025)
by: He, Jinglin, et al.
Published: (2025)
TCMBench: A Comprehensive Benchmark for Evaluating Large Language Models in Traditional Chinese Medicine
by: Yue, Wenjing, et al.
Published: (2024)
by: Yue, Wenjing, et al.
Published: (2024)
TCMD: A Traditional Chinese Medicine QA Dataset for Evaluating Large Language Models
by: Yu, Ping, et al.
Published: (2024)
by: Yu, Ping, et al.
Published: (2024)
TCM-DiffRAG: Personalized Syndrome Differentiation Reasoning Method for Traditional Chinese Medicine based on Knowledge Graph and Chain of Thought
by: Li, Jianmin, et al.
Published: (2026)
by: Li, Jianmin, et al.
Published: (2026)
CEval: A Benchmark for Evaluating Counterfactual Text Generation
by: Nguyen, Van Bach, et al.
Published: (2024)
by: Nguyen, Van Bach, et al.
Published: (2024)
Can Large Language Models Function as Qualified Pediatricians? A Systematic Evaluation in Real-World Clinical Contexts
by: Zhu, Siyu, et al.
Published: (2025)
by: Zhu, Siyu, et al.
Published: (2025)
Clinical Application Guideline of Combination With Traditional Chinese Medicine and Western Medicine in the Prevention and Treatment of Chronic Obstructive Pulmonary Disease (2024)
by: Di Wu, et al.
Published: (2025)
by: Di Wu, et al.
Published: (2025)
Traditional Chinese Medicine in the Treatment of Infertility: A Comprehensive Review
by: Yiman Chen, et al.
Published: (2026)
by: Yiman Chen, et al.
Published: (2026)
Production Safety Supervision Evaluation of Traditional Chinese Medicine: A Fuzzy‐ANP Comprehensive Evaluation Method
by: Wenyi Wang, et al.
Published: (2025)
by: Wenyi Wang, et al.
Published: (2025)
Exploring the Comprehension of ChatGPT in Traditional Chinese Medicine Knowledge
by: Yizhen, Li, et al.
Published: (2024)
by: Yizhen, Li, et al.
Published: (2024)
Tianyi: A Traditional Chinese Medicine all-rounder language model and its Real-World Clinical Practice
by: Liu, Zhi, et al.
Published: (2025)
by: Liu, Zhi, et al.
Published: (2025)
OmniMedVQA: A New Large-Scale Comprehensive Evaluation Benchmark for Medical LVLM
by: Hu, Yutao, et al.
Published: (2024)
by: Hu, Yutao, et al.
Published: (2024)
Human-Level and Beyond: Benchmarking Large Language Models Against Clinical Pharmacists in Prescription Review
by: Yang, Yan, et al.
Published: (2025)
by: Yang, Yan, et al.
Published: (2025)
Safety and Toxicity of Qi‐Fu Yin, a Classical Traditional Chinese Medicine Prescription: A Nonclinical Research
by: Kai Chen, et al.
Published: (2025)
by: Kai Chen, et al.
Published: (2025)
Evaluating Clinical Competencies of Large Language Models with a General Practice Benchmark
by: Li, Zheqing, et al.
Published: (2025)
by: Li, Zheqing, et al.
Published: (2025)
Building a Human-Verified Clinical Reasoning Dataset via a Human LLM Hybrid Pipeline for Trustworthy Medical AI
by: Ding, Chao, et al.
Published: (2025)
by: Ding, Chao, et al.
Published: (2025)
Traditional Chinese Medicine Properties and Microcalorimetry: BioScience Evaluation
by: Qiang Li, et al.
Published: (2025)
by: Qiang Li, et al.
Published: (2025)
Resource Analysis and Classification Utilization in Traditional Chinese Medicine Solid Residues
by: Ying‐lei Lu, et al.
Published: (2025)
by: Ying‐lei Lu, et al.
Published: (2025)
MiCEval: Unveiling Multimodal Chain of Thought's Quality via Image Description and Reasoning Steps
by: Zhou, Xiongtao, et al.
Published: (2024)
by: Zhou, Xiongtao, et al.
Published: (2024)
LingLanMiDian: Systematic Evaluation of LLMs on TCM Knowledge and Clinical Reasoning
by: Hua, Rui, et al.
Published: (2026)
by: Hua, Rui, et al.
Published: (2026)
Benchmarking Chinese Medical LLMs: A Medbench-based Analysis of Performance Gaps and Hierarchical Optimization Strategies
by: Jiang, Luyi, et al.
Published: (2025)
by: Jiang, Luyi, et al.
Published: (2025)
MTCMB: A Multi-Task Benchmark Framework for Evaluating LLMs on Knowledge, Reasoning, and Safety in Traditional Chinese Medicine
by: Kong, Shufeng, et al.
Published: (2025)
by: Kong, Shufeng, et al.
Published: (2025)
Application of Artificial Intelligence in the Development of Traditional Chinese Medicine
by: Xuebing He, et al.
Published: (2025)
by: Xuebing He, et al.
Published: (2025)
Evaluating the Ability of Large Language Models to Identify Adherence to CONSORT Reporting Guidelines in Randomized Controlled Trials: A Methodological Evaluation Study
by: He, Zhichao, et al.
Published: (2025)
by: He, Zhichao, et al.
Published: (2025)
Current advances in the pain treatment and mechanisms of Traditional Chinese Medicine
by: Xiaoli Zhu, et al.
Published: (2024)
by: Xiaoli Zhu, et al.
Published: (2024)
Evaluating Large‐Scale and Lightweight Large Language Models for Traditional Chinese Medicine Exam Questions: A Comparative Study
by: Yizhen Li, et al.
Published: (2026)
by: Yizhen Li, et al.
Published: (2026)
Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan
by: Yao, Jui-Ming, et al.
Published: (2025)
by: Yao, Jui-Ming, et al.
Published: (2025)
RETRACTION : Evaluating Traditional Chinese Medicine ( TCM ) Jie Geng and Huang Qi Combination on Reducing Surgical Site Infections in Colorectal Cancer Surgeries: A Systematic Review and Meta‐Analysis
Published: (2025)
Published: (2025)
Science of Traditional Chinese Medicine
Published: (2024)
Published: (2024)
Polymers Facilitating Therapeutic Efficacy and Applications for Traditional Chinese Medicine
by: Cong Li, et al.
Published: (2024)
by: Cong Li, et al.
Published: (2024)
Individual‐specific metabolic network based on 18F‐FDG PET revealing multi‐level aberrant metabolisms in Parkinson's disease
by: Weizhao Lu, et al.
Published: (2024)
by: Weizhao Lu, et al.
Published: (2024)
The Role of Traditional Chinese Medicine Health Management Model in Improving the Quality of Clinical Nursing Services
by: Desheng Li, et al.
Published: (2025)
by: Desheng Li, et al.
Published: (2025)
Advances in the Use of Traditional Chinese Medicine Prescriptions for Alzheimer's Disease
by: Jiachen Zhao, et al.
Published: (2026)
by: Jiachen Zhao, et al.
Published: (2026)
Traditional Chinese Medicine (TCM)‐Inspired Fully Printed Soft Pressure Sensor Array with Self‐Adaptive Pressurization for Highly Reliable Individualized Long‐Term Pulse Diagnostics
by: Xin Wang, et al.
Published: (2024)
by: Xin Wang, et al.
Published: (2024)
MedBench v4: A Robust and Scalable Benchmark for Evaluating Chinese Medical Language Models, Multimodal Models, and Intelligent Agents
by: Ding, Jinru, et al.
Published: (2025)
by: Ding, Jinru, et al.
Published: (2025)
Similar Items
-
TCM-3CEval: A Triaxial Benchmark for Assessing Responses from Large Language Models in Traditional Chinese Medicine
by: Huang, Tianai, et al.
Published: (2025) -
TCM-Eval: An Expert-Level Dynamic and Extensible Benchmark for Traditional Chinese Medicine
by: Cheng, Zihao, et al.
Published: (2025) -
TCM-Ladder: A Benchmark for Multimodal Question Answering on Traditional Chinese Medicine
by: Xie, Jiacheng, et al.
Published: (2025) -
GUI-CEval: A Hierarchical and Comprehensive Chinese Benchmark for Mobile GUI Agents
by: Li, Yang, et al.
Published: (2026) -
An Integrated Strategy for Comprehensive Characterization of Traditional Chinese Medicine (TCM) Formulas: A Case Study of Gegen‐Qinlian Decoction
by: Zhitian Peng, et al.
Published: (2025)