Gespeichert in:
| Hauptverfasser: | Yang, Xiao, Zhao, Xuejiao, Shen, Zhiqi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2511.08206 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
A Generalizable Anomaly Detection Method in Dynamic Graphs
von: Yang, Xiao, et al.
Veröffentlicht: (2024)
von: Yang, Xiao, et al.
Veröffentlicht: (2024)
Are Heterogeneous Graph Neural Networks Truly Effective? A Causal Perspective
von: Yang, Xiao, et al.
Veröffentlicht: (2025)
von: Yang, Xiao, et al.
Veröffentlicht: (2025)
MCP-SafetyBench: A Benchmark for Safety Evaluation of Large Language Models with Real-World MCP Servers
von: Zong, Xuanjun, et al.
Veröffentlicht: (2025)
von: Zong, Xuanjun, et al.
Veröffentlicht: (2025)
A Comprehensive Survey of Electronic Health Record Modeling: From Deep Learning Approaches to Large Language Models
von: Ren, Weijieying, et al.
Veröffentlicht: (2025)
von: Ren, Weijieying, et al.
Veröffentlicht: (2025)
Benchmarking Foundation Models with Multimodal Public Electronic Health Records
von: Yu, Kunyu, et al.
Veröffentlicht: (2025)
von: Yu, Kunyu, et al.
Veröffentlicht: (2025)
A Comprehensive Evaluation of Large Language Models on Benchmark Biomedical Text Processing Tasks
von: Jahan, Israt, et al.
Veröffentlicht: (2023)
von: Jahan, Israt, et al.
Veröffentlicht: (2023)
Large Language Models to Identify Social Determinants of Health in Electronic Health Records
von: Guevara, Marco, et al.
Veröffentlicht: (2023)
von: Guevara, Marco, et al.
Veröffentlicht: (2023)
Large Language Models are Powerful Electronic Health Record Encoders
von: Hegselmann, Stefan, et al.
Veröffentlicht: (2025)
von: Hegselmann, Stefan, et al.
Veröffentlicht: (2025)
CHiSafetyBench: A Chinese Hierarchical Safety Benchmark for Large Language Models
von: Zhang, Wenjing, et al.
Veröffentlicht: (2024)
von: Zhang, Wenjing, et al.
Veröffentlicht: (2024)
Improving Mortality Prediction After Radiotherapy with Large Language Model Structuring of Large-Scale Unstructured Electronic Health Records
von: Park, Sangjoon, et al.
Veröffentlicht: (2024)
von: Park, Sangjoon, et al.
Veröffentlicht: (2024)
Extracting OPQRST in Electronic Health Records using Large Language Models with Reasoning
von: Luo, Zhimeng, et al.
Veröffentlicht: (2025)
von: Luo, Zhimeng, et al.
Veröffentlicht: (2025)
EHRSQL: A Practical Text-to-SQL Benchmark for Electronic Health Records
von: Lee, Gyubok, et al.
Veröffentlicht: (2023)
von: Lee, Gyubok, et al.
Veröffentlicht: (2023)
Towards Goal-oriented Prompt Engineering for Large Language Models: A Survey
von: Li, Haochen, et al.
Veröffentlicht: (2024)
von: Li, Haochen, et al.
Veröffentlicht: (2024)
TrustMH-Bench: A Comprehensive Benchmark for Evaluating the Trustworthiness of Large Language Models in Mental Health
von: Xiong, Zixin, et al.
Veröffentlicht: (2026)
von: Xiong, Zixin, et al.
Veröffentlicht: (2026)
MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers
von: Luo, Ziyang, et al.
Veröffentlicht: (2025)
von: Luo, Ziyang, et al.
Veröffentlicht: (2025)
What is the best model? Application-driven Evaluation for Large Language Models
von: Lian, Shiguo, et al.
Veröffentlicht: (2024)
von: Lian, Shiguo, et al.
Veröffentlicht: (2024)
TReB: A Comprehensive Benchmark for Evaluating Table Reasoning Capabilities of Large Language Models
von: Li, Ce, et al.
Veröffentlicht: (2025)
von: Li, Ce, et al.
Veröffentlicht: (2025)
Generative Foundation Model for Structured and Unstructured Electronic Health Records
von: Sivarajkumar, Sonish, et al.
Veröffentlicht: (2025)
von: Sivarajkumar, Sonish, et al.
Veröffentlicht: (2025)
Integrating Large Language Models with Human Expertise for Disease Detection in Electronic Health Records
von: Pan, Jie, et al.
Veröffentlicht: (2025)
von: Pan, Jie, et al.
Veröffentlicht: (2025)
Autocompletion of Chief Complaints in the Electronic Health Records using Large Language Models
von: Islam, K M Sajjadul, et al.
Veröffentlicht: (2024)
von: Islam, K M Sajjadul, et al.
Veröffentlicht: (2024)
CEHR-XGPT: A Scalable Multi-Task Foundation Model for Electronic Health Records
von: Pang, Chao, et al.
Veröffentlicht: (2025)
von: Pang, Chao, et al.
Veröffentlicht: (2025)
TaskBench: Benchmarking Large Language Models for Task Automation
von: Shen, Yongliang, et al.
Veröffentlicht: (2023)
von: Shen, Yongliang, et al.
Veröffentlicht: (2023)
EHR-RAG: Bridging Long-Horizon Structured Electronic Health Records and Large Language Models via Enhanced Retrieval-Augmented Generation
von: Cao, Lang, et al.
Veröffentlicht: (2026)
von: Cao, Lang, et al.
Veröffentlicht: (2026)
Prompting Large Language Models for Zero-Shot Clinical Prediction with Structured Longitudinal Electronic Health Record Data
von: Zhu, Yinghao, et al.
Veröffentlicht: (2024)
von: Zhu, Yinghao, et al.
Veröffentlicht: (2024)
Evaluation of General Large Language Models in Contextually Assessing Semantic Concepts Extracted from Adult Critical Care Electronic Health Record Notes
von: Liu, Darren, et al.
Veröffentlicht: (2024)
von: Liu, Darren, et al.
Veröffentlicht: (2024)
REALM: RAG-Driven Enhancement of Multimodal Electronic Health Records Analysis via Large Language Models
von: Zhu, Yinghao, et al.
Veröffentlicht: (2024)
von: Zhu, Yinghao, et al.
Veröffentlicht: (2024)
UGPhysics: A Comprehensive Benchmark for Undergraduate Physics Reasoning with Large Language Models
von: Xu, Xin, et al.
Veröffentlicht: (2025)
von: Xu, Xin, et al.
Veröffentlicht: (2025)
Revolutionizing Database Q&A with Large Language Models: Comprehensive Benchmark and Evaluation
von: Zheng, Yihang, et al.
Veröffentlicht: (2024)
von: Zheng, Yihang, et al.
Veröffentlicht: (2024)
FeatEHR-LLM: Leveraging Large Language Models for Feature Engineering in Electronic Health Records
von: Karami, Hojjat, et al.
Veröffentlicht: (2026)
von: Karami, Hojjat, et al.
Veröffentlicht: (2026)
Recent Advances in Predictive Modeling with Electronic Health Records
von: Wang, Jiaqi, et al.
Veröffentlicht: (2024)
von: Wang, Jiaqi, et al.
Veröffentlicht: (2024)
COMET: Benchmark for Comprehensive Biological Multi-omics Evaluation Tasks and Language Models
von: Ren, Yuchen, et al.
Veröffentlicht: (2024)
von: Ren, Yuchen, et al.
Veröffentlicht: (2024)
EHRAgent: Code Empowers Large Language Models for Few-shot Complex Tabular Reasoning on Electronic Health Records
von: Shi, Wenqi, et al.
Veröffentlicht: (2024)
von: Shi, Wenqi, et al.
Veröffentlicht: (2024)
USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models
von: Zheng, Baolin, et al.
Veröffentlicht: (2025)
von: Zheng, Baolin, et al.
Veröffentlicht: (2025)
Cancer Diagnosis Categorization in Electronic Health Records Using Large Language Models and BioBERT: Model Performance Evaluation Study
von: Hashtarkhani, Soheil, et al.
Veröffentlicht: (2025)
von: Hashtarkhani, Soheil, et al.
Veröffentlicht: (2025)
OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
von: Xu, Hainiu, et al.
Veröffentlicht: (2024)
von: Xu, Hainiu, et al.
Veröffentlicht: (2024)
Large Language Models in the Clinic: A Comprehensive Benchmark
von: Liu, Fenglin, et al.
Veröffentlicht: (2024)
von: Liu, Fenglin, et al.
Veröffentlicht: (2024)
EchoBench: Benchmarking Sycophancy in Medical Large Vision-Language Models
von: Yuan, Botai, et al.
Veröffentlicht: (2025)
von: Yuan, Botai, et al.
Veröffentlicht: (2025)
EmotionQueen: A Benchmark for Evaluating Empathy of Large Language Models
von: Chen, Yuyan, et al.
Veröffentlicht: (2024)
von: Chen, Yuyan, et al.
Veröffentlicht: (2024)
Applying and Evaluating Large Language Models in Mental Health Care: A Scoping Review of Human-Assessed Generative Tasks
von: Hua, Yining, et al.
Veröffentlicht: (2024)
von: Hua, Yining, et al.
Veröffentlicht: (2024)
CEFW: A Comprehensive Evaluation Framework for Watermark in Large Language Models
von: Zhang, Shuhao, et al.
Veröffentlicht: (2025)
von: Zhang, Shuhao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
A Generalizable Anomaly Detection Method in Dynamic Graphs
von: Yang, Xiao, et al.
Veröffentlicht: (2024) -
Are Heterogeneous Graph Neural Networks Truly Effective? A Causal Perspective
von: Yang, Xiao, et al.
Veröffentlicht: (2025) -
MCP-SafetyBench: A Benchmark for Safety Evaluation of Large Language Models with Real-World MCP Servers
von: Zong, Xuanjun, et al.
Veröffentlicht: (2025) -
A Comprehensive Survey of Electronic Health Record Modeling: From Deep Learning Approaches to Large Language Models
von: Ren, Weijieying, et al.
Veröffentlicht: (2025) -
Benchmarking Foundation Models with Multimodal Public Electronic Health Records
von: Yu, Kunyu, et al.
Veröffentlicht: (2025)