Systematic Evaluation of Large Language Models for Post-Discharge Clinical Action Extraction
Fuente:
arXiv
Salvato in:
| Autori principali: | Dalmia, Shivali, Mantravadi, Ananya, Desikan, Prasanna |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Measuring What Matters: Benchmarking Generative, Multimodal, and Agentic AI in Healthcare
di: Desikan, Prasanna, et al.
Pubblicazione: (2026)
di: Desikan, Prasanna, et al.
Pubblicazione: (2026)
ART: Action-based Reasoning Task Benchmarking for Medical AI Agents
di: Mantravadi, Ananya, et al.
Pubblicazione: (2026)
di: Mantravadi, Ananya, et al.
Pubblicazione: (2026)
LegalWiz: A Multi-Agent Generation Framework for Contradiction Detection in Legal Documents
di: Mantravadi, Ananya, et al.
Pubblicazione: (2025)
di: Mantravadi, Ananya, et al.
Pubblicazione: (2025)
Automated Auditing of Hospital Discharge Summaries for Care Transitions
di: Dasula, Akshat, et al.
Pubblicazione: (2026)
di: Dasula, Akshat, et al.
Pubblicazione: (2026)
Human + AI for Accelerating Ad Localization Evaluation
di: Rajgarhia, Harshit, et al.
Pubblicazione: (2025)
di: Rajgarhia, Harshit, et al.
Pubblicazione: (2025)
Scalable multilingual PII annotation for responsible AI in LLMs
di: Meena, Bharti, et al.
Pubblicazione: (2025)
di: Meena, Bharti, et al.
Pubblicazione: (2025)
MedMosaic: A Challenging Large Scale Benchmark of Diverse Medical Audio
di: Rajgarhia, Harshit, et al.
Pubblicazione: (2026)
di: Rajgarhia, Harshit, et al.
Pubblicazione: (2026)
ALOE: Action-Level Off-Policy Evaluation for Vision-Language-Action Model Post-Training
di: Yang, Rushuai, et al.
Pubblicazione: (2026)
di: Yang, Rushuai, et al.
Pubblicazione: (2026)
Extracting Disaster Impacts and Impact Related Locations in Social Media Posts Using Large Language Models
di: Hameed, Sameeah Noreen, et al.
Pubblicazione: (2025)
di: Hameed, Sameeah Noreen, et al.
Pubblicazione: (2025)
Retrieval-Augmented Large Language Models for Schema-Constrained Clinical Information Extraction
di: Karim, A H M Rezaul, et al.
Pubblicazione: (2026)
di: Karim, A H M Rezaul, et al.
Pubblicazione: (2026)
Enabling Precise Topic Alignment in Large Language Models Via Sparse Autoencoders
di: Joshi, Ananya, et al.
Pubblicazione: (2025)
di: Joshi, Ananya, et al.
Pubblicazione: (2025)
Systematic Comparative Analysis of Large Pretrained Language Models on Contextualized Medication Event Extraction
di: Abdul-Quddoos, Tariq, et al.
Pubblicazione: (2025)
di: Abdul-Quddoos, Tariq, et al.
Pubblicazione: (2025)
SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal
di: Xie, Tinghao, et al.
Pubblicazione: (2024)
di: Xie, Tinghao, et al.
Pubblicazione: (2024)
Systematic Evaluation of Knowledge Graph Repair with Large Language Models
di: Lin, Tung-Wei, et al.
Pubblicazione: (2025)
di: Lin, Tung-Wei, et al.
Pubblicazione: (2025)
Chinese Discharge Drug Recommendation in Metabolic Diseases with Large Language Models
di: Li, Juntao, et al.
Pubblicazione: (2025)
di: Li, Juntao, et al.
Pubblicazione: (2025)
AI-Powered Annotation Pipelines for Stabilizing Large Language Models: A Human-AI Synergy Approach
di: Pathak, Gangesh, et al.
Pubblicazione: (2025)
di: Pathak, Gangesh, et al.
Pubblicazione: (2025)
Model Tuning or Prompt Tuning? A Study of Large Language Models for Clinical Concept and Relation Extraction
di: Peng, Cheng, et al.
Pubblicazione: (2023)
di: Peng, Cheng, et al.
Pubblicazione: (2023)
Bias in Large Language Models Across Clinical Applications: A Systematic Review
di: Suenghataiphorn, Thanathip, et al.
Pubblicazione: (2025)
di: Suenghataiphorn, Thanathip, et al.
Pubblicazione: (2025)
Resource-Conscious Modeling for Next- Day Discharge Prediction Using Clinical Notes
di: Cho, Ha Na, et al.
Pubblicazione: (2026)
di: Cho, Ha Na, et al.
Pubblicazione: (2026)
Revisiting In-Context Learning with Long Context Language Models
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
KnowledgeBerg: Evaluating Systematic Knowledge Coverage and Compositional Reasoning in Large Language Models
di: Zhang, Xiao, et al.
Pubblicazione: (2026)
di: Zhang, Xiao, et al.
Pubblicazione: (2026)
Responsible AI in Construction Safety: Systematic Evaluation of Large Language Models and Prompt Engineering
di: Sammour, Farouq, et al.
Pubblicazione: (2024)
di: Sammour, Farouq, et al.
Pubblicazione: (2024)
Scaling Open-Weight Large Language Models for Hydropower Regulatory Information Extraction: A Systematic Analysis
di: Yoon, Hong-Jun, et al.
Pubblicazione: (2025)
di: Yoon, Hong-Jun, et al.
Pubblicazione: (2025)
Context-Aware Hospitalization Forecasting Evaluations for Decision Support using LLMs
di: Makkuni, Rhea, et al.
Pubblicazione: (2026)
di: Makkuni, Rhea, et al.
Pubblicazione: (2026)
GenRES: Rethinking Evaluation for Generative Relation Extraction in the Era of Large Language Models
di: Jiang, Pengcheng, et al.
Pubblicazione: (2024)
di: Jiang, Pengcheng, et al.
Pubblicazione: (2024)
Context-Aware Assistant Selection for Improved Inference Acceleration with Large Language Models
di: Huang, Jerry, et al.
Pubblicazione: (2024)
di: Huang, Jerry, et al.
Pubblicazione: (2024)
Harnessing Large Language Models for Precision Querying and Retrieval-Augmented Knowledge Extraction in Clinical Data Science
di: Jan, Juan Jose Rubio, et al.
Pubblicazione: (2026)
di: Jan, Juan Jose Rubio, et al.
Pubblicazione: (2026)
MSDiagnosis: A Benchmark for Evaluating Large Language Models in Multi-Step Clinical Diagnosis
di: Hou, Ruihui, et al.
Pubblicazione: (2024)
di: Hou, Ruihui, et al.
Pubblicazione: (2024)
Systematic Weight Evaluation for Pruning Large Language Models: Enhancing Performance and Sustainability
di: Islam, Ashhadul, et al.
Pubblicazione: (2025)
di: Islam, Ashhadul, et al.
Pubblicazione: (2025)
Improving Large Language Model Planning with Action Sequence Similarity
di: Zhao, Xinran, et al.
Pubblicazione: (2025)
di: Zhao, Xinran, et al.
Pubblicazione: (2025)
Evaluation of Causal Reasoning for Large Language Models in Contextualized Clinical Scenarios of Laboratory Test Interpretation
di: Bhasuran, Balu, et al.
Pubblicazione: (2025)
di: Bhasuran, Balu, et al.
Pubblicazione: (2025)
CP-Env: Evaluating Large Language Models on Clinical Pathways in a Controllable Hospital Environment
di: Zhu, Yakun, et al.
Pubblicazione: (2025)
di: Zhu, Yakun, et al.
Pubblicazione: (2025)
Experience Scaling: Post-Deployment Evolution For Large Language Models
di: Yin, Xingkun, et al.
Pubblicazione: (2025)
di: Yin, Xingkun, et al.
Pubblicazione: (2025)
Optimal Question Selection from a Large Question Bank for Clinical Field Recovery in Conversational Psychiatric Intake
di: Gui, Guan, et al.
Pubblicazione: (2026)
di: Gui, Guan, et al.
Pubblicazione: (2026)
A Systematic Approach for Large Language Models Debugging
di: Shbita, Basel, et al.
Pubblicazione: (2026)
di: Shbita, Basel, et al.
Pubblicazione: (2026)
Meronymic Ontology Extraction via Large Language Models
di: Zhang, Dekai, et al.
Pubblicazione: (2025)
di: Zhang, Dekai, et al.
Pubblicazione: (2025)
Evaluating Clinical Competencies of Large Language Models with a General Practice Benchmark
di: Li, Zheqing, et al.
Pubblicazione: (2025)
di: Li, Zheqing, et al.
Pubblicazione: (2025)
Simulating Viva Voce Examinations to Evaluate Clinical Reasoning in Large Language Models
di: Chiu, Christopher, et al.
Pubblicazione: (2025)
di: Chiu, Christopher, et al.
Pubblicazione: (2025)
LLM+AL: Bridging Large Language Models and Action Languages for Complex Reasoning about Actions
di: Ishay, Adam, et al.
Pubblicazione: (2025)
di: Ishay, Adam, et al.
Pubblicazione: (2025)
LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models
di: Parmar, Mihir, et al.
Pubblicazione: (2024)
di: Parmar, Mihir, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Measuring What Matters: Benchmarking Generative, Multimodal, and Agentic AI in Healthcare
di: Desikan, Prasanna, et al.
Pubblicazione: (2026) -
ART: Action-based Reasoning Task Benchmarking for Medical AI Agents
di: Mantravadi, Ananya, et al.
Pubblicazione: (2026) -
LegalWiz: A Multi-Agent Generation Framework for Contradiction Detection in Legal Documents
di: Mantravadi, Ananya, et al.
Pubblicazione: (2025) -
Automated Auditing of Hospital Discharge Summaries for Care Transitions
di: Dasula, Akshat, et al.
Pubblicazione: (2026) -
Human + AI for Accelerating Ad Localization Evaluation
di: Rajgarhia, Harshit, et al.
Pubblicazione: (2025)