HIVMedQA: Benchmarking large language models for HIV medical decision support
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cardenal-Antolin, Gonzalo, Fellay, Jacques, Jaha, Bashkim, Kouyos, Roger, Beerenwinkel, Niko, Duroux, Diane |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fine-tuning the ESM2 protein language model to understand the functional impact of missense variants
par: Saadat, Ali, et autres
Publié: (2024)
par: Saadat, Ali, et autres
Publié: (2024)
Performance of large language models in numerical vs. semantic medical knowledge: Benchmarking on evidence-based Q&As
par: Avnat, Eden, et autres
Publié: (2024)
par: Avnat, Eden, et autres
Publié: (2024)
Evaluating large language models in medical applications: a survey
par: Chen, Xiaolan, et autres
Publié: (2024)
par: Chen, Xiaolan, et autres
Publié: (2024)
WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation
par: Matos, João, et autres
Publié: (2024)
par: Matos, João, et autres
Publié: (2024)
70B-parameter large language models in Japanese medical question-answering
par: Sukeda, Issey, et autres
Publié: (2024)
par: Sukeda, Issey, et autres
Publié: (2024)
Entry-level guide to the use of large language models for medical research
par: Jin, Qiao, et autres
Publié: (2024)
par: Jin, Qiao, et autres
Publié: (2024)
Developmental trajectories of decision making and affective dynamics in large language models
par: Wang, Zhihao, et autres
Publié: (2025)
par: Wang, Zhihao, et autres
Publié: (2025)
Evidence from counterfactual tasks supports emergent analogical reasoning in large language models
par: Webb, Taylor, et autres
Publié: (2024)
par: Webb, Taylor, et autres
Publié: (2024)
Development and bilingual evaluation of Japanese medical large language model within reasonably low computational resources
par: Sukeda, Issey
Publié: (2024)
par: Sukeda, Issey
Publié: (2024)
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
par: Syromiatnikov, Mykyta, et autres
Publié: (2025)
par: Syromiatnikov, Mykyta, et autres
Publié: (2025)
Benchmarking large language models for biomedical natural language processing applications and recommendations
par: Chen, Qingyu, et autres
Publié: (2023)
par: Chen, Qingyu, et autres
Publié: (2023)
Large language models replicate and predict human cooperation across experiments in game theory
par: Palatsi, Andrea Cera, et autres
Publié: (2025)
par: Palatsi, Andrea Cera, et autres
Publié: (2025)
Closing the gap between open-source and commercial large language models for medical evidence summarization
par: Zhang, Gongbo, et autres
Publié: (2024)
par: Zhang, Gongbo, et autres
Publié: (2024)
Supplementary Materials for "Learning and forecasting selection dynamics of SARS-CoV-2 variants from wastewater sequencing data using Covvfit"
par: Dreifuss, David, et autres
Publié: (2025)
par: Dreifuss, David, et autres
Publié: (2025)
Dissociating language and thought in large language models
par: Mahowald, Kyle, et autres
Publié: (2023)
par: Mahowald, Kyle, et autres
Publié: (2023)
Complex QA and language models hybrid architectures, Survey
par: Daull, Xavier, et autres
Publié: (2023)
par: Daull, Xavier, et autres
Publié: (2023)
CVE-LLM : Automatic vulnerability evaluation in medical device industry using large language models
par: Ghosh, Rikhiya, et autres
Publié: (2024)
par: Ghosh, Rikhiya, et autres
Publié: (2024)
Alignment faking in large language models
par: Greenblatt, Ryan, et autres
Publié: (2024)
par: Greenblatt, Ryan, et autres
Publié: (2024)
Retrieval augmentation of large language models for lay language generation
par: Guo, Yue, et autres
Publié: (2022)
par: Guo, Yue, et autres
Publié: (2022)
Do large language models resemble humans in language use?
par: Cai, Zhenguang G., et autres
Publié: (2023)
par: Cai, Zhenguang G., et autres
Publié: (2023)
Creativity Benchmark: A benchmark for marketing creativity for large language models
par: Bhat, Ninad, et autres
Publié: (2025)
par: Bhat, Ninad, et autres
Publié: (2025)
Using large language models to estimate features of multi-word expressions: Concreteness, valence, arousal
par: Martínez, Gonzalo, et autres
Publié: (2024)
par: Martínez, Gonzalo, et autres
Publié: (2024)
Prompting language influences diagnostic reasoning and accuracy of large language models
par: Bazoge, Adrien, et autres
Publié: (2026)
par: Bazoge, Adrien, et autres
Publié: (2026)
Addressing cognitive bias in medical language models
par: Schmidgall, Samuel, et autres
Publié: (2024)
par: Schmidgall, Samuel, et autres
Publié: (2024)
DNA Language Model and Interpretable Graph Neural Network Identify Genes and Pathways Involved in Rare Diseases
par: Saadat, Ali, et autres
Publié: (2024)
par: Saadat, Ali, et autres
Publié: (2024)
Proteome-wide prediction of mode of inheritance and molecular mechanism underlying genetic diseases using structural interactomics
par: Saadat, Ali, et autres
Publié: (2024)
par: Saadat, Ali, et autres
Publié: (2024)
Large Language Models for Variant-Centric Functional Evidence Mining
par: Saadat, Ali, et autres
Publié: (2026)
par: Saadat, Ali, et autres
Publié: (2026)
From Mutation to Degradation: Predicting Nonsense-Mediated Decay with NMDEP
par: Saadat, Ali, et autres
Publié: (2025)
par: Saadat, Ali, et autres
Publié: (2025)
Representation in large language models
par: Yetman, Cameron
Publié: (2025)
par: Yetman, Cameron
Publié: (2025)
On the attribution of confidence to large language models
par: Keeling, Geoff, et autres
Publié: (2024)
par: Keeling, Geoff, et autres
Publié: (2024)
The creative psychometric item generator: a framework for item generation and validation using large language models
par: Laverghetta Jr., Antonio, et autres
Publié: (2024)
par: Laverghetta Jr., Antonio, et autres
Publié: (2024)
Simulated patient systems powered by large language model-based AI agents offer potential for transforming medical education
par: Yu, Huizi, et autres
Publié: (2024)
par: Yu, Huizi, et autres
Publié: (2024)
Can large language models interpret unstructured chat data on dynamic group decision-making processes? Evidence on joint destination choice
par: Lim, Sung-Yoo, et autres
Publié: (2026)
par: Lim, Sung-Yoo, et autres
Publié: (2026)
Dynamic data sampler for cross-language transfer learning in large language models
par: Li, Yudong, et autres
Publié: (2024)
par: Li, Yudong, et autres
Publié: (2024)
Multilingual large language models leak human stereotypes across language boundaries
par: Cao, Yang Trista, et autres
Publié: (2023)
par: Cao, Yang Trista, et autres
Publié: (2023)
MedConceptsQA: Open Source Medical Concepts QA Benchmark
par: Shoham, Ofir Ben, et autres
Publié: (2024)
par: Shoham, Ofir Ben, et autres
Publié: (2024)
Measuring short-form factuality in large language models
par: Wei, Jason, et autres
Publié: (2024)
par: Wei, Jason, et autres
Publié: (2024)
AI-AI Bias: large language models favor communications generated by large language models
par: Laurito, Walter, et autres
Publié: (2024)
par: Laurito, Walter, et autres
Publié: (2024)
Can adversarial attacks by large language models be attributed?
par: Cebrian, Manuel, et autres
Publié: (2024)
par: Cebrian, Manuel, et autres
Publié: (2024)
Optimizing watermarks for large language models
par: Wouters, Bram
Publié: (2023)
par: Wouters, Bram
Publié: (2023)
Documents similaires
-
Fine-tuning the ESM2 protein language model to understand the functional impact of missense variants
par: Saadat, Ali, et autres
Publié: (2024) -
Performance of large language models in numerical vs. semantic medical knowledge: Benchmarking on evidence-based Q&As
par: Avnat, Eden, et autres
Publié: (2024) -
Evaluating large language models in medical applications: a survey
par: Chen, Xiaolan, et autres
Publié: (2024) -
WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation
par: Matos, João, et autres
Publié: (2024) -
70B-parameter large language models in Japanese medical question-answering
par: Sukeda, Issey, et autres
Publié: (2024)