Can LLMs Correct Physicians, Yet? Investigating Effective Interaction Methods in the Medical Domain
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sayin, Burcu, Minervini, Pasquale, Staiano, Jacopo, Passerini, Andrea |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MedGellan: LLM-Generated Medical Guidance to Support Physicians
par: Banerjee, Debodeep, et autres
Publié: (2025)
par: Banerjee, Debodeep, et autres
Publié: (2025)
MedSyn: Enhancing Diagnostics with Human-AI Collaboration
par: Sayin, Burcu, et autres
Publié: (2025)
par: Sayin, Burcu, et autres
Publié: (2025)
Unveiling LLMs: The Evolution of Latent Representations in a Dynamic Knowledge Graph
par: Bronzini, Marco, et autres
Publié: (2024)
par: Bronzini, Marco, et autres
Publié: (2024)
Hybrid Decision Making via Conformal VLM-generated Guidance
par: Banerjee, Debodeep, et autres
Publié: (2026)
par: Banerjee, Debodeep, et autres
Publié: (2026)
Hyperdimensional Probe: Decoding LLM Representations via Vector Symbolic Architectures
par: Bronzini, Marco, et autres
Publié: (2025)
par: Bronzini, Marco, et autres
Publié: (2025)
Human-LLM Dialogue Improves Diagnostic Accuracy in Emergency Care
par: Sayin, Burcu, et autres
Publié: (2026)
par: Sayin, Burcu, et autres
Publié: (2026)
Noiser: Bounded Input Perturbations for Attributing Large Language Models
par: Madani, Mohammad Reza Ghasemi, et autres
Publié: (2025)
par: Madani, Mohammad Reza Ghasemi, et autres
Publié: (2025)
A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression
par: Devoto, Alessio, et autres
Publié: (2024)
par: Devoto, Alessio, et autres
Publié: (2024)
Translating Under Pressure: Domain-Aware LLMs for Crisis Communication
par: Castaldo, Antonio, et autres
Publié: (2026)
par: Castaldo, Antonio, et autres
Publié: (2026)
Lost in Time: Clock and Calendar Understanding Challenges in Multimodal LLMs
par: Saxena, Rohit, et autres
Publié: (2025)
par: Saxena, Rohit, et autres
Publié: (2025)
Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection Method
par: Zhao, Yukun, et autres
Publié: (2023)
par: Zhao, Yukun, et autres
Publié: (2023)
The LLM Wears Prada: Analysing Gender Bias and Stereotypes through Online Shopping Data
par: Luca, Massimiliano, et autres
Publié: (2025)
par: Luca, Massimiliano, et autres
Publié: (2025)
Learning To Guide Human Decision Makers With Vision-Language Models
par: Banerjee, Debodeep, et autres
Publié: (2024)
par: Banerjee, Debodeep, et autres
Publié: (2024)
Do LLMs Provide Consistent Answers to Health-Related Questions across Languages?
par: Schlicht, Ipek Baris, et autres
Publié: (2025)
par: Schlicht, Ipek Baris, et autres
Publié: (2025)
LLMEval-Med: A Real-world Clinical Benchmark for Medical LLMs with Physician Validation
par: Zhang, Ming, et autres
Publié: (2025)
par: Zhang, Ming, et autres
Publié: (2025)
PosterSum: A Multimodal Benchmark for Scientific Poster Summarization
par: Saxena, Rohit, et autres
Publié: (2025)
par: Saxena, Rohit, et autres
Publié: (2025)
Can LLMs Correct Themselves? A Benchmark of Self-Correction in LLMs
par: Tie, Guiyao, et autres
Publié: (2025)
par: Tie, Guiyao, et autres
Publié: (2025)
FairBelief -- Assessing Harmful Beliefs in Language Models
par: Setzu, Mattia, et autres
Publié: (2024)
par: Setzu, Mattia, et autres
Publié: (2024)
Evaluating and Safeguarding the Adversarial Robustness of Retrieval-Based In-Context Learning
par: Yu, Simon, et autres
Publié: (2024)
par: Yu, Simon, et autres
Publié: (2024)
SPARSEFIT: Few-shot Prompting with Sparse Fine-tuning for Jointly Generating Predictions and Natural Language Explanations
par: Solano, Jesus, et autres
Publié: (2023)
par: Solano, Jesus, et autres
Publié: (2023)
Probing the Emergence of Cross-lingual Alignment during LLM Training
par: Wang, Hetong, et autres
Publié: (2024)
par: Wang, Hetong, et autres
Publié: (2024)
Catch Me If You Can? Not Yet: LLMs Still Struggle to Imitate the Implicit Writing Styles of Everyday Authors
par: Wang, Zhengxiang, et autres
Publié: (2025)
par: Wang, Zhengxiang, et autres
Publié: (2025)
From Physician Expertise to Clinical Agents: Preserving, Standardizing, and Scaling Physicians' Medical Expertise with Lightweight LLM
par: Luo, Chanyong, et autres
Publié: (2026)
par: Luo, Chanyong, et autres
Publié: (2026)
I Want to Break Free! Persuasion and Anti-Social Behavior of LLMs in Multi-Agent Settings with Social Hierarchy
par: Campedelli, Gian Maria, et autres
Publié: (2024)
par: Campedelli, Gian Maria, et autres
Publié: (2024)
Can LLMs Perceive Time? An Empirical Investigation
par: Garikaparthi, Aniketh
Publié: (2026)
par: Garikaparthi, Aniketh
Publié: (2026)
SynDARin: Synthesising Datasets for Automated Reasoning in Low-Resource Languages
par: Ghazaryan, Gayane, et autres
Publié: (2024)
par: Ghazaryan, Gayane, et autres
Publié: (2024)
LLM-REVal: Can We Trust LLM Reviewers Yet?
par: Li, Rui, et autres
Publié: (2025)
par: Li, Rui, et autres
Publié: (2025)
An Analysis of Decoding Methods for LLM-based Agents for Faithful Multi-Hop Question Answering
par: Murphy, Alexander, et autres
Publié: (2025)
par: Murphy, Alexander, et autres
Publié: (2025)
Large Language Models Cannot Self-Correct Reasoning Yet
par: Huang, Jie, et autres
Publié: (2023)
par: Huang, Jie, et autres
Publié: (2023)
The Garden of Forking Paths: Observing Dynamic Parameters Distribution in Large Language Models
par: Nicolini, Carlo, et autres
Publié: (2024)
par: Nicolini, Carlo, et autres
Publié: (2024)
Rethinking and Recomputing the Value of Machine Learning Models
par: Sayin, Burcu, et autres
Publié: (2022)
par: Sayin, Burcu, et autres
Publié: (2022)
Sociodemographic Prompting is Not Yet an Effective Approach for Simulating Subjective Judgments with LLMs
par: Sun, Huaman, et autres
Publié: (2023)
par: Sun, Huaman, et autres
Publié: (2023)
Glitter or Gold? Deriving Structured Insights from Sustainability Reports via Large Language Models
par: Bronzini, Marco, et autres
Publié: (2023)
par: Bronzini, Marco, et autres
Publié: (2023)
Edinburgh Clinical NLP at MEDIQA-CORR 2024: Guiding Large Language Models with Hints
par: Gema, Aryo Pradipta, et autres
Publié: (2024)
par: Gema, Aryo Pradipta, et autres
Publié: (2024)
MedPAIR: Measuring Physicians and AI Relevance Alignment in Medical Question Answering
par: Hao, Yuexing, et autres
Publié: (2025)
par: Hao, Yuexing, et autres
Publié: (2025)
Semantic Flow Regularization: Teaching LLMs to Generate Diverse Yet Coherent Responses
par: Peng, Kerui, et autres
Publié: (2026)
par: Peng, Kerui, et autres
Publié: (2026)
Fine-tuning and Utilization Methods of Domain-specific LLMs
par: Jeong, Cheonsu
Publié: (2024)
par: Jeong, Cheonsu
Publié: (2024)
To Generate or to Retrieve? On the Effectiveness of Artificial Contexts for Medical Open-Domain Question Answering
par: Frisoni, Giacomo, et autres
Publié: (2024)
par: Frisoni, Giacomo, et autres
Publié: (2024)
Can LLMs Recognize Toxicity? A Structured Investigation Framework and Toxicity Metric
par: Koh, Hyukhun, et autres
Publié: (2024)
par: Koh, Hyukhun, et autres
Publié: (2024)
MedReflect: Teaching Medical LLMs to Self-Improve via Reflective Correction
par: Huang, Yue, et autres
Publié: (2025)
par: Huang, Yue, et autres
Publié: (2025)
Documents similaires
-
MedGellan: LLM-Generated Medical Guidance to Support Physicians
par: Banerjee, Debodeep, et autres
Publié: (2025) -
MedSyn: Enhancing Diagnostics with Human-AI Collaboration
par: Sayin, Burcu, et autres
Publié: (2025) -
Unveiling LLMs: The Evolution of Latent Representations in a Dynamic Knowledge Graph
par: Bronzini, Marco, et autres
Publié: (2024) -
Hybrid Decision Making via Conformal VLM-generated Guidance
par: Banerjee, Debodeep, et autres
Publié: (2026) -
Hyperdimensional Probe: Decoding LLM Representations via Vector Symbolic Architectures
par: Bronzini, Marco, et autres
Publié: (2025)