Evaluating the Presence of Sex Bias in Clinical Reasoning by Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Tsintsiper, Isabel, Wong, Sheng, Albert, Beth, Brennecke, Shaun P, Jones, Gabriel Davis |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Energy Landscapes Enable Reliable Abstention in Retrieval-Augmented Large Language Models for Healthcare
por: Shankar, Ravi, et al.
Publicado: (2025)
por: Shankar, Ravi, et al.
Publicado: (2025)
Inference-Time Reasoning Selectively Reduces Implicit Social Bias in Large Language Models
por: Apsel, Molly, et al.
Publicado: (2026)
por: Apsel, Molly, et al.
Publicado: (2026)
BiasCause: Evaluate Socially Biased Causal Reasoning of Large Language Models
por: Xie, Tian, et al.
Publicado: (2025)
por: Xie, Tian, et al.
Publicado: (2025)
Rosetta-PL: Propositional Logic as a Benchmark for Large Language Model Reasoning
por: Baek, Shaun, et al.
Publicado: (2025)
por: Baek, Shaun, et al.
Publicado: (2025)
Evaluating Gender Bias in Large Language Models
por: Döll, Michael, et al.
Publicado: (2024)
por: Döll, Michael, et al.
Publicado: (2024)
Mitigating the Bias of Large Language Model Evaluation
por: Zhou, Hongli, et al.
Publicado: (2024)
por: Zhou, Hongli, et al.
Publicado: (2024)
CLIMB: A Benchmark of Clinical Bias in Large Language Models
por: Zhang, Yubo, et al.
Publicado: (2024)
por: Zhang, Yubo, et al.
Publicado: (2024)
BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models
por: Fan, Zhiting, et al.
Publicado: (2025)
por: Fan, Zhiting, et al.
Publicado: (2025)
ClinDEF: A Dynamic Evaluation Framework for Large Language Models in Clinical Reasoning
por: Tang, Yuqi, et al.
Publicado: (2025)
por: Tang, Yuqi, et al.
Publicado: (2025)
Chain-of-Thought Reasoning with Large Language Models for Clinical Alzheimer's Disease Assessment and Diagnosis
por: Zhang, Tongze, et al.
Publicado: (2026)
por: Zhang, Tongze, et al.
Publicado: (2026)
IndiVec: An Exploration of Leveraging Large Language Models for Media Bias Detection with Fine-Grained Bias Indicators
por: Lin, Luyang, et al.
Publicado: (2024)
por: Lin, Luyang, et al.
Publicado: (2024)
Talent or Luck? Evaluating Attribution Bias in Large Language Models
por: Raj, Chahat, et al.
Publicado: (2025)
por: Raj, Chahat, et al.
Publicado: (2025)
CleanCTG: A Deep Learning Model for Multi-Artefact Detection and Reconstruction in Cardiotocography
por: Wong, Sheng, et al.
Publicado: (2025)
por: Wong, Sheng, et al.
Publicado: (2025)
Gender Bias in Large Language Models for Healthcare: Assignment Consistency and Clinical Implications
por: Liu, Mingxuan, et al.
Publicado: (2025)
por: Liu, Mingxuan, et al.
Publicado: (2025)
A Comprehensive Evaluation on Event Reasoning of Large Language Models
por: Tao, Zhengwei, et al.
Publicado: (2024)
por: Tao, Zhengwei, et al.
Publicado: (2024)
Bias in Large Language Models: Origin, Evaluation, and Mitigation
por: Guo, Yufei, et al.
Publicado: (2024)
por: Guo, Yufei, et al.
Publicado: (2024)
Regional Bias in Large Language Models
por: Gopinadh, M P V S, et al.
Publicado: (2026)
por: Gopinadh, M P V S, et al.
Publicado: (2026)
Evaluating Nuanced Bias in Large Language Model Free Response Answers
por: Healey, Jennifer, et al.
Publicado: (2024)
por: Healey, Jennifer, et al.
Publicado: (2024)
Social Bias Evaluation for Large Language Models Requires Prompt Variations
por: Hida, Rem, et al.
Publicado: (2024)
por: Hida, Rem, et al.
Publicado: (2024)
Bias in, Bias out: Annotation Bias in Multilingual Large Language Models
por: Cui, Xia, et al.
Publicado: (2025)
por: Cui, Xia, et al.
Publicado: (2025)
ReliableMath: Benchmark of Reliable Mathematical Reasoning on Large Language Models
por: Xue, Boyang, et al.
Publicado: (2025)
por: Xue, Boyang, et al.
Publicado: (2025)
Generalization in Healthcare AI: Evaluation of a Clinical Large Language Model
por: Rahman, Salman, et al.
Publicado: (2024)
por: Rahman, Salman, et al.
Publicado: (2024)
Translate With Care: Addressing Gender Bias, Neutrality, and Reasoning in Large Language Model Translations
por: Zahraei, Pardis Sadat, et al.
Publicado: (2025)
por: Zahraei, Pardis Sadat, et al.
Publicado: (2025)
LEME: Open Large Language Models for Ophthalmology with Advanced Reasoning and Clinical Validation
por: Kim, Hyunjae, et al.
Publicado: (2024)
por: Kim, Hyunjae, et al.
Publicado: (2024)
Evaluating Counterfactual Strategic Reasoning in Large Language Models
por: Georgousis, Dimitrios, et al.
Publicado: (2026)
por: Georgousis, Dimitrios, et al.
Publicado: (2026)
Evaluating Accounting Reasoning Capabilities of Large Language Models
por: Zhou, Jie, et al.
Publicado: (2026)
por: Zhou, Jie, et al.
Publicado: (2026)
A Systematic Analysis of Large Language Models as Soft Reasoners: The Case of Syllogistic Inferences
por: Bertolazzi, Leonardo, et al.
Publicado: (2024)
por: Bertolazzi, Leonardo, et al.
Publicado: (2024)
Acquiescence Bias in Large Language Models
por: Braun, Daniel
Publicado: (2025)
por: Braun, Daniel
Publicado: (2025)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
por: Oi, Masanari, et al.
Publicado: (2024)
por: Oi, Masanari, et al.
Publicado: (2024)
Evaluating and Mitigating Social Bias for Large Language Models in Open-ended Settings
por: Liu, Zhao, et al.
Publicado: (2024)
por: Liu, Zhao, et al.
Publicado: (2024)
Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models
por: Abolghasemi, Amin, et al.
Publicado: (2024)
por: Abolghasemi, Amin, et al.
Publicado: (2024)
Evaluating Gender Bias in Large Language Models via Chain-of-Thought Prompting
por: Kaneko, Masahiro, et al.
Publicado: (2024)
por: Kaneko, Masahiro, et al.
Publicado: (2024)
Large Language Models with Temporal Reasoning for Longitudinal Clinical Summarization and Prediction
por: Kruse, Maya, et al.
Publicado: (2025)
por: Kruse, Maya, et al.
Publicado: (2025)
R-TOFU: Unlearning in Large Reasoning Models
por: Yoon, Sangyeon, et al.
Publicado: (2025)
por: Yoon, Sangyeon, et al.
Publicado: (2025)
Bias in Large Language Models Across Clinical Applications: A Systematic Review
por: Suenghataiphorn, Thanathip, et al.
Publicado: (2025)
por: Suenghataiphorn, Thanathip, et al.
Publicado: (2025)
A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners
por: Jiang, Bowen, et al.
Publicado: (2024)
por: Jiang, Bowen, et al.
Publicado: (2024)
No LLM is Free From Bias: A Comprehensive Study of Bias Evaluation in Large Language Models
por: Kumar, Charaka Vinayak, et al.
Publicado: (2025)
por: Kumar, Charaka Vinayak, et al.
Publicado: (2025)
Harnessing the Reasoning Economy: A Survey of Efficient Reasoning for Large Language Models
por: Wang, Rui, et al.
Publicado: (2025)
por: Wang, Rui, et al.
Publicado: (2025)
Hearing the Order: Investigating Position Bias in Large Audio-Language Models
por: Lin, Yu-Xiang, et al.
Publicado: (2025)
por: Lin, Yu-Xiang, et al.
Publicado: (2025)
Is Reasoning All You Need? Probing Bias in the Age of Reasoning Language Models
por: Cantini, Riccardo, et al.
Publicado: (2025)
por: Cantini, Riccardo, et al.
Publicado: (2025)
Ejemplares similares
-
Energy Landscapes Enable Reliable Abstention in Retrieval-Augmented Large Language Models for Healthcare
por: Shankar, Ravi, et al.
Publicado: (2025) -
Inference-Time Reasoning Selectively Reduces Implicit Social Bias in Large Language Models
por: Apsel, Molly, et al.
Publicado: (2026) -
BiasCause: Evaluate Socially Biased Causal Reasoning of Large Language Models
por: Xie, Tian, et al.
Publicado: (2025) -
Rosetta-PL: Propositional Logic as a Benchmark for Large Language Model Reasoning
por: Baek, Shaun, et al.
Publicado: (2025) -
Evaluating Gender Bias in Large Language Models
por: Döll, Michael, et al.
Publicado: (2024)