Reliability of Large Language Model Generated Clinical Reasoning in Assisted Reproductive Technology: Blinded Comparative Evaluation Study
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Dou, Long, Ying, Zuoqiu, Sophia, Liu, Di, Li, Kang, Lin, Yiting, Liu, Hanyi, Yin, Rong, Tang, Tian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Evaluating the Feasibility and Accuracy of Large Language Models for Medical History-Taking in Obstetrics and Gynecology
di: Liu, Dou, et al.
Pubblicazione: (2025)
di: Liu, Dou, et al.
Pubblicazione: (2025)
The Alignment Paradox of Medical Large Language Models in Infertility Care: Decoupling Algorithmic Improvement from Clinical Decision-making Quality
di: Liu, Dou, et al.
Pubblicazione: (2025)
di: Liu, Dou, et al.
Pubblicazione: (2025)
Evaluating the Application of ChatGPT in Outpatient Triage Guidance: A Comparative Study
di: Liu, Dou, et al.
Pubblicazione: (2024)
di: Liu, Dou, et al.
Pubblicazione: (2024)
Outcomes of Assisted Reproductive Technology in Women With Hepatitis B Infection
di: Xiaoling Hu, et al.
Pubblicazione: (2025)
di: Xiaoling Hu, et al.
Pubblicazione: (2025)
Reliable Imputed-Sample Assisted Vertical Federated Learning
di: Zeng, Yaopei, et al.
Pubblicazione: (2025)
di: Zeng, Yaopei, et al.
Pubblicazione: (2025)
AssistRAG: Boosting the Potential of Large Language Models with an Intelligent Information Assistant
di: Zhou, Yujia, et al.
Pubblicazione: (2024)
di: Zhou, Yujia, et al.
Pubblicazione: (2024)
TangramPuzzle: Evaluating Multimodal Large Language Models with Compositional Spatial Reasoning
di: Liu, Daixian, et al.
Pubblicazione: (2026)
di: Liu, Daixian, et al.
Pubblicazione: (2026)
ReliableMath: Benchmark of Reliable Mathematical Reasoning on Large Language Models
di: Xue, Boyang, et al.
Pubblicazione: (2025)
di: Xue, Boyang, et al.
Pubblicazione: (2025)
Complementary Interventions Using Technology for Individuals With Infertility Using Assisted Reproductive Technology: A Scoping Review
di: Jiwon Lee, et al.
Pubblicazione: (2025)
di: Jiwon Lee, et al.
Pubblicazione: (2025)
Large Language Models for Mathematical Reasoning: Progresses and Challenges
di: Ahn, Janice, et al.
Pubblicazione: (2024)
di: Ahn, Janice, et al.
Pubblicazione: (2024)
Blind Spot Navigation in Large Language Model Reasoning with Thought Space Explorer
di: Zhang, Jinghan, et al.
Pubblicazione: (2024)
di: Zhang, Jinghan, et al.
Pubblicazione: (2024)
Reproductive Curation: Assisted Reproductive Technologies ( ARTs ) and Lesbian Motherhood‐Making
di: Xiaomin Cai, et al.
Pubblicazione: (2025)
di: Xiaomin Cai, et al.
Pubblicazione: (2025)
RETRACTION: Comparison of the Effect of Dydrogesterone and Natural Micronized Progesterone for Luteal‐Phase Support in Assisted Reproductive Technology Cycles: A Single‐Blind Randomized Clinical Trial Study
Pubblicazione: (2025)
Pubblicazione: (2025)
Assisted Reproductive Technology and the Externality of Multiple Births
di: Hawkins, Richard
Pubblicazione: (2009)
di: Hawkins, Richard
Pubblicazione: (2009)
Integration of Bioengineered Tools in Assisted Reproductive Technologies
di: Aslı Ak, et al.
Pubblicazione: (2025)
di: Aslı Ak, et al.
Pubblicazione: (2025)
Assisted Reproductive Technology in China: A Commentary
di: Fang Gu, et al.
Pubblicazione: (2025)
di: Fang Gu, et al.
Pubblicazione: (2025)
Mixture of Low-rank Experts for Transferable AI-Generated Image Detection
di: Liu, Zihan, et al.
Pubblicazione: (2024)
di: Liu, Zihan, et al.
Pubblicazione: (2024)
Reasoning Hijacking: The Fragility of Reasoning Alignment in Large Language Models
di: Liu, Yuansen, et al.
Pubblicazione: (2026)
di: Liu, Yuansen, et al.
Pubblicazione: (2026)
Reliability Assessment Models of System Under a Mixed Run Shock With Phase‐Type Distribution
di: Yiting Fan, et al.
Pubblicazione: (2025)
di: Yiting Fan, et al.
Pubblicazione: (2025)
Disentangling Language and Culture for Evaluating Multilingual Large Language Models
di: Ying, Jiahao, et al.
Pubblicazione: (2025)
di: Ying, Jiahao, et al.
Pubblicazione: (2025)
Large Language Models Cannot Reliably Detect Vulnerabilities in JavaScript: The First Systematic Benchmark and Evaluation
di: Fei, Qingyuan, et al.
Pubblicazione: (2025)
di: Fei, Qingyuan, et al.
Pubblicazione: (2025)
GeoFM: Enhancing Geometric Reasoning of MLLMs via Synthetic Data Generation through Formal Language
di: Zhang, Yuhao, et al.
Pubblicazione: (2025)
di: Zhang, Yuhao, et al.
Pubblicazione: (2025)
MedMMV: A Controllable Multimodal Multi-Agent Framework for Reliable and Verifiable Clinical Reasoning
di: Liu, Hongjun, et al.
Pubblicazione: (2025)
di: Liu, Hongjun, et al.
Pubblicazione: (2025)
Reasoning Multimodal Large Language Model: Data Contamination and Dynamic Evaluation
di: Liu, Ming, et al.
Pubblicazione: (2025)
di: Liu, Ming, et al.
Pubblicazione: (2025)
CodeMind: Evaluating Large Language Models for Code Reasoning
di: Liu, Changshu, et al.
Pubblicazione: (2024)
di: Liu, Changshu, et al.
Pubblicazione: (2024)
LEME: Open Large Language Models for Ophthalmology with Advanced Reasoning and Clinical Validation
di: Kim, Hyunjae, et al.
Pubblicazione: (2024)
di: Kim, Hyunjae, et al.
Pubblicazione: (2024)
The Application of Orthopedic Surgical Robot‐Assisted Technology in Various Clinical Scenarios Involving Bone Tumors
di: Hanxiao Yin, et al.
Pubblicazione: (2025)
di: Hanxiao Yin, et al.
Pubblicazione: (2025)
Towards Safer Large Language Models through Machine Unlearning
di: Liu, Zheyuan, et al.
Pubblicazione: (2024)
di: Liu, Zheyuan, et al.
Pubblicazione: (2024)
Comparative Evaluation of Teaching Plans on Prostate Cancer Generated by Various Large Language Models and a Human Expert
di: Rong Wang, et al.
Pubblicazione: (2025)
di: Rong Wang, et al.
Pubblicazione: (2025)
Derivative-Free Optimization for Low-Rank Adaptation in Large Language Models
di: Jin, Feihu, et al.
Pubblicazione: (2024)
di: Jin, Feihu, et al.
Pubblicazione: (2024)
BiasCause: Evaluate Socially Biased Causal Reasoning of Large Language Models
di: Xie, Tian, et al.
Pubblicazione: (2025)
di: Xie, Tian, et al.
Pubblicazione: (2025)
Disguised Copyright Infringement of Latent Diffusion Models
di: Lu, Yiwei, et al.
Pubblicazione: (2024)
di: Lu, Yiwei, et al.
Pubblicazione: (2024)
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
di: Li, Shuozhe, et al.
Pubblicazione: (2026)
di: Li, Shuozhe, et al.
Pubblicazione: (2026)
Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics
di: Al-Khalili, Zena, et al.
Pubblicazione: (2025)
di: Al-Khalili, Zena, et al.
Pubblicazione: (2025)
Reliable Academic Conference Question Answering: A Study Based on Large Language Model
di: Huang, Zhiwei, et al.
Pubblicazione: (2023)
di: Huang, Zhiwei, et al.
Pubblicazione: (2023)
The Illusion of Clinical Reasoning: A Benchmark Reveals the Pervasive Gap in Vision-Language Models for Clinical Competency
di: Wang, Dingyu, et al.
Pubblicazione: (2025)
di: Wang, Dingyu, et al.
Pubblicazione: (2025)
Automating Dataset Updates Towards Reliable and Timely Evaluation of Large Language Models
di: Ying, Jiahao, et al.
Pubblicazione: (2024)
di: Ying, Jiahao, et al.
Pubblicazione: (2024)
xFinder: Large Language Models as Automated Evaluators for Reliable Evaluation
di: Yu, Qingchen, et al.
Pubblicazione: (2024)
di: Yu, Qingchen, et al.
Pubblicazione: (2024)
Digital Technology Empowering Rural Environmental Governance: Evidences From Villages in Shanghai, China
di: Qiang Bai, et al.
Pubblicazione: (2025)
di: Qiang Bai, et al.
Pubblicazione: (2025)
Large Language Model‐Assisted Genotoxic Metal‐Phenolic Nanoplatform for Osteosarcoma Therapy
di: Qingxin Fan, et al.
Pubblicazione: (2024)
di: Qingxin Fan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Evaluating the Feasibility and Accuracy of Large Language Models for Medical History-Taking in Obstetrics and Gynecology
di: Liu, Dou, et al.
Pubblicazione: (2025) -
The Alignment Paradox of Medical Large Language Models in Infertility Care: Decoupling Algorithmic Improvement from Clinical Decision-making Quality
di: Liu, Dou, et al.
Pubblicazione: (2025) -
Evaluating the Application of ChatGPT in Outpatient Triage Guidance: A Comparative Study
di: Liu, Dou, et al.
Pubblicazione: (2024) -
Outcomes of Assisted Reproductive Technology in Women With Hepatitis B Infection
di: Xiaoling Hu, et al.
Pubblicazione: (2025) -
Reliable Imputed-Sample Assisted Vertical Federated Learning
di: Zeng, Yaopei, et al.
Pubblicazione: (2025)