Enhancing Systematic Reviews with Large Language Models: Using GPT-4 and Kimi
Fuente:
arXiv
Guardado en:
| Autores principales: | Kaptur, Dandan Chen, Huang, Yue, Ji, Xuejun Ryan, Guo, Yanhui, Kaptur, Bradley |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Evaluating Four Methods for Detecting Differential Item Functioning in Large-Scale Assessments with More Than Two Groups
por: Kaptur, Dandan Chen, et al.
Publicado: (2024)
por: Kaptur, Dandan Chen, et al.
Publicado: (2024)
Examining Differential Item Functioning (DIF) in Self-Reported Health Survey Data: Via Multilevel Modeling
por: Kaptur, Dandan Chen, et al.
Publicado: (2024)
por: Kaptur, Dandan Chen, et al.
Publicado: (2024)
Examinees' Rapid-Guessing Patterns in Computerized Adaptive Testing for Interim Assessment: From Hierarchical Clustering
por: Kaptur, Dandan Chen, et al.
Publicado: (2024)
por: Kaptur, Dandan Chen, et al.
Publicado: (2024)
Dependencies in Item-Adaptive CAT Data and Differential Item Functioning Detection: A Multilevel Framework
por: Kaptur, Dandan Chen, et al.
Publicado: (2024)
por: Kaptur, Dandan Chen, et al.
Publicado: (2024)
Systematic Evaluation of Uncertainty Estimation Methods in Large Language Models
por: Hobelsberger, Christian, et al.
Publicado: (2025)
por: Hobelsberger, Christian, et al.
Publicado: (2025)
Personalized Prediction of Perceived Message Effectiveness Using Large Language Model Based Digital Twins
por: Han, Jasmin, et al.
Publicado: (2026)
por: Han, Jasmin, et al.
Publicado: (2026)
TransitGPT: A Generative AI-based framework for interacting with GTFS data using Large Language Models
por: Devunuri, Saipraneeth, et al.
Publicado: (2024)
por: Devunuri, Saipraneeth, et al.
Publicado: (2024)
Exploring the Comprehension of ChatGPT in Traditional Chinese Medicine Knowledge
por: Yizhen, Li, et al.
Publicado: (2024)
por: Yizhen, Li, et al.
Publicado: (2024)
Does a Large Language Model Really Speak in Human-Like Language?
por: Park, Mose, et al.
Publicado: (2025)
por: Park, Mose, et al.
Publicado: (2025)
Large Language Models for Full-Text Methods Assessment: A Case Study on Mediation Analysis
por: Zhang, Wenqing, et al.
Publicado: (2025)
por: Zhang, Wenqing, et al.
Publicado: (2025)
Judging It, Washing It: Scoring and Greenwashing Corporate Climate Disclosures using Large Language Models
por: Chuang, Marianne, et al.
Publicado: (2025)
por: Chuang, Marianne, et al.
Publicado: (2025)
A Novel Metric for Measuring the Robustness of Large Language Models in Non-adversarial Scenarios
por: Ackerman, Samuel, et al.
Publicado: (2024)
por: Ackerman, Samuel, et al.
Publicado: (2024)
The GPT Surprise: Offering Large Language Model Chat in a Massive Coding Class Reduced Engagement but Increased Adopters Exam Performances
por: Nie, Allen, et al.
Publicado: (2024)
por: Nie, Allen, et al.
Publicado: (2024)
LAVA: Language Model Assisted Verbal Autopsy for Cause-of-Death Determination
por: Chen, Yiqun T., et al.
Publicado: (2025)
por: Chen, Yiqun T., et al.
Publicado: (2025)
Bayesian Evaluation of Large Language Model Behavior
por: Longjohn, Rachel, et al.
Publicado: (2025)
por: Longjohn, Rachel, et al.
Publicado: (2025)
Repeated Sequences Reveal Gaps between Large Language Models and Natural Language
por: Tanaka-Ishii, Kumiko
Publicado: (2026)
por: Tanaka-Ishii, Kumiko
Publicado: (2026)
Metacognitive Myopia in Large Language Models
por: Scholten, Florian, et al.
Publicado: (2024)
por: Scholten, Florian, et al.
Publicado: (2024)
Auditing the Use of Language Models to Guide Hiring Decisions
por: Gaebler, Johann D., et al.
Publicado: (2024)
por: Gaebler, Johann D., et al.
Publicado: (2024)
Bias in Language Models: Beyond Trick Tests and Toward RUTEd Evaluation
por: Lum, Kristian, et al.
Publicado: (2024)
por: Lum, Kristian, et al.
Publicado: (2024)
Adding Error Bars to Evals: A Statistical Approach to Language Model Evaluations
por: Miller, Evan
Publicado: (2024)
por: Miller, Evan
Publicado: (2024)
Language Hierarchization Provides the Optimal Solution to Human Working Memory Limits
por: Chen, Luyao, et al.
Publicado: (2026)
por: Chen, Luyao, et al.
Publicado: (2026)
Limits of Large Language Models in Debating Humans
por: Flamino, James, et al.
Publicado: (2024)
por: Flamino, James, et al.
Publicado: (2024)
Language-Dependent Political Bias in AI: A Study of ChatGPT and Gemini
por: Yuksel, Dogus, et al.
Publicado: (2025)
por: Yuksel, Dogus, et al.
Publicado: (2025)
Advanced Crash Causation Analysis for Freeway Safety: A Large Language Model Approach to Identifying Key Contributing Factors
por: Abdelrahman, Ahmed S., et al.
Publicado: (2025)
por: Abdelrahman, Ahmed S., et al.
Publicado: (2025)
Contextual Phenotyping of Pediatric Sepsis Cohort Using Large Language Models
por: Nagori, Aditya, et al.
Publicado: (2025)
por: Nagori, Aditya, et al.
Publicado: (2025)
Sampling the Swadesh List to Identify Similar Languages with Tree Spaces
por: Ordway, Garett, et al.
Publicado: (2024)
por: Ordway, Garett, et al.
Publicado: (2024)
Language Markers of Emotion Flexibility Predict Depression and Anxiety Treatment Outcomes
por: Brindle, Benjamin, et al.
Publicado: (2026)
por: Brindle, Benjamin, et al.
Publicado: (2026)
Domain-Shift-Aware Conformal Prediction for Large Language Models
por: Lin, Zhexiao, et al.
Publicado: (2025)
por: Lin, Zhexiao, et al.
Publicado: (2025)
Mind the Unseen Mass: Unmasking LLM Hallucinations via Soft-Hybrid Alphabet Estimation
por: Pan, Hongxing, et al.
Publicado: (2026)
por: Pan, Hongxing, et al.
Publicado: (2026)
A Design-based Solution for Causal Inference with Text: Can a Language Model Be Too Large?
por: Tierney, Graham, et al.
Publicado: (2025)
por: Tierney, Graham, et al.
Publicado: (2025)
How to Choose a Threshold for an Evaluation Metric for Large Language Models
por: Sarmah, Bhaskarjit, et al.
Publicado: (2024)
por: Sarmah, Bhaskarjit, et al.
Publicado: (2024)
Augmented Risk Prediction for the Onset of Alzheimer's Disease from Electronic Health Records with Large Language Models
por: Wang, Jiankun, et al.
Publicado: (2024)
por: Wang, Jiankun, et al.
Publicado: (2024)
Uncertainty-Aware Adaptation of Large Language Models for Protein-Protein Interaction Analysis
por: Jantre, Sanket, et al.
Publicado: (2025)
por: Jantre, Sanket, et al.
Publicado: (2025)
Daily and Weekly Periodicity in Large Language Model Performance and Its Implications for Research
por: Tschisgale, Paul, et al.
Publicado: (2026)
por: Tschisgale, Paul, et al.
Publicado: (2026)
Probing Minimalist Phase Structure in LLMs: What Universal Dependencies Cannot Represent
por: Chen, Yuanhao, et al.
Publicado: (2026)
por: Chen, Yuanhao, et al.
Publicado: (2026)
Context-Alignment: Activating and Enhancing LLM Capabilities in Time Series
por: Hu, Yuxiao, et al.
Publicado: (2025)
por: Hu, Yuxiao, et al.
Publicado: (2025)
Beyond Words: How Large Language Models Perform in Quantitative Management Problem-Solving
por: Kuzmanko, Jonathan
Publicado: (2025)
por: Kuzmanko, Jonathan
Publicado: (2025)
Dynamic Topic Language Model on Heterogeneous Children's Mental Health Clinical Notes
por: Ye, Hanwen, et al.
Publicado: (2023)
por: Ye, Hanwen, et al.
Publicado: (2023)
Large Language Model-Based Agents for Automated Research Reproducibility: An Exploratory Study in Alzheimer's Disease
por: Dobbins, Nic, et al.
Publicado: (2025)
por: Dobbins, Nic, et al.
Publicado: (2025)
Catalysts of Conversation: Examining Interaction Dynamics Between Topic Initiators and Commentors in Alzheimer's Disease Online Communities
por: Ni, Congning, et al.
Publicado: (2024)
por: Ni, Congning, et al.
Publicado: (2024)
Ejemplares similares
-
Evaluating Four Methods for Detecting Differential Item Functioning in Large-Scale Assessments with More Than Two Groups
por: Kaptur, Dandan Chen, et al.
Publicado: (2024) -
Examining Differential Item Functioning (DIF) in Self-Reported Health Survey Data: Via Multilevel Modeling
por: Kaptur, Dandan Chen, et al.
Publicado: (2024) -
Examinees' Rapid-Guessing Patterns in Computerized Adaptive Testing for Interim Assessment: From Hierarchical Clustering
por: Kaptur, Dandan Chen, et al.
Publicado: (2024) -
Dependencies in Item-Adaptive CAT Data and Differential Item Functioning Detection: A Multilevel Framework
por: Kaptur, Dandan Chen, et al.
Publicado: (2024) -
Systematic Evaluation of Uncertainty Estimation Methods in Large Language Models
por: Hobelsberger, Christian, et al.
Publicado: (2025)