A Reproducible Optimisation Protocol for Calibrating Prompt-Based Large Language Model Workflows in Evidence Synthesis
Fuente:
arXiv
Saved in:
| Main Author: | Susnjak, Teo |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Compiling Prompts, Not Crafting Them: A Reproducible Workflow for AI-Assisted Evidence Synthesis
by: Susnjak, Teo
Published: (2025)
by: Susnjak, Teo
Published: (2025)
When Predictions Shape Reality: A Socio-Technical Synthesis of Performative Predictions in Machine Learning
by: Fybish, Gal, et al.
Published: (2026)
by: Fybish, Gal, et al.
Published: (2026)
Transforming Evidence Synthesis: A Systematic Review of the Evolution of Automated Meta-Analysis in the Age of AI
by: Li, Lingbo, et al.
Published: (2025)
by: Li, Lingbo, et al.
Published: (2025)
What Level of Automation is "Good Enough"? A Benchmark of Large Language Models for Meta-Analysis Data Extraction
by: Li, Lingbo, et al.
Published: (2025)
by: Li, Lingbo, et al.
Published: (2025)
Image First or Text First? Optimising the Sequencing of Modalities in Large Language Model Prompting and Reasoning Tasks
by: Wardle, Grant, et al.
Published: (2024)
by: Wardle, Grant, et al.
Published: (2024)
Generalisation Bounds of Zero-Shot Economic Forecasting using Time Series Foundation Models
by: Jetwiriyanon, Jittarin, et al.
Published: (2025)
by: Jetwiriyanon, Jittarin, et al.
Published: (2025)
Transfer Learning on Transformers for Building Energy Consumption Forecasting -- A Comparative Study
by: Spencer, Robert, et al.
Published: (2024)
by: Spencer, Robert, et al.
Published: (2024)
Evaluating Prompting Strategies and Large Language Models in Systematic Literature Review Screening: Relevance and Task-Stage Classification
by: Han, Binglan, et al.
Published: (2025)
by: Han, Binglan, et al.
Published: (2025)
R-LAM: Reproducibility-Constrained Large Action Models for Scientific Workflow Automation
by: Sureshkumar, Suriya
Published: (2026)
by: Sureshkumar, Suriya
Published: (2026)
From Prompt to Protocol: Fast Charging Batteries with Large Language Models
by: Lei, Ge, et al.
Published: (2026)
by: Lei, Ge, et al.
Published: (2026)
Applying BERT and ChatGPT for Sentiment Analysis of Lyme Disease in Scientific Literature
by: Susnjak, Teo
Published: (2023)
by: Susnjak, Teo
Published: (2023)
PromptCoT 2.0: Scaling Prompt Synthesis for Large Language Model Reasoning
by: Zhao, Xueliang, et al.
Published: (2025)
by: Zhao, Xueliang, et al.
Published: (2025)
Large Language Models for Software Engineering: A Reproducibility Crisis
by: Siddiq, Mohammed Latif, et al.
Published: (2025)
by: Siddiq, Mohammed Latif, et al.
Published: (2025)
Large Language Models Can Verbatim Reproduce Long Malicious Sequences
by: Lin, Sharon, et al.
Published: (2025)
by: Lin, Sharon, et al.
Published: (2025)
Prompt-Based Bias Calibration for Better Zero/Few-Shot Learning of Language Models
by: He, Kang, et al.
Published: (2024)
by: He, Kang, et al.
Published: (2024)
Confidence Calibration in Large Language Model-Based Entity Matching
by: Kamsteeg, Iris, et al.
Published: (2025)
by: Kamsteeg, Iris, et al.
Published: (2025)
Cache & Distil: Optimising API Calls to Large Language Models
by: Ramírez, Guillem, et al.
Published: (2023)
by: Ramírez, Guillem, et al.
Published: (2023)
Confidence Calibration in Large Language Models
by: Michael, Noam, et al.
Published: (2026)
by: Michael, Noam, et al.
Published: (2026)
Large-Scale Optimization Model Auto-Formulation: Harnessing LLM Flexibility via Structured Workflow
by: Liang, Kuo, et al.
Published: (2026)
by: Liang, Kuo, et al.
Published: (2026)
DataDreamer: A Tool for Synthetic Data Generation and Reproducible LLM Workflows
by: Patel, Ajay, et al.
Published: (2024)
by: Patel, Ajay, et al.
Published: (2024)
Human Alignment of Large Language Models through Online Preference Optimisation
by: Calandriello, Daniele, et al.
Published: (2024)
by: Calandriello, Daniele, et al.
Published: (2024)
Identifying Evidence-Based Nudges in Biomedical Literature with Large Language Models
by: Chauhan, Jaydeep, et al.
Published: (2026)
by: Chauhan, Jaydeep, et al.
Published: (2026)
Knowing What You Know Is Not Enough: Large Language Model Confidences Don't Align With Their Actions
by: Pal, Arka, et al.
Published: (2025)
by: Pal, Arka, et al.
Published: (2025)
Large Language Models for Constructing and Optimizing Machine Learning Workflows: A Survey
by: Gu, Yang, et al.
Published: (2024)
by: Gu, Yang, et al.
Published: (2024)
Improving Fairness of Large Language Model-Based ICU Mortality Prediction via Case-Based Prompting
by: Zhang, Gangxiong, et al.
Published: (2025)
by: Zhang, Gangxiong, et al.
Published: (2025)
Prompt Obfuscation for Large Language Models
by: Pape, David, et al.
Published: (2024)
by: Pape, David, et al.
Published: (2024)
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
by: Xiao, Jiancong, et al.
Published: (2025)
by: Xiao, Jiancong, et al.
Published: (2025)
Decoupled Conformal Optimisation: Efficient Prediction Sets via Independent Tuning and Calibration
by: Wu, Fanyi, et al.
Published: (2026)
by: Wu, Fanyi, et al.
Published: (2026)
Calibrated Large Language Models for Binary Question Answering
by: Giovannotti, Patrizio, et al.
Published: (2024)
by: Giovannotti, Patrizio, et al.
Published: (2024)
Thermometer: Towards Universal Calibration for Large Language Models
by: Shen, Maohao, et al.
Published: (2024)
by: Shen, Maohao, et al.
Published: (2024)
Automated Risk-of-Bias Assessment of Randomized Controlled Trials: A First Look at a GEPA-trained Programmatic Prompting Framework
by: Li, Lingbo, et al.
Published: (2025)
by: Li, Lingbo, et al.
Published: (2025)
Automatic Prompt Selection for Large Language Models
by: Do, Viet-Tung, et al.
Published: (2024)
by: Do, Viet-Tung, et al.
Published: (2024)
MIRROR: A Hierarchical Benchmark for Metacognitive Calibration in Large Language Models
by: Wang, Jason Z
Published: (2026)
by: Wang, Jason Z
Published: (2026)
Noise-Response Calibration: A Causal Intervention Protocol for LLM-Judges
by: Khomiakov, Maxim, et al.
Published: (2026)
by: Khomiakov, Maxim, et al.
Published: (2026)
Saliency-Aware Regularized Quantization Calibration for Large Language Models
by: Zhao, Yanlong, et al.
Published: (2026)
by: Zhao, Yanlong, et al.
Published: (2026)
OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models
by: Shao, Wenqi, et al.
Published: (2023)
by: Shao, Wenqi, et al.
Published: (2023)
Automatic Calibration for Membership Inference Attack on Large Language Models
by: Zade, Saleh Zare, et al.
Published: (2025)
by: Zade, Saleh Zare, et al.
Published: (2025)
Optimizing Prompts for Large Language Models: A Causal Approach
by: Chen, Wei, et al.
Published: (2026)
by: Chen, Wei, et al.
Published: (2026)
AutoFlow: Automated Workflow Generation for Large Language Model Agents
by: Li, Zelong, et al.
Published: (2024)
by: Li, Zelong, et al.
Published: (2024)
Graph Reasoning with Large Language Models via Pseudo-code Prompting
by: Skianis, Konstantinos, et al.
Published: (2024)
by: Skianis, Konstantinos, et al.
Published: (2024)
Similar Items
-
Compiling Prompts, Not Crafting Them: A Reproducible Workflow for AI-Assisted Evidence Synthesis
by: Susnjak, Teo
Published: (2025) -
When Predictions Shape Reality: A Socio-Technical Synthesis of Performative Predictions in Machine Learning
by: Fybish, Gal, et al.
Published: (2026) -
Transforming Evidence Synthesis: A Systematic Review of the Evolution of Automated Meta-Analysis in the Age of AI
by: Li, Lingbo, et al.
Published: (2025) -
What Level of Automation is "Good Enough"? A Benchmark of Large Language Models for Meta-Analysis Data Extraction
by: Li, Lingbo, et al.
Published: (2025) -
Image First or Text First? Optimising the Sequencing of Modalities in Large Language Model Prompting and Reasoning Tasks
by: Wardle, Grant, et al.
Published: (2024)