CARGO: A Framework for Confidence-Aware Routing of Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Barrak, Amine, Fourati, Yosr, Olchawa, Michael, Ksontini, Emna, Zoghlami, Khalil |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
From REST to MCP: An Empirical Study of API Wrapping and Automated Server Generation for LLM Agents
by: Mastouri, Meriem, et al.
Published: (2025)
by: Mastouri, Meriem, et al.
Published: (2025)
FaaSGuard: Secure CI/CD for Serverless Applications -- An OpenFaaS Case Study
by: Barrak, Amine, et al.
Published: (2025)
by: Barrak, Amine, et al.
Published: (2025)
Scalable and Cost-Efficient ML Inference: Parallel Batch Processing with Serverless Functions
by: Barrak, Amine, et al.
Published: (2025)
by: Barrak, Amine, et al.
Published: (2025)
Traceability and Accountability in Role-Specialized Multi-Agent LLM Pipelines
by: Barrak, Amine
Published: (2025)
by: Barrak, Amine
Published: (2025)
Refactoring for Dockerfile Quality: A Dive into Developer Practices and Automation Potential
by: Ksontini, Emna, et al.
Published: (2025)
by: Ksontini, Emna, et al.
Published: (2025)
PromSec: Prompt Optimization for Secure Generation of Functional Source Code with Large Language Models (LLMs)
by: Nazzal, Mahmoud, et al.
Published: (2024)
by: Nazzal, Mahmoud, et al.
Published: (2024)
Large Language Models Should Ask Clarifying Questions to Increase Confidence in Generated Code
by: Wu, Jie JW
Published: (2023)
by: Wu, Jie JW
Published: (2023)
Fuzz4All: Universal Fuzzing with Large Language Models
by: Xia, Chunqiu Steven, et al.
Published: (2023)
by: Xia, Chunqiu Steven, et al.
Published: (2023)
Large Language Models for Software Engineering: A Reproducibility Crisis
by: Siddiq, Mohammed Latif, et al.
Published: (2025)
by: Siddiq, Mohammed Latif, et al.
Published: (2025)
Fault Localization via Fine-tuning Large Language Models with Mutation Generated Stack Traces
by: Jambigi, Neetha, et al.
Published: (2025)
by: Jambigi, Neetha, et al.
Published: (2025)
Unlearning Trojans in Large Language Models: A Comparison Between Natural Language and Source Code
by: Kazemi, Mahdi, et al.
Published: (2024)
by: Kazemi, Mahdi, et al.
Published: (2024)
Towards a Small Language Model Lifecycle Framework
by: Miraghaei, Parsa, et al.
Published: (2025)
by: Miraghaei, Parsa, et al.
Published: (2025)
Integrating Large Language Models for Automated Structural Analysis
by: Liang, Haoran, et al.
Published: (2025)
by: Liang, Haoran, et al.
Published: (2025)
When Your LLM Reaches End-of-Life: A Framework for Confident Model Migration in Production Systems
by: Casey, Emma, et al.
Published: (2026)
by: Casey, Emma, et al.
Published: (2026)
AssertionBench: A Benchmark to Evaluate Large-Language Models for Assertion Generation
by: Pulavarthi, Vaishnavi, et al.
Published: (2024)
by: Pulavarthi, Vaishnavi, et al.
Published: (2024)
Revisiting the Plastic Surgery Hypothesis via Large Language Models
by: Xia, Chunqiu Steven, et al.
Published: (2023)
by: Xia, Chunqiu Steven, et al.
Published: (2023)
Uncertainty Awareness of Large Language Models Under Code Distribution Shifts: A Benchmark Study
by: Li, Yufei, et al.
Published: (2024)
by: Li, Yufei, et al.
Published: (2024)
LEANCODE: Understanding Models Better for Code Simplification of Pre-trained Large Language Models
by: Wang, Yan, et al.
Published: (2025)
by: Wang, Yan, et al.
Published: (2025)
Applying Large Language Models to Issue Classification: Revisiting with Extended Data and New Models
by: Aracena, Gabriel, et al.
Published: (2025)
by: Aracena, Gabriel, et al.
Published: (2025)
Enhancing Large Language Models with Faster Code Preprocessing for Vulnerability Detection
by: Gonçalves, José, et al.
Published: (2025)
by: Gonçalves, José, et al.
Published: (2025)
Using Large Language Models to Generate JUnit Tests: An Empirical Study
by: Siddiq, Mohammed Latif, et al.
Published: (2023)
by: Siddiq, Mohammed Latif, et al.
Published: (2023)
Large Language Models for Analyzing Enterprise Architecture Debt in Unstructured Documentation
by: Pagels, Christin, et al.
Published: (2026)
by: Pagels, Christin, et al.
Published: (2026)
Large Language Models for Code Generation: A Comprehensive Survey of Challenges, Techniques, Evaluation, and Applications
by: Huynh, Nam, et al.
Published: (2025)
by: Huynh, Nam, et al.
Published: (2025)
Code Graph Model (CGM): A Graph-Integrated Large Language Model for Repository-Level Software Engineering Tasks
by: Tao, Hongyuan, et al.
Published: (2025)
by: Tao, Hongyuan, et al.
Published: (2025)
A Comprehensive Framework for Evaluating API-oriented Code Generation in Large Language Models
by: Wu, Yixi, et al.
Published: (2024)
by: Wu, Yixi, et al.
Published: (2024)
Correctness Assessment of Code Generated by Large Language Models Using Internal Representations
by: Bui, Tuan-Dung, et al.
Published: (2025)
by: Bui, Tuan-Dung, et al.
Published: (2025)
CodeIF: Benchmarking the Instruction-Following Capabilities of Large Language Models for Code Generation
by: Yan, Kaiwen, et al.
Published: (2025)
by: Yan, Kaiwen, et al.
Published: (2025)
An Exploratory Investigation into Code License Infringements in Large Language Model Training Datasets
by: Katzy, Jonathan, et al.
Published: (2024)
by: Katzy, Jonathan, et al.
Published: (2024)
InfiBench: Evaluating the Question-Answering Capabilities of Code Large Language Models
by: Li, Linyi, et al.
Published: (2024)
by: Li, Linyi, et al.
Published: (2024)
Trojans in Large Language Models of Code: A Critical Review through a Trigger-Based Taxonomy
by: Hussain, Aftab, et al.
Published: (2024)
by: Hussain, Aftab, et al.
Published: (2024)
Applying the Chinese Wall Reverse Engineering Technique to Large Language Model Code Editing
by: Hanmongkolchai, Manatsawin
Published: (2025)
by: Hanmongkolchai, Manatsawin
Published: (2025)
EVALOOOP: A Self-Consistency-Centered Framework for Assessing Large Language Model Robustness in Programming
by: Fang, Sen, et al.
Published: (2025)
by: Fang, Sen, et al.
Published: (2025)
Effort and Size Estimation in Software Projects with Large Language Model-based Intelligent Interfaces
by: Coelho Jr, Claudionor N., et al.
Published: (2024)
by: Coelho Jr, Claudionor N., et al.
Published: (2024)
LLM-Enhanced Log Anomaly Detection: A Comprehensive Benchmark of Large Language Models for Automated System Diagnostics
by: Patel, Disha
Published: (2026)
by: Patel, Disha
Published: (2026)
MLXP: A Framework for Conducting Replicable Experiments in Python
by: Arbel, Michael, et al.
Published: (2024)
by: Arbel, Michael, et al.
Published: (2024)
Automatic Programming: Large Language Models and Beyond
by: Lyu, Michael R., et al.
Published: (2024)
by: Lyu, Michael R., et al.
Published: (2024)
IDE-Bench: Evaluating Large Language Models as IDE Agents on Real-World Software Engineering Tasks
by: Mateega, Spencer, et al.
Published: (2026)
by: Mateega, Spencer, et al.
Published: (2026)
Calibration and Correctness of Language Models for Code
by: Spiess, Claudio, et al.
Published: (2024)
by: Spiess, Claudio, et al.
Published: (2024)
HackerRank-ASTRA: Evaluating Correctness & Consistency of Large Language Models on cross-domain multi-file project problems
by: Xing, Jun, et al.
Published: (2025)
by: Xing, Jun, et al.
Published: (2025)
FGDM: Reasoning Aware Multi-Agentic Framework for Software Bug Detection using Chain of Thought and Tree of Thought Prompting
by: Padmanabhuni, Srita, et al.
Published: (2026)
by: Padmanabhuni, Srita, et al.
Published: (2026)
Similar Items
-
From REST to MCP: An Empirical Study of API Wrapping and Automated Server Generation for LLM Agents
by: Mastouri, Meriem, et al.
Published: (2025) -
FaaSGuard: Secure CI/CD for Serverless Applications -- An OpenFaaS Case Study
by: Barrak, Amine, et al.
Published: (2025) -
Scalable and Cost-Efficient ML Inference: Parallel Batch Processing with Serverless Functions
by: Barrak, Amine, et al.
Published: (2025) -
Traceability and Accountability in Role-Specialized Multi-Agent LLM Pipelines
by: Barrak, Amine
Published: (2025) -
Refactoring for Dockerfile Quality: A Dive into Developer Practices and Automation Potential
by: Ksontini, Emna, et al.
Published: (2025)