Evaluating and Mitigating Errors in LLM-Generated Web API Integrations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Maninger, Daniel, Chemnitz, Leon, Sharifloo, Amir Molzam, Lamba, Tushar, Brugger, Jannis, Mezini, Mira |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Where Do LLMs Still Struggle? An In-Depth Analysis of Code Generation Benchmarks
par: Sharifloo, Amir Molzam, et autres
Publié: (2025)
par: Sharifloo, Amir Molzam, et autres
Publié: (2025)
Deep Graph-Language Fusion for Structure-Aware Code Generation
par: Tiftikci, Mert, et autres
Publié: (2026)
par: Tiftikci, Mert, et autres
Publié: (2026)
Towards Trustworthy AI Software Development Assistance
par: Maninger, Daniel, et autres
Publié: (2023)
par: Maninger, Daniel, et autres
Publié: (2023)
Domain-Adaptable Reinforcement Learning for Code Generation with Dense Rewards
par: Jolfaei, Erfan Aghadavoodi, et autres
Publié: (2026)
par: Jolfaei, Erfan Aghadavoodi, et autres
Publié: (2026)
Automating API Documentation with LLMs: A BERTopic Approach
par: Naghshzan, AmirHossein
Publié: (2025)
par: Naghshzan, AmirHossein
Publié: (2025)
Integrating Symbolic Execution into the Fine-Tuning of Code-Generating LLMs
par: Sakharova, Marina, et autres
Publié: (2025)
par: Sakharova, Marina, et autres
Publié: (2025)
Automating REST API Postman Test Cases Using LLM
par: Sri, S Deepika, et autres
Publié: (2024)
par: Sri, S Deepika, et autres
Publié: (2024)
Beyond BLEU: A Semantic Evaluation Method for Code Translation
par: Näumann, Julius, et autres
Publié: (2026)
par: Näumann, Julius, et autres
Publié: (2026)
Supporting Error Chains in Static Analysis for Precise Evaluation Results and Enhanced Usability
par: Wickert, Anna-Katharina, et autres
Publié: (2024)
par: Wickert, Anna-Katharina, et autres
Publié: (2024)
A Comprehensive Framework for Evaluating API-oriented Code Generation in Large Language Models
par: Wu, Yixi, et autres
Publié: (2024)
par: Wu, Yixi, et autres
Publié: (2024)
MINES: Explainable Anomaly Detection through Web API Invariant Inference
par: Zhang, Wenjie, et autres
Publié: (2025)
par: Zhang, Wenjie, et autres
Publié: (2025)
CONCORD: Towards a DSL for Configurable Graph Code Representation
par: Saad, Mootez, et autres
Publié: (2024)
par: Saad, Mootez, et autres
Publié: (2024)
Untangling Knots: Leveraging LLM for Error Resolution in Computational Notebooks
par: Grotov, Konstantin, et autres
Publié: (2024)
par: Grotov, Konstantin, et autres
Publié: (2024)
MASTEST: A LLM-Based Multi-Agent System For RESTful API Tests
par: Han, Xiaoke, et autres
Publié: (2025)
par: Han, Xiaoke, et autres
Publié: (2025)
A Machine Learning-Based Error Mitigation Approach For Reliable Software Development On IBM'S Quantum Computers
par: Muqeet, Asmar, et autres
Publié: (2024)
par: Muqeet, Asmar, et autres
Publié: (2024)
ToolFactory: Automating Tool Generation by Leveraging LLM to Understand REST API Documentations
par: Ni, Xinyi, et autres
Publié: (2025)
par: Ni, Xinyi, et autres
Publié: (2025)
Face It Yourselves: An LLM-Based Two-Stage Strategy to Localize Configuration Errors via Logs
par: Shan, Shiwen, et autres
Publié: (2024)
par: Shan, Shiwen, et autres
Publié: (2024)
CodeSSM: Towards State Space Models for Code Understanding
par: Verma, Shweta, et autres
Publié: (2025)
par: Verma, Shweta, et autres
Publié: (2025)
Can LLMs Find Bugs in Code? An Evaluation from Beginner Errors to Security Vulnerabilities in Python and C++
par: Mhatre, Akshay, et autres
Publié: (2025)
par: Mhatre, Akshay, et autres
Publié: (2025)
Wisdom and Delusion of LLM Ensembles for Code Generation and Repair
par: Vallecillos-Ruiz, Fernando, et autres
Publié: (2025)
par: Vallecillos-Ruiz, Fernando, et autres
Publié: (2025)
Robust Learning of Diverse Code Edits
par: Aggarwal, Tushar, et autres
Publié: (2025)
par: Aggarwal, Tushar, et autres
Publié: (2025)
LLM Performance for Code Generation on Noisy Tasks
par: Sendyka, Radzim, et autres
Publié: (2025)
par: Sendyka, Radzim, et autres
Publié: (2025)
Polynomiogram: An Integrated Framework for Root Visualization and Generative Art
par: Nguyen, Hoang Duc, et autres
Publié: (2025)
par: Nguyen, Hoang Duc, et autres
Publié: (2025)
APITestGenie: Generating Web API Tests from Requirements and API Specifications with LLMs
par: Pereira, André, et autres
Publié: (2026)
par: Pereira, André, et autres
Publié: (2026)
Detecting Proxy Gaming in RL and LLM Alignment via Evaluator Stress Tests
par: Shihab, Ibne Farabi, et autres
Publié: (2025)
par: Shihab, Ibne Farabi, et autres
Publié: (2025)
Bridging the Clinical Expertise Gap: Development of a Web-Based Platform for Accessible Time Series Forecasting and Analysis
par: Mullen, Aaron D., et autres
Publié: (2025)
par: Mullen, Aaron D., et autres
Publié: (2025)
FuzzTheREST: An Intelligent Automated Black-box RESTful API Fuzzer
par: Dias, Tiago, et autres
Publié: (2024)
par: Dias, Tiago, et autres
Publié: (2024)
Code Roulette: How Prompt Variability Affects LLM Code Generation
par: Paleyes, Andrei, et autres
Publié: (2025)
par: Paleyes, Andrei, et autres
Publié: (2025)
PRIMG : Efficient LLM-driven Test Generation Using Mutant Prioritization
par: Bouafif, Mohamed Salah, et autres
Publié: (2025)
par: Bouafif, Mohamed Salah, et autres
Publié: (2025)
LLM-Powered Test Case Generation for Detecting Bugs in Plausible Programs
par: Liu, Kaibo, et autres
Publié: (2024)
par: Liu, Kaibo, et autres
Publié: (2024)
CWEval: Outcome-driven Evaluation on Functionality and Security of LLM Code Generation
par: Peng, Jinjun, et autres
Publié: (2025)
par: Peng, Jinjun, et autres
Publié: (2025)
Carbon Footprint Evaluation of Code Generation through LLM as a Service
par: Vartziotis, Tina, et autres
Publié: (2025)
par: Vartziotis, Tina, et autres
Publié: (2025)
Clotho: Measuring Task-Specific Pre-Generation Test Adequacy for LLM Inputs
par: Yoon, Juyeon, et autres
Publié: (2025)
par: Yoon, Juyeon, et autres
Publié: (2025)
Leveraging LLMs for Legacy Code Modernization: Challenges and Opportunities for LLM-Generated Documentation
par: Diggs, Colin, et autres
Publié: (2024)
par: Diggs, Colin, et autres
Publié: (2024)
SecureInfer: Heterogeneous TEE-GPU Architecture for Privacy-Critical Tensors for Large Language Model Deployment
par: Nayan, Tushar, et autres
Publié: (2025)
par: Nayan, Tushar, et autres
Publié: (2025)
Incoherence as Oracle-less Measure of Error in LLM-Based Code Generation
par: Valentin, Thomas, et autres
Publié: (2025)
par: Valentin, Thomas, et autres
Publié: (2025)
SmartOracle -- An Agentic Approach to Mitigate Noise in Differential Oracles
par: Srinivasan, Srinath, et autres
Publié: (2026)
par: Srinivasan, Srinath, et autres
Publié: (2026)
Evaluating LLM-Generated Obfuscated XSS Payloads for Machine Learning-Based Detection
par: Gabbireddy, Divyesh, et autres
Publié: (2026)
par: Gabbireddy, Divyesh, et autres
Publié: (2026)
A Survey on LLM-based Code Generation for Low-Resource and Domain-Specific Programming Languages
par: Joel, Sathvik, et autres
Publié: (2024)
par: Joel, Sathvik, et autres
Publié: (2024)
Code Less, Align More: Efficient LLM Fine-tuning for Code Generation with Data Pruning
par: Tsai, Yun-Da, et autres
Publié: (2024)
par: Tsai, Yun-Da, et autres
Publié: (2024)
Documents similaires
-
Where Do LLMs Still Struggle? An In-Depth Analysis of Code Generation Benchmarks
par: Sharifloo, Amir Molzam, et autres
Publié: (2025) -
Deep Graph-Language Fusion for Structure-Aware Code Generation
par: Tiftikci, Mert, et autres
Publié: (2026) -
Towards Trustworthy AI Software Development Assistance
par: Maninger, Daniel, et autres
Publié: (2023) -
Domain-Adaptable Reinforcement Learning for Code Generation with Dense Rewards
par: Jolfaei, Erfan Aghadavoodi, et autres
Publié: (2026) -
Automating API Documentation with LLMs: A BERTopic Approach
par: Naghshzan, AmirHossein
Publié: (2025)