Efficient Detection of Intermittent Job Failures Using Few-Shot Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Aïdasso, Henri, Bordeleau, Francis, Tizghadam, Ali |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Predicting Intermittent Job Failure Categories for Diagnosis Using Few-Shot Fine-Tuned Language Models
by: Aïdasso, Henri, et al.
Published: (2026)
by: Aïdasso, Henri, et al.
Published: (2026)
Towards Build Optimization Using Digital Twins
by: Aïdasso, Henri, et al.
Published: (2025)
by: Aïdasso, Henri, et al.
Published: (2025)
On the Diagnosis of Flaky Job Failures: Understanding and Prioritizing Failure Categories
by: Aïdasso, Henri, et al.
Published: (2025)
by: Aïdasso, Henri, et al.
Published: (2025)
On the Illusion of Success: An Empirical Study of Build Reruns and Silent Failures in Industrial CI
by: Aïdasso, Henri, et al.
Published: (2025)
by: Aïdasso, Henri, et al.
Published: (2025)
On The Impact of Merge Request Deviations on Code Review Practices
by: Kansab, Samah, et al.
Published: (2025)
by: Kansab, Samah, et al.
Published: (2025)
Build Optimization: A Systematic Literature Review
by: Aïdasso, Henri, et al.
Published: (2025)
by: Aïdasso, Henri, et al.
Published: (2025)
FlakeRanker: Automated Identification and Prioritization of Flaky Job Failure Categories
by: Aïdasso, Henri
Published: (2025)
by: Aïdasso, Henri
Published: (2025)
RevMine: An LLM-Assisted Tool for Code Review Mining and Analysis Across Git Platforms
by: Kansab, Samah, et al.
Published: (2025)
by: Kansab, Samah, et al.
Published: (2025)
An Empirical Study on the Amount of Changes Required for Merge Request Acceptance
by: Kansab, Samah, et al.
Published: (2025)
by: Kansab, Samah, et al.
Published: (2025)
Analyzing DevOps Practices Through Merge Request Data: A Case Study in Networking Software Company
by: Kansab, Samah, et al.
Published: (2025)
by: Kansab, Samah, et al.
Published: (2025)
Does Few-Shot Learning Help LLM Performance in Code Synthesis?
by: Xu, Derek, et al.
Published: (2024)
by: Xu, Derek, et al.
Published: (2024)
Mass-Producing Failures of Multimodal Systems with Language Models
by: Tong, Shengbang, et al.
Published: (2023)
by: Tong, Shengbang, et al.
Published: (2023)
SERA: Soft-Verified Efficient Repository Agents
by: Shen, Ethan, et al.
Published: (2026)
by: Shen, Ethan, et al.
Published: (2026)
GrowthHacker: Automated Off-Policy Evaluation Optimization Using Code-Modifying LLM Agents
by: Wu, Jie JW, et al.
Published: (2025)
by: Wu, Jie JW, et al.
Published: (2025)
Suggesting Code Edits in Interactive Machine Learning Notebooks Using Large Language Models
by: Jin, Bihui, et al.
Published: (2025)
by: Jin, Bihui, et al.
Published: (2025)
Evaluating Language Models for Efficient Code Generation
by: Liu, Jiawei, et al.
Published: (2024)
by: Liu, Jiawei, et al.
Published: (2024)
Evaluation and Improvement of Fault Detection for Large Language Models
by: Hu, Qiang, et al.
Published: (2024)
by: Hu, Qiang, et al.
Published: (2024)
Quality Matters: Evaluating Synthetic Data for Tool-Using LLMs
by: Iskander, Shadi, et al.
Published: (2024)
by: Iskander, Shadi, et al.
Published: (2024)
Exploring Parameter-Efficient Fine-Tuning Techniques for Code Generation with Large Language Models
by: Weyssow, Martin, et al.
Published: (2023)
by: Weyssow, Martin, et al.
Published: (2023)
LeetCodeDataset: A Temporal Dataset for Robust Evaluation and Efficient Training of Code LLMs
by: Xia, Yunhui, et al.
Published: (2025)
by: Xia, Yunhui, et al.
Published: (2025)
Refining GPT-3 Embeddings with a Siamese Structure for Technical Post Duplicate Detection
by: Wu, Xingfang, et al.
Published: (2023)
by: Wu, Xingfang, et al.
Published: (2023)
Automatic Pull Request Description Generation Using LLMs: A T5 Model Approach
by: Sakib, Md Nazmus, et al.
Published: (2024)
by: Sakib, Md Nazmus, et al.
Published: (2024)
Learning Code Preference via Synthetic Evolution
by: Liu, Jiawei, et al.
Published: (2024)
by: Liu, Jiawei, et al.
Published: (2024)
Towards Understanding What Code Language Models Learned
by: Ahmed, Toufique, et al.
Published: (2023)
by: Ahmed, Toufique, et al.
Published: (2023)
Training Long-Context, Multi-Turn Software Engineering Agents with Reinforcement Learning
by: Golubev, Alexander, et al.
Published: (2025)
by: Golubev, Alexander, et al.
Published: (2025)
WebGen-R1: Incentivizing Large Language Models to Generate Functional and Aesthetic Websites with Reinforcement Learning
by: Jiang, Juyong, et al.
Published: (2026)
by: Jiang, Juyong, et al.
Published: (2026)
ReflexiCoder: Teaching Large Language Models to Self-Reflect on Generated Code and Self-Correct It via Reinforcement Learning
by: Jiang, Juyong, et al.
Published: (2026)
by: Jiang, Juyong, et al.
Published: (2026)
Understanding Formal Reasoning Failures in LLMs as Abstract Interpreters
by: Mitchell, Jacqueline L., et al.
Published: (2025)
by: Mitchell, Jacqueline L., et al.
Published: (2025)
On the Potential and Limitations of Few-Shot In-Context Learning to Generate Metamorphic Specifications for Tax Preparation Software
by: Srinivas, Dananjay, et al.
Published: (2023)
by: Srinivas, Dananjay, et al.
Published: (2023)
Retrieval-Augmented Few-Shot Prompting Versus Fine-Tuning for Code Vulnerability Detection
by: Trad, Fouad, et al.
Published: (2025)
by: Trad, Fouad, et al.
Published: (2025)
Evaluating the Process Modeling Abilities of Large Language Models -- Preliminary Foundations and Results
by: Fettke, Peter, et al.
Published: (2025)
by: Fettke, Peter, et al.
Published: (2025)
Code Review Without Borders: Evaluating Synthetic vs. Real Data for Review Recommendation
by: Cohen, Yogev, et al.
Published: (2025)
by: Cohen, Yogev, et al.
Published: (2025)
SODBench: A Large Language Model Approach to Documenting Spreadsheet Operations
by: Indika, Amila, et al.
Published: (2025)
by: Indika, Amila, et al.
Published: (2025)
CWEval: Outcome-driven Evaluation on Functionality and Security of LLM Code Generation
by: Peng, Jinjun, et al.
Published: (2025)
by: Peng, Jinjun, et al.
Published: (2025)
Sense and Sensitivity: Examining the Influence of Semantic Recall on Long Context Code Reasoning
by: Štorek, Adam, et al.
Published: (2025)
by: Štorek, Adam, et al.
Published: (2025)
EVALOOOP: A Self-Consistency-Centered Framework for Assessing Large Language Model Robustness in Programming
by: Fang, Sen, et al.
Published: (2025)
by: Fang, Sen, et al.
Published: (2025)
GLLM: Self-Corrective G-Code Generation using Large Language Models with User Feedback
by: Abdelaal, Mohamed, et al.
Published: (2025)
by: Abdelaal, Mohamed, et al.
Published: (2025)
Sentiment Analysis in Software Engineering: Evaluating Generative Pre-trained Transformers
by: Saifullah, KM Khalid, et al.
Published: (2025)
by: Saifullah, KM Khalid, et al.
Published: (2025)
Optimizing Case-Based Reasoning System for Functional Test Script Generation with Large Language Models
by: Guo, Siyuan, et al.
Published: (2025)
by: Guo, Siyuan, et al.
Published: (2025)
A Semantic-based Optimization Approach for Repairing LLMs: Case Study on Code Generation
by: Gu, Jian, et al.
Published: (2025)
by: Gu, Jian, et al.
Published: (2025)
Similar Items
-
Predicting Intermittent Job Failure Categories for Diagnosis Using Few-Shot Fine-Tuned Language Models
by: Aïdasso, Henri, et al.
Published: (2026) -
Towards Build Optimization Using Digital Twins
by: Aïdasso, Henri, et al.
Published: (2025) -
On the Diagnosis of Flaky Job Failures: Understanding and Prioritizing Failure Categories
by: Aïdasso, Henri, et al.
Published: (2025) -
On the Illusion of Success: An Empirical Study of Build Reruns and Silent Failures in Industrial CI
by: Aïdasso, Henri, et al.
Published: (2025) -
On The Impact of Merge Request Deviations on Code Review Practices
by: Kansab, Samah, et al.
Published: (2025)