A Dataset of Reproducible Flaky-Test Failures
Fuente:
arXiv
Guardado en:
| Autores principales: | Rafi, Suzzana, Sumon, Mahbub-Ul-Hoque, Erfan, Md, Khan, Maruf Morshed, Shi, August, Lam, Wing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Systematic Evaluation of Environmental Flakiness in JavaScript Tests
por: Hashemi, Negar, et al.
Publicado: (2026)
por: Hashemi, Negar, et al.
Publicado: (2026)
JS-TOD: Detecting Order-Dependent Flaky Tests in Jest
por: Hashemi, Negar, et al.
Publicado: (2025)
por: Hashemi, Negar, et al.
Publicado: (2025)
Detecting and Evaluating Order-Dependent Flaky Tests in JavaScript
por: Hashemi, Negar, et al.
Publicado: (2025)
por: Hashemi, Negar, et al.
Publicado: (2025)
The Effects of Computational Resources on Flaky Tests
por: Silva, Denini, et al.
Publicado: (2023)
por: Silva, Denini, et al.
Publicado: (2023)
Systemic Flakiness: An Empirical Analysis of Co-Occurring Flaky Test Failures
por: Parry, Owain, et al.
Publicado: (2025)
por: Parry, Owain, et al.
Publicado: (2025)
FlakyGuard: Automatically Fixing Flaky Tests at Industry Scale
por: Li, Chengpeng, et al.
Publicado: (2025)
por: Li, Chengpeng, et al.
Publicado: (2025)
NeuroFlake: A Neuro-Symbolic LLM Framework for Flaky Test Classification
por: Hoque, Khondaker Tasnia, et al.
Publicado: (2026)
por: Hoque, Khondaker Tasnia, et al.
Publicado: (2026)
230,439 Test Failures Later: An Empirical Evaluation of Flaky Failure Classifiers
por: Alshammari, Abdulrahman, et al.
Publicado: (2024)
por: Alshammari, Abdulrahman, et al.
Publicado: (2024)
On the Diagnosis of Flaky Job Failures: Understanding and Prioritizing Failure Categories
por: Aïdasso, Henri, et al.
Publicado: (2025)
por: Aïdasso, Henri, et al.
Publicado: (2025)
The Vocabulary of Flaky Tests in the Context of SAP HANA
por: Berndt, Alexander, et al.
Publicado: (2026)
por: Berndt, Alexander, et al.
Publicado: (2026)
FlakeRanker: Automated Identification and Prioritization of Flaky Job Failure Categories
por: Aïdasso, Henri
Publicado: (2025)
por: Aïdasso, Henri
Publicado: (2025)
Detecting Flaky Tests in Quantum Software: A Dynamic Approach
por: Kim, Dongchan, et al.
Publicado: (2025)
por: Kim, Dongchan, et al.
Publicado: (2025)
What Breaks When LLMs Code? Characterizing Operational Safety Failures of Agentic Code Assistants
por: Hasan, Alif Al, et al.
Publicado: (2026)
por: Hasan, Alif Al, et al.
Publicado: (2026)
A Generic Approach to Fix Test Flakiness in Real-World Projects
por: Chen, Yang, et al.
Publicado: (2024)
por: Chen, Yang, et al.
Publicado: (2024)
A Practical Framework for Flaky Failure Triage in Distributed Database Continuous Integration
por: Zhu, Jun-Peng, et al.
Publicado: (2026)
por: Zhu, Jun-Peng, et al.
Publicado: (2026)
Reduction of Test Re-runs by Prioritizing Potential Order Dependent Flaky Tests
por: Iqbal, Hasnain, et al.
Publicado: (2025)
por: Iqbal, Hasnain, et al.
Publicado: (2025)
A Preliminary Study of Fixed Flaky Tests in Rust Projects on GitHub
por: Schroeder, Tom, et al.
Publicado: (2025)
por: Schroeder, Tom, et al.
Publicado: (2025)
Dockerfile Flakiness: Characterization and Repair
por: Shabani, Taha, et al.
Publicado: (2024)
por: Shabani, Taha, et al.
Publicado: (2024)
On the Flakiness of LLM-Generated Tests for Industrial and Open-Source Database Management Systems
por: Berndt, Alexander, et al.
Publicado: (2026)
por: Berndt, Alexander, et al.
Publicado: (2026)
Automated Test Validators for Flaky Cyber-Physical System Simulators: Approach and Evaluation
por: Jodat, Baharin A., et al.
Publicado: (2025)
por: Jodat, Baharin A., et al.
Publicado: (2025)
Do Test and Environmental Complexity Increase Flakiness? An Empirical Study of SAP HANA
por: Berndt, Alexander, et al.
Publicado: (2024)
por: Berndt, Alexander, et al.
Publicado: (2024)
Can We Classify Flaky Tests Using Only Test Code? An LLM-Based Empirical Study
por: Berndt, Alexander, et al.
Publicado: (2026)
por: Berndt, Alexander, et al.
Publicado: (2026)
FlakyFix: Using Large Language Models for Predicting Flaky Test Fix Categories and Test Code Repair
por: Fatima, Sakina, et al.
Publicado: (2023)
por: Fatima, Sakina, et al.
Publicado: (2023)
Approaching Code Search for Python as a Translation Retrieval Problem with Dual Encoders
por: Khan, Monoshiz Mahbub, et al.
Publicado: (2024)
por: Khan, Monoshiz Mahbub, et al.
Publicado: (2024)
Identifying Flaky Tests in Quantum Code: A Machine Learning Approach
por: Kaur, Khushdeep, et al.
Publicado: (2025)
por: Kaur, Khushdeep, et al.
Publicado: (2025)
WEFix: Intelligent Automatic Generation of Explicit Waits for Efficient Web End-to-End Flaky Tests
por: Liu, Xinyue, et al.
Publicado: (2024)
por: Liu, Xinyue, et al.
Publicado: (2024)
Detecting and Mitigating Flakiness in REST API Fuzzing
por: Zhang, Man, et al.
Publicado: (2026)
por: Zhang, Man, et al.
Publicado: (2026)
A Dataset For Computational Reproducibility
por: Costa, Lázaro, et al.
Publicado: (2025)
por: Costa, Lázaro, et al.
Publicado: (2025)
FlaKat: A Machine Learning-Based Categorization Framework for Flaky Tests
por: Lin, Shizhe, et al.
Publicado: (2024)
por: Lin, Shizhe, et al.
Publicado: (2024)
Taming Timeout Flakiness: An Empirical Study of SAP HANA
por: Berndt, Alexander, et al.
Publicado: (2024)
por: Berndt, Alexander, et al.
Publicado: (2024)
Cross-Project Flakiness: A Case Study of the OpenStack Ecosystem
por: Xiao, Tao, et al.
Publicado: (2026)
por: Xiao, Tao, et al.
Publicado: (2026)
A Large Language Model Approach to Identify Flakiness in C++ Projects
por: Sun, Xin, et al.
Publicado: (2024)
por: Sun, Xin, et al.
Publicado: (2024)
Flaky Tests in a Large Industrial Database Management System: An Empirical Study of Fixed Issue Reports for SAP HANA
por: Berndt, Alexander, et al.
Publicado: (2026)
por: Berndt, Alexander, et al.
Publicado: (2026)
Java JIT Testing with Template Extraction
por: Zang, Zhiqiang, et al.
Publicado: (2024)
por: Zang, Zhiqiang, et al.
Publicado: (2024)
SBEST: Spectrum-Based Fault Localization Without Fault-Triggering Tests
por: Rafi, Md Nakhla, et al.
Publicado: (2024)
por: Rafi, Md Nakhla, et al.
Publicado: (2024)
Automating Detection and Root-Cause Analysis of Flaky Tests in Quantum Software
por: Sivaloganathan, Janakan, et al.
Publicado: (2026)
por: Sivaloganathan, Janakan, et al.
Publicado: (2026)
ReproBreak: A Dataset of Reproducible Web Locator Breaks
por: de Moura, Thiago Santos, et al.
Publicado: (2026)
por: de Moura, Thiago Santos, et al.
Publicado: (2026)
GHTraffic: A Dataset for Reproducible Research in Service-Oriented Computing
por: Bhagya, Thilini, et al.
Publicado: (2018)
por: Bhagya, Thilini, et al.
Publicado: (2018)
Bias Testing and Mitigation in Black Box LLMs using Metamorphic Relations
por: Salimian, Sina, et al.
Publicado: (2025)
por: Salimian, Sina, et al.
Publicado: (2025)
Understanding Bug-Reproducing Tests: A First Empirical Study
por: Hora, Andre, et al.
Publicado: (2026)
por: Hora, Andre, et al.
Publicado: (2026)
Ejemplares similares
-
A Systematic Evaluation of Environmental Flakiness in JavaScript Tests
por: Hashemi, Negar, et al.
Publicado: (2026) -
JS-TOD: Detecting Order-Dependent Flaky Tests in Jest
por: Hashemi, Negar, et al.
Publicado: (2025) -
Detecting and Evaluating Order-Dependent Flaky Tests in JavaScript
por: Hashemi, Negar, et al.
Publicado: (2025) -
The Effects of Computational Resources on Flaky Tests
por: Silva, Denini, et al.
Publicado: (2023) -
Systemic Flakiness: An Empirical Analysis of Co-Occurring Flaky Test Failures
por: Parry, Owain, et al.
Publicado: (2025)