Benchmarking Generative AI Models for Deep Learning Test Input Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Maryam, Biagiola, Matteo, Stocco, Andrea, Riccio, Vincenzo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Two is Better Than One: Digital Siblings to Improve Autonomous Driving Testing
di: Biagiola, Matteo, et al.
Pubblicazione: (2023)
di: Biagiola, Matteo, et al.
Pubblicazione: (2023)
Testing of Deep Reinforcement Learning Agents with Surrogate Models
di: Biagiola, Matteo, et al.
Pubblicazione: (2023)
di: Biagiola, Matteo, et al.
Pubblicazione: (2023)
Toward Efficient Testing of Graph Neural Networks via Test Input Prioritization
di: Yang, Lichen, et al.
Pubblicazione: (2025)
di: Yang, Lichen, et al.
Pubblicazione: (2025)
COMET: Coverage-guided Model Generation For Deep Learning Library Testing
di: Li, Meiziniu, et al.
Pubblicazione: (2022)
di: Li, Meiziniu, et al.
Pubblicazione: (2022)
Automated Generation of Issue-Reproducing Tests by Combining LLMs and Search-Based Testing
di: Kitsios, Konstantinos, et al.
Pubblicazione: (2025)
di: Kitsios, Konstantinos, et al.
Pubblicazione: (2025)
PALM: Path-aware LLM-based Test Generation with Comprehension
di: Wu, Yaoxuan, et al.
Pubblicazione: (2025)
di: Wu, Yaoxuan, et al.
Pubblicazione: (2025)
Multi-modal Traffic Scenario Generation for Autonomous Driving System Testing
di: Tu, Zhi, et al.
Pubblicazione: (2025)
di: Tu, Zhi, et al.
Pubblicazione: (2025)
CASCADE: Detecting Inconsistencies between Code and Documentation with Automatic Test Generation
di: Kiecker, Tobias, et al.
Pubblicazione: (2026)
di: Kiecker, Tobias, et al.
Pubblicazione: (2026)
Automated Test Generation from Program Documentation Encoded in Code Comments
di: Denaro, Giovanni, et al.
Pubblicazione: (2025)
di: Denaro, Giovanni, et al.
Pubblicazione: (2025)
Enhancing Differential Testing With LLMs For Testing Deep Learning Libraries
di: Li, Meiziniu, et al.
Pubblicazione: (2024)
di: Li, Meiziniu, et al.
Pubblicazione: (2024)
A Match Made in Heaven? AI-driven Matching of Vulnerabilities and Security Unit Tests
di: Iannone, Emanuele, et al.
Pubblicazione: (2025)
di: Iannone, Emanuele, et al.
Pubblicazione: (2025)
Tests4Py: A Benchmark for System Testing
di: Smytzek, Marius, et al.
Pubblicazione: (2023)
di: Smytzek, Marius, et al.
Pubblicazione: (2023)
Refining Fuzzed Crashing Inputs for Better Fault Diagnosis
di: Kim, Kieun, et al.
Pubblicazione: (2025)
di: Kim, Kieun, et al.
Pubblicazione: (2025)
SWE-ABS: Adversarial Benchmark Strengthening Exposes Inflated Success Rates on Test-based Benchmark
di: Yu, Boxi, et al.
Pubblicazione: (2026)
di: Yu, Boxi, et al.
Pubblicazione: (2026)
A Comprehensive Study on Large Language Models for Mutation Testing
di: Wang, Bo, et al.
Pubblicazione: (2024)
di: Wang, Bo, et al.
Pubblicazione: (2024)
LLM Based Input Space Partitioning Testing for Library APIs
di: Li, Jiageng, et al.
Pubblicazione: (2024)
di: Li, Jiageng, et al.
Pubblicazione: (2024)
E-Test: E'er-Improving Test Suites
di: Qiu, Ketai, et al.
Pubblicazione: (2025)
di: Qiu, Ketai, et al.
Pubblicazione: (2025)
A semantic mutation metric for metamorphic relation adequacy in scientific computing programs
di: Li, Meng, et al.
Pubblicazione: (2026)
di: Li, Meng, et al.
Pubblicazione: (2026)
Analyzing Quantum Programs with LintQ: A Static Analysis Framework for Qiskit
di: Paltenghi, Matteo, et al.
Pubblicazione: (2023)
di: Paltenghi, Matteo, et al.
Pubblicazione: (2023)
DeepCodeProbe: Towards Understanding What Models Trained on Code Learn
di: Majdinasab, Vahid, et al.
Pubblicazione: (2024)
di: Majdinasab, Vahid, et al.
Pubblicazione: (2024)
VLM-Fuzz: Vision Language Model Assisted Recursive Depth-first Search Exploration for Effective UI Testing of Android Apps
di: Demissie, Biniam Fisseha, et al.
Pubblicazione: (2025)
di: Demissie, Biniam Fisseha, et al.
Pubblicazione: (2025)
The Explabox: Model-Agnostic Machine Learning Transparency & Analysis
di: Robeer, Marcel, et al.
Pubblicazione: (2024)
di: Robeer, Marcel, et al.
Pubblicazione: (2024)
QITE: Assembly-Level, Cross-Platform Testing of Quantum Computing Platforms
di: Paltenghi, Matteo, et al.
Pubblicazione: (2025)
di: Paltenghi, Matteo, et al.
Pubblicazione: (2025)
HyperNet-Adaptation for Diffusion-Based Test Case Generation
di: Weißl, Oliver, et al.
Pubblicazione: (2026)
di: Weißl, Oliver, et al.
Pubblicazione: (2026)
A Catalog of Transformations to Remove Smells From Natural Language Tests
di: Aranda, Manoel, et al.
Pubblicazione: (2024)
di: Aranda, Manoel, et al.
Pubblicazione: (2024)
LibLMFuzz: LLM-Augmented Fuzz Target Generation for Black-box Libraries
di: Hardgrove, Ian, et al.
Pubblicazione: (2025)
di: Hardgrove, Ian, et al.
Pubblicazione: (2025)
How Do Developers Structure Unit Test Cases? An Empirical Study from the "AAA" Perspective
di: Wei, Chenhao, et al.
Pubblicazione: (2024)
di: Wei, Chenhao, et al.
Pubblicazione: (2024)
From Program Slices to Causal Clarity: Evaluating Faithful, Actionable LLM-Generated Failure Explanations via Context Partitioning and LLM-as-a-Judge
di: Porbeck, Julius, et al.
Pubblicazione: (2026)
di: Porbeck, Julius, et al.
Pubblicazione: (2026)
CoverUp: Effective High Coverage Test Generation for Python
di: Pizzorno, Juan Altmayer, et al.
Pubblicazione: (2024)
di: Pizzorno, Juan Altmayer, et al.
Pubblicazione: (2024)
Which Combination of Test Metrics Can Predict Success of a Software Project? A Case Study in a Year-Long Project Course
di: Filipovic, Marina, et al.
Pubblicazione: (2024)
di: Filipovic, Marina, et al.
Pubblicazione: (2024)
LSPRAG: LSP-Guided RAG for Language-Agnostic Real-Time Unit Test Generation
di: Go, Gwihwan, et al.
Pubblicazione: (2025)
di: Go, Gwihwan, et al.
Pubblicazione: (2025)
PICKLES: a Natural Language Framework for Requirement Specification and Model-Based Testing
di: Rodríguez, María Belén, et al.
Pubblicazione: (2026)
di: Rodríguez, María Belén, et al.
Pubblicazione: (2026)
SpecOps: A Fully Automated AI Agent Testing Framework in Real-World GUI Environments
di: Ahmed, Syed Yusuf, et al.
Pubblicazione: (2026)
di: Ahmed, Syed Yusuf, et al.
Pubblicazione: (2026)
Directed Grammar-Based Test Generation
di: Kirschner, Lukas, et al.
Pubblicazione: (2025)
di: Kirschner, Lukas, et al.
Pubblicazione: (2025)
Latent Regularization in Generative Test Input Generation
di: Merabishvili, Giorgi, et al.
Pubblicazione: (2026)
di: Merabishvili, Giorgi, et al.
Pubblicazione: (2026)
XMutant: XAI-based Fuzzing for Deep Learning Systems
di: Chen, Xingcheng, et al.
Pubblicazione: (2025)
di: Chen, Xingcheng, et al.
Pubblicazione: (2025)
Testing SSD Firmware with State Data-Aware Fuzzing: Accelerating Coverage in Nondeterministic I/O Environments
di: Yoon, Gangho, et al.
Pubblicazione: (2025)
di: Yoon, Gangho, et al.
Pubblicazione: (2025)
Autonomous QA Agent: A Retrieval-Augmented Framework for Reliable Selenium Script Generation
di: Vali, Dudekula Kasim
Pubblicazione: (2025)
di: Vali, Dudekula Kasim
Pubblicazione: (2025)
LLMORPH: Automated Metamorphic Testing of Large Language Models
di: Cho, Steven, et al.
Pubblicazione: (2026)
di: Cho, Steven, et al.
Pubblicazione: (2026)
In industrial embedded software, are some compilation errors easier to localize and fix than others?
di: Fu, Han, et al.
Pubblicazione: (2024)
di: Fu, Han, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Two is Better Than One: Digital Siblings to Improve Autonomous Driving Testing
di: Biagiola, Matteo, et al.
Pubblicazione: (2023) -
Testing of Deep Reinforcement Learning Agents with Surrogate Models
di: Biagiola, Matteo, et al.
Pubblicazione: (2023) -
Toward Efficient Testing of Graph Neural Networks via Test Input Prioritization
di: Yang, Lichen, et al.
Pubblicazione: (2025) -
COMET: Coverage-guided Model Generation For Deep Learning Library Testing
di: Li, Meiziniu, et al.
Pubblicazione: (2022) -
Automated Generation of Issue-Reproducing Tests by Combining LLMs and Search-Based Testing
di: Kitsios, Konstantinos, et al.
Pubblicazione: (2025)