Mutation Testing via Iterative Large Language Model-Driven Scientific Debugging
Fuente:
arXiv
Saved in:
| Main Authors: | Straubinger, Philipp, Kreis, Marvin, Lukasczyk, Stephan, Fraser, Gordon |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Sojourner under Sabotage: A Serious Testing and Debugging Game
by: Straubinger, Philipp, et al.
Published: (2025)
by: Straubinger, Philipp, et al.
Published: (2025)
Teaching Software Testing and Debugging with the Serious Game Sojourner under Sabotage
by: Straubinger, Philipp, et al.
Published: (2025)
by: Straubinger, Philipp, et al.
Published: (2025)
Teaching Loop Testing to Young Learners with the Code Critters Mutation Testing Game
by: Straubinger, Philipp, et al.
Published: (2025)
by: Straubinger, Philipp, et al.
Published: (2025)
Search-based Hyperparameter Tuning for Python Unit Test Generation
by: Lukasczyk, Stephan, et al.
Published: (2025)
by: Lukasczyk, Stephan, et al.
Published: (2025)
Engaging Young Learners with Testing Using the Code Critters Mutation Game
by: Straubinger, Philipp, et al.
Published: (2024)
by: Straubinger, Philipp, et al.
Published: (2024)
Gamifying a Software Testing Course with Continuous Integration
by: Straubinger, Philipp, et al.
Published: (2024)
by: Straubinger, Philipp, et al.
Published: (2024)
Engaging Developers in Exploratory Unit Testing through Gamification
by: Straubinger, Philipp, et al.
Published: (2024)
by: Straubinger, Philipp, et al.
Published: (2024)
Combining Type Inference and Automated Unit Test Generation for Python
by: Krodinger, Lukas, et al.
Published: (2025)
by: Krodinger, Lukas, et al.
Published: (2025)
An IDE Plugin for Gamified Continuous Integration
by: Straubinger, Philipp, et al.
Published: (2024)
by: Straubinger, Philipp, et al.
Published: (2024)
Constraint-Guided Unit Test Generation for Machine Learning Libraries
by: Krodinger, Lukas, et al.
Published: (2025)
by: Krodinger, Lukas, et al.
Published: (2025)
IntelliGame in Action: An Experience Report on Gamifying JavaScript Unit Tests
by: Straubinger, Philipp, et al.
Published: (2024)
by: Straubinger, Philipp, et al.
Published: (2024)
An Empirical Evaluation of Manually Created Equivalent Mutants
by: Straubinger, Philipp, et al.
Published: (2024)
by: Straubinger, Philipp, et al.
Published: (2024)
Acknowledging Good Java Code with Code Perfumes
by: Straubinger, Philipp, et al.
Published: (2024)
by: Straubinger, Philipp, et al.
Published: (2024)
Gamifying Testing in IntelliJ: A Replicability Study
by: Straubinger, Philipp, et al.
Published: (2025)
by: Straubinger, Philipp, et al.
Published: (2025)
Real-World Fault Detection for C-Extended Python Projects with Automated Unit Test Generation
by: Berg, Lucas, et al.
Published: (2026)
by: Berg, Lucas, et al.
Published: (2026)
Unit Testing Past vs. Present: Examining LLMs' Impact on Defect Detection and Efficiency
by: Ramler, Rudolf, et al.
Published: (2025)
by: Ramler, Rudolf, et al.
Published: (2025)
AsserT5: Test Assertion Generation Using a Fine-Tuned Code Language Model
by: Primbs, Severin, et al.
Published: (2025)
by: Primbs, Severin, et al.
Published: (2025)
LLMorpheus: Mutation Testing using Large Language Models
by: Tip, Frank, et al.
Published: (2024)
by: Tip, Frank, et al.
Published: (2024)
Exceptional Behaviors: How Frequently Are They Tested?
by: Hora, Andre, et al.
Published: (2026)
by: Hora, Andre, et al.
Published: (2026)
Understanding Bug-Reproducing Tests: A First Empirical Study
by: Hora, Andre, et al.
Published: (2026)
by: Hora, Andre, et al.
Published: (2026)
Debugging Performance Issues in WebAssembly Runtimes via Mutation-based Inference
by: Zeng, Ruiying, et al.
Published: (2026)
by: Zeng, Ruiying, et al.
Published: (2026)
Debugging with Open-Source Large Language Models: An Evaluation
by: Majdoub, Yacine, et al.
Published: (2024)
by: Majdoub, Yacine, et al.
Published: (2024)
Mutation-Guided Unit Test Generation with a Large Language Model
by: Wang, Guancheng, et al.
Published: (2025)
by: Wang, Guancheng, et al.
Published: (2025)
SBFT Tool Competition 2024 -- Python Test Case Generation Track
by: Erni, Nicolas, et al.
Published: (2024)
by: Erni, Nicolas, et al.
Published: (2024)
RepoDebug: Repository-Level Multi-Task and Multi-Language Debugging Evaluation of Large Language Models
by: Liu, Jingjing, et al.
Published: (2025)
by: Liu, Jingjing, et al.
Published: (2025)
DebugBench: Evaluating Debugging Capability of Large Language Models
by: Tian, Runchu, et al.
Published: (2024)
by: Tian, Runchu, et al.
Published: (2024)
Hybrid Fault-Driven Mutation Testing for Python
by: Alimadadi, Saba, et al.
Published: (2026)
by: Alimadadi, Saba, et al.
Published: (2026)
Large Language Model Guided Self-Debugging Code Generation
by: Adnan, Muntasir, et al.
Published: (2025)
by: Adnan, Muntasir, et al.
Published: (2025)
A Comprehensive Study on Large Language Models for Mutation Testing
by: Wang, Bo, et al.
Published: (2024)
by: Wang, Bo, et al.
Published: (2024)
Improving Merge Pipeline Throughput in Continuous Integration via Pull Request Prioritization
by: Jungwirth, Maximilian, et al.
Published: (2025)
by: Jungwirth, Maximilian, et al.
Published: (2025)
RePurr: Automated Repair of Block-Based Learners' Programs
by: Schweikl, Sebastian, et al.
Published: (2025)
by: Schweikl, Sebastian, et al.
Published: (2025)
Leveraging Print Debugging to Improve Code Generation in Large Language Models
by: Hu, Xueyu, et al.
Published: (2024)
by: Hu, Xueyu, et al.
Published: (2024)
SmartC2Rust: Iterative, Feedback-Driven C-to-Rust Translation via Large Language Models for Safety and Equivalence
by: Shiraishi, Momoko, et al.
Published: (2024)
by: Shiraishi, Momoko, et al.
Published: (2024)
Guided Debugging of Auto-Translated Code Using Differential Testing
by: Wu, Shengnan, et al.
Published: (2025)
by: Wu, Shengnan, et al.
Published: (2025)
DebugRepair: Enhancing LLM-Based Automated Program Repair via Self-Directed Debugging
by: Wu, Linhao, et al.
Published: (2026)
by: Wu, Linhao, et al.
Published: (2026)
Synthesizing File-Level Data for Unit Test Generation with Chain-of-Thoughts via Self-Debugging
by: Hua, Ziyue, et al.
Published: (2026)
by: Hua, Ziyue, et al.
Published: (2026)
Fully Autonomous Programming using Iterative Multi-Agent Debugging with Large Language Models
by: Grishina, Anastasiia, et al.
Published: (2025)
by: Grishina, Anastasiia, et al.
Published: (2025)
Deep Learning Framework Testing via Model Mutation: How Far Are We?
by: Mu, Yanzhou, et al.
Published: (2025)
by: Mu, Yanzhou, et al.
Published: (2025)
Many-Objective Neuroevolution for Testing Games
by: Feldmeier, Patric, et al.
Published: (2025)
by: Feldmeier, Patric, et al.
Published: (2025)
Challenges and Practices in Quantum Software Testing and Debugging: Insights from Practitioners
by: Zappin, Jake, et al.
Published: (2025)
by: Zappin, Jake, et al.
Published: (2025)
Similar Items
-
Sojourner under Sabotage: A Serious Testing and Debugging Game
by: Straubinger, Philipp, et al.
Published: (2025) -
Teaching Software Testing and Debugging with the Serious Game Sojourner under Sabotage
by: Straubinger, Philipp, et al.
Published: (2025) -
Teaching Loop Testing to Young Learners with the Code Critters Mutation Testing Game
by: Straubinger, Philipp, et al.
Published: (2025) -
Search-based Hyperparameter Tuning for Python Unit Test Generation
by: Lukasczyk, Stephan, et al.
Published: (2025) -
Engaging Young Learners with Testing Using the Code Critters Mutation Game
by: Straubinger, Philipp, et al.
Published: (2024)