Large Language Models for Unit Test Generation: Achievements, Challenges, and Opportunities
Fuente:
arXiv
Saved in:
| Main Authors: | Chu, Bei, Feng, Yang, Liu, Kui, Guo, Zhaoqiang, Zhang, Yichi, Shi, Hange, Nan, Zifan, Xu, Baowen |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
PALM: Synergizing Program Analysis and LLMs to Enhance Rust Unit Test Coverage
by: Chu, Bei, et al.
Published: (2025)
by: Chu, Bei, et al.
Published: (2025)
Mutation-Guided Unit Test Generation with a Large Language Model
by: Wang, Guancheng, et al.
Published: (2025)
by: Wang, Guancheng, et al.
Published: (2025)
A Roadmap on Modern Code Review: Challenges and Opportunities
by: Yang, Zezhou, et al.
Published: (2024)
by: Yang, Zezhou, et al.
Published: (2024)
On the Evaluation of Large Language Models in Unit Test Generation
by: Yang, Lin, et al.
Published: (2024)
by: Yang, Lin, et al.
Published: (2024)
PR-Aware Automated Unit Test Generation: Challenges and Opportunities
by: Haratian, Vahid, et al.
Published: (2026)
by: Haratian, Vahid, et al.
Published: (2026)
Call-Chain-Aware LLM-Based Test Generation for Java Projects
by: Wang, Guancheng, et al.
Published: (2026)
by: Wang, Guancheng, et al.
Published: (2026)
Reflective Unit Test Generation for Precise Type Error Detection with Large Language Models
by: Yang, Chen, et al.
Published: (2025)
by: Yang, Chen, et al.
Published: (2025)
MultiTest: Physical-Aware Object Insertion for Testing Multi-sensor Fusion Perception Systems
by: Gao, Xinyu, et al.
Published: (2024)
by: Gao, Xinyu, et al.
Published: (2024)
Clean Code In Practice: Challenges and Opportunities
by: Yan, Dapeng, et al.
Published: (2025)
by: Yan, Dapeng, et al.
Published: (2025)
An Empirical Study of Retrieval-Augmented Code Generation: Challenges and Opportunities
by: Yang, Zezhou, et al.
Published: (2025)
by: Yang, Zezhou, et al.
Published: (2025)
TESTEVAL: Benchmarking Large Language Models for Test Case Generation
by: Wang, Wenhan, et al.
Published: (2024)
by: Wang, Wenhan, et al.
Published: (2024)
Large Language Models for Unit Testing: A Systematic Literature Review
by: Zhang, Quanjun, et al.
Published: (2025)
by: Zhang, Quanjun, et al.
Published: (2025)
Automated Unit Test Improvement using Large Language Models at Meta
by: Alshahwan, Nadia, et al.
Published: (2024)
by: Alshahwan, Nadia, et al.
Published: (2024)
Leveraging Large Language Models for Enhancing the Understandability of Generated Unit Tests
by: Deljouyi, Amirhossein, et al.
Published: (2024)
by: Deljouyi, Amirhossein, et al.
Published: (2024)
Seed&Steer: Guiding Large Language Models with Compilable Prefix and Branch Signals for Unit Test Generation
by: Zhou, Shuaiyu, et al.
Published: (2025)
by: Zhou, Shuaiyu, et al.
Published: (2025)
A Large-scale Empirical Study on Fine-tuning Large Language Models for Unit Testing
by: Shang, Ye, et al.
Published: (2024)
by: Shang, Ye, et al.
Published: (2024)
Navigating the Labyrinth: Path-Sensitive Unit Test Generation with Large Language Models
by: Liao, Dianshu, et al.
Published: (2025)
by: Liao, Dianshu, et al.
Published: (2025)
PanicFI: An Infrastructure for Fixing Panic Bugs in Real-World Rust Programs
by: Ni, Yunbo, et al.
Published: (2024)
by: Ni, Yunbo, et al.
Published: (2024)
A System for Automated Unit Test Generation Using Large Language Models and Assessment of Generated Test Suites
by: Lops, Andrea, et al.
Published: (2024)
by: Lops, Andrea, et al.
Published: (2024)
Evaluating Large Language Models for the Generation of Unit Tests with Equivalence Partitions and Boundary Values
by: Rodríguez, Martín, et al.
Published: (2025)
by: Rodríguez, Martín, et al.
Published: (2025)
Test vs Mutant: Adversarial LLM Agents for Robust Unit Test Generation
by: Chang, Pengyu, et al.
Published: (2026)
by: Chang, Pengyu, et al.
Published: (2026)
Test smells in LLM-Generated Unit Tests
by: Ouédraogo, Wendkûuni C., et al.
Published: (2024)
by: Ouédraogo, Wendkûuni C., et al.
Published: (2024)
Vibe Modeling: Challenges and Opportunities
by: Cabot, Jordi
Published: (2025)
by: Cabot, Jordi
Published: (2025)
CasModaTest: A Cascaded and Model-agnostic Self-directed Framework for Unit Test Generation
by: Ni, Chao, et al.
Published: (2024)
by: Ni, Chao, et al.
Published: (2024)
Bridging Code Graphs and Large Language Models for Better Code Understanding
by: Chen, Zeqi, et al.
Published: (2025)
by: Chen, Zeqi, et al.
Published: (2025)
Automated Unit Test Refactoring
by: Gao, Yi, et al.
Published: (2024)
by: Gao, Yi, et al.
Published: (2024)
Impact of Code Context and Prompting Strategies on Automated Unit Test Generation with Modern General-Purpose Large Language Models
by: Walczak, Jakub, et al.
Published: (2025)
by: Walczak, Jakub, et al.
Published: (2025)
Automatically Generating Single-Responsibility Unit Tests
by: Galindo-Gutierrez, Geraldine
Published: (2025)
by: Galindo-Gutierrez, Geraldine
Published: (2025)
Uncovering Business Logic Bugs via Semantics-Driven Unit Test Generation
by: Yang, Chen, et al.
Published: (2026)
by: Yang, Chen, et al.
Published: (2026)
Comparative Evaluation of Large Language Models for Test-Skeleton Generation
by: Boorlagadda, Subhang, et al.
Published: (2025)
by: Boorlagadda, Subhang, et al.
Published: (2025)
Quality Assessment of Python Tests Generated by Large Language Models
by: Alves, Victor, et al.
Published: (2025)
by: Alves, Victor, et al.
Published: (2025)
Hallucination to Consensus: Multi-Agent LLMs for End-to-End JUnit Test Generation
by: Xu, Qinghua, et al.
Published: (2025)
by: Xu, Qinghua, et al.
Published: (2025)
DistillSeq: A Framework for Safety Alignment Testing in Large Language Models using Knowledge Distillation
by: Yang, Mingke, et al.
Published: (2024)
by: Yang, Mingke, et al.
Published: (2024)
What You See Is What You Get: Attention-based Self-guided Automatic Unit Test Generation
by: Yin, Xin, et al.
Published: (2024)
by: Yin, Xin, et al.
Published: (2024)
DebugHarness: Emulating Human Dynamic Debugging for Autonomous Program Repair
by: Sun, Maolin, et al.
Published: (2026)
by: Sun, Maolin, et al.
Published: (2026)
YATE: The Role of Test Repair in LLM-Based Unit Test Generation
by: Konstantinou, Michael, et al.
Published: (2025)
by: Konstantinou, Michael, et al.
Published: (2025)
Rethinking Legal Compliance Automation: Opportunities with Large Language Models
by: Hassani, Shabnam, et al.
Published: (2024)
by: Hassani, Shabnam, et al.
Published: (2024)
Automated Harmfulness Testing for Code Large Language Models
by: Tan, Honghao, et al.
Published: (2025)
by: Tan, Honghao, et al.
Published: (2025)
C2RustXW: Program-Structure-Aware C-to-Rust Translation via Program Analysis and LLM
by: Yan, Yanyan, et al.
Published: (2026)
by: Yan, Yanyan, et al.
Published: (2026)
Can Large Language Models Serve as Evaluators for Code Summarization?
by: Wu, Yang, et al.
Published: (2024)
by: Wu, Yang, et al.
Published: (2024)
Similar Items
-
PALM: Synergizing Program Analysis and LLMs to Enhance Rust Unit Test Coverage
by: Chu, Bei, et al.
Published: (2025) -
Mutation-Guided Unit Test Generation with a Large Language Model
by: Wang, Guancheng, et al.
Published: (2025) -
A Roadmap on Modern Code Review: Challenges and Opportunities
by: Yang, Zezhou, et al.
Published: (2024) -
On the Evaluation of Large Language Models in Unit Test Generation
by: Yang, Lin, et al.
Published: (2024) -
PR-Aware Automated Unit Test Generation: Challenges and Opportunities
by: Haratian, Vahid, et al.
Published: (2026)