On the Evaluation of Large Language Models in Unit Test Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Lin, Yang, Chen, Gao, Shutao, Wang, Weijing, Wang, Bo, Zhu, Qihao, Chu, Xiao, Zhou, Jianyi, Liang, Guangtai, Wang, Qianxiang, Chen, Junjie |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Reflective Unit Test Generation for Precise Type Error Detection with Large Language Models
by: Yang, Chen, et al.
Published: (2025)
by: Yang, Chen, et al.
Published: (2025)
Clarifying Semantics of In-Context Examples for Unit Test Generation
by: Yang, Chen, et al.
Published: (2025)
by: Yang, Chen, et al.
Published: (2025)
Advancing Code Coverage: Incorporating Program Analysis with Large Language Models
by: Yang, Chen, et al.
Published: (2024)
by: Yang, Chen, et al.
Published: (2024)
A Large-scale Empirical Study on Fine-tuning Large Language Models for Unit Testing
by: Shang, Ye, et al.
Published: (2024)
by: Shang, Ye, et al.
Published: (2024)
Uncovering Business Logic Bugs via Semantics-Driven Unit Test Generation
by: Yang, Chen, et al.
Published: (2026)
by: Yang, Chen, et al.
Published: (2026)
TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models
by: Zhang, Quanjun, et al.
Published: (2024)
by: Zhang, Quanjun, et al.
Published: (2024)
Large Language Models for Unit Testing: A Systematic Literature Review
by: Zhang, Quanjun, et al.
Published: (2025)
by: Zhang, Quanjun, et al.
Published: (2025)
CoderEval: A Benchmark of Pragmatic Code Generation with Generative Pre-trained Models
by: Yu, Hao, et al.
Published: (2023)
by: Yu, Hao, et al.
Published: (2023)
Software Testing with Large Language Models: Survey, Landscape, and Vision
by: Wang, Junjie, et al.
Published: (2023)
by: Wang, Junjie, et al.
Published: (2023)
TestART: Improving LLM-based Unit Testing via Co-evolution of Automated Generation and Repair Iteration
by: Gu, Siqi, et al.
Published: (2024)
by: Gu, Siqi, et al.
Published: (2024)
Large Language Models for Unit Test Generation: Achievements, Challenges, and Opportunities
by: Chu, Bei, et al.
Published: (2025)
by: Chu, Bei, et al.
Published: (2025)
Try with Simpler -- An Evaluation of Improved Principal Component Analysis in Log-based Anomaly Detection
by: Yang, Lin, et al.
Published: (2023)
by: Yang, Lin, et al.
Published: (2023)
TESTEVAL: Benchmarking Large Language Models for Test Case Generation
by: Wang, Wenhan, et al.
Published: (2024)
by: Wang, Wenhan, et al.
Published: (2024)
Mutation-Guided Unit Test Generation with a Large Language Model
by: Wang, Guancheng, et al.
Published: (2025)
by: Wang, Guancheng, et al.
Published: (2025)
No More Manual Tests? Evaluating and Improving ChatGPT for Unit Test Generation
by: Yuan, Zhiqiang, et al.
Published: (2023)
by: Yuan, Zhiqiang, et al.
Published: (2023)
CasModaTest: A Cascaded and Model-agnostic Self-directed Framework for Unit Test Generation
by: Ni, Chao, et al.
Published: (2024)
by: Ni, Chao, et al.
Published: (2024)
Automated Unit Test Refactoring
by: Gao, Yi, et al.
Published: (2024)
by: Gao, Yi, et al.
Published: (2024)
Automated Unit Test Improvement using Large Language Models at Meta
by: Alshahwan, Nadia, et al.
Published: (2024)
by: Alshahwan, Nadia, et al.
Published: (2024)
Evaluating Large Language Models for Multilingual Vulnerability Detection at Dual Granularities
by: Shu, Honglin, et al.
Published: (2025)
by: Shu, Honglin, et al.
Published: (2025)
CodeV: Issue Resolving with Visual Data
by: Zhang, Linhao, et al.
Published: (2024)
by: Zhang, Linhao, et al.
Published: (2024)
Fine-grained Testing for Autonomous Driving Software: a Study on Autoware with LLM-driven Unit Testing
by: Wang, Wenhan, et al.
Published: (2025)
by: Wang, Wenhan, et al.
Published: (2025)
Large Language Models for Software Testing Education: an Experience Report
by: Yang, Peng, et al.
Published: (2026)
by: Yang, Peng, et al.
Published: (2026)
Automatic Smart Contract Comment Generation via Large Language Models and In-Context Learning
by: Zhao, Junjie, et al.
Published: (2023)
by: Zhao, Junjie, et al.
Published: (2023)
Aligning Requirement for Large Language Model's Code Generation
by: Tian, Zhao, et al.
Published: (2025)
by: Tian, Zhao, et al.
Published: (2025)
GraphCoder: Enhancing Repository-Level Code Completion via Code Context Graph-based Retrieval and Language Model
by: Liu, Wei, et al.
Published: (2024)
by: Liu, Wei, et al.
Published: (2024)
Seed&Steer: Guiding Large Language Models with Compilable Prefix and Branch Signals for Unit Test Generation
by: Zhou, Shuaiyu, et al.
Published: (2025)
by: Zhou, Shuaiyu, et al.
Published: (2025)
Narrowing the Complexity Gap in the Evaluation of Large Language Models
by: Chen, Yang, et al.
Published: (2026)
by: Chen, Yang, et al.
Published: (2026)
Interleaved Learning and Exploration: A Self-Adaptive Fuzz Testing Framework for MLIR
by: Sun, Zeyu, et al.
Published: (2025)
by: Sun, Zeyu, et al.
Published: (2025)
A Survey of Reinforcement Learning for Software Engineering
by: Wang, Dong, et al.
Published: (2025)
by: Wang, Dong, et al.
Published: (2025)
PALM: Synergizing Program Analysis and LLMs to Enhance Rust Unit Test Coverage
by: Chu, Bei, et al.
Published: (2025)
by: Chu, Bei, et al.
Published: (2025)
TestDecision: Sequential Test Suite Generation via Greedy Optimization and Reinforcement Learning
by: Wang, Guoqing, et al.
Published: (2026)
by: Wang, Guoqing, et al.
Published: (2026)
Characterizing and Mitigating False-Positive Bug Reports in the Linux Kernel
by: Tian, Jiashuo, et al.
Published: (2026)
by: Tian, Jiashuo, et al.
Published: (2026)
A Comprehensive Study on Static Application Security Testing (SAST) Tools for Android
by: Zhu, Jingyun, et al.
Published: (2024)
by: Zhu, Jingyun, et al.
Published: (2024)
On the Evaluation of Large Language Models in Multilingual Vulnerability Repair
by: wang, Dong, et al.
Published: (2025)
by: wang, Dong, et al.
Published: (2025)
Mut4All: Fuzzing Compilers via LLM-Synthesized Mutators Learned from Bug Reports
by: Wang, Bo, et al.
Published: (2025)
by: Wang, Bo, et al.
Published: (2025)
A Survey on Evaluating Large Language Models in Code Generation Tasks
by: Chen, Liguo, et al.
Published: (2024)
by: Chen, Liguo, et al.
Published: (2024)
Large Language Models for Equivalent Mutant Detection: How Far Are We?
by: Tian, Zhao, et al.
Published: (2024)
by: Tian, Zhao, et al.
Published: (2024)
Secure-Instruct: An Automated Pipeline for Synthesizing Instruction-Tuning Datasets Using LLMs for Secure Code Generation
by: Li, Junjie, et al.
Published: (2025)
by: Li, Junjie, et al.
Published: (2025)
MultiTest: Physical-Aware Object Insertion for Testing Multi-sensor Fusion Perception Systems
by: Gao, Xinyu, et al.
Published: (2024)
by: Gao, Xinyu, et al.
Published: (2024)
Optimizing Knowledge Utilization for Multi-Intent Comment Generation with Large Language Models
by: Li, Shuochuan, et al.
Published: (2025)
by: Li, Shuochuan, et al.
Published: (2025)
Similar Items
-
Reflective Unit Test Generation for Precise Type Error Detection with Large Language Models
by: Yang, Chen, et al.
Published: (2025) -
Clarifying Semantics of In-Context Examples for Unit Test Generation
by: Yang, Chen, et al.
Published: (2025) -
Advancing Code Coverage: Incorporating Program Analysis with Large Language Models
by: Yang, Chen, et al.
Published: (2024) -
A Large-scale Empirical Study on Fine-tuning Large Language Models for Unit Testing
by: Shang, Ye, et al.
Published: (2024) -
Uncovering Business Logic Bugs via Semantics-Driven Unit Test Generation
by: Yang, Chen, et al.
Published: (2026)