KTester: Leveraging Domain and Testing Knowledge for More Effective LLM-based Test Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Anji, Liu, Mingwei, Chen, Zhenxi, Pei, Zheng, Li, Zike, Dai, Dekun, Wang, Yanlin, Zheng, Zibin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Preliminary Study on the Robustness of Code Generation by Large Language Models
par: Li, Zike, et autres
Publié: (2025)
par: Li, Zike, et autres
Publié: (2025)
Are Decoder-Only Large Language Models the Silver Bullet for Code Search?
par: Chen, Yuxuan, et autres
Publié: (2024)
par: Chen, Yuxuan, et autres
Publié: (2024)
Architecture-Aware Multi-Design Generation for Repository-Level Feature Addition
par: Liu, Mingwei, et autres
Publié: (2026)
par: Liu, Mingwei, et autres
Publié: (2026)
Dynamic analysis enhances issue resolution
par: Liu, Mingwei, et autres
Publié: (2026)
par: Liu, Mingwei, et autres
Publié: (2026)
Build-Aware Incremental C-to-Rust Migration via Skeleton-First Translation and Historical Knowledge Reuse
par: Wang, Shengbo, et autres
Publié: (2026)
par: Wang, Shengbo, et autres
Publié: (2026)
FeedbackEval: A Benchmark for Evaluating Large Language Models in Feedback-Driven Code Repair Tasks
par: Dai, Dekun, et autres
Publié: (2025)
par: Dai, Dekun, et autres
Publié: (2025)
Unseen-Codebases-Domain Data Synthesis and Training Based on Code Graphs
par: Ou, Guangsheng, et autres
Publié: (2026)
par: Ou, Guangsheng, et autres
Publié: (2026)
AdaDec: A Uncertainty-Guided Lookahead Decoding Framework for LLM-Based Code Generation
par: He, Kaifeng, et autres
Publié: (2025)
par: He, Kaifeng, et autres
Publié: (2025)
Knowledge-Graph-Driven Data Synthesis for Low-Resource Software Development: A HarmonyOS Case Study
par: Liu, Mingwei, et autres
Publié: (2025)
par: Liu, Mingwei, et autres
Publié: (2025)
What to Retrieve for Effective Retrieval-Augmented Code Generation? An Empirical Study and Beyond
par: Gu, Wenchao, et autres
Publié: (2025)
par: Gu, Wenchao, et autres
Publié: (2025)
Generating High-Quality Datasets for Code Editing via Open-Source Language Models
par: Zhang, Zekai, et autres
Publié: (2025)
par: Zhang, Zekai, et autres
Publié: (2025)
RustRepoTrans: Repository-level Code Translation Benchmark Targeting Rust
par: Ou, Guangsheng, et autres
Publié: (2024)
par: Ou, Guangsheng, et autres
Publié: (2024)
RustEvo^2: An Evolving Benchmark for API Evolution in LLM-based Rust Code Generation
par: Liang, Linxi, et autres
Publié: (2025)
par: Liang, Linxi, et autres
Publié: (2025)
RepoDoc: A Knowledge Graph-Based Framework to Automatic Documentation Generation and Incremental Updates
par: Xu, Dong, et autres
Publié: (2026)
par: Xu, Dong, et autres
Publié: (2026)
No More Manual Tests? Evaluating and Improving ChatGPT for Unit Test Generation
par: Yuan, Zhiqiang, et autres
Publié: (2023)
par: Yuan, Zhiqiang, et autres
Publié: (2023)
iJTyper: An Iterative Type Inference Framework for Java by Integrating Constraint- and Statistically-based Methods
par: Chen, Zhixiang, et autres
Publié: (2024)
par: Chen, Zhixiang, et autres
Publié: (2024)
A Hierarchical and Evolvable Benchmark for Fine-Grained Code Instruction Following with Multi-Turn Feedback
par: Duan, Guoliang, et autres
Publié: (2025)
par: Duan, Guoliang, et autres
Publié: (2025)
HumanEvo: An Evolution-aware Benchmark for More Realistic Evaluation of Repository-level Code Generation
par: Zheng, Dewu, et autres
Publié: (2024)
par: Zheng, Dewu, et autres
Publié: (2024)
SimpleDevQA: Benchmarking Large Language Models on Development Knowledge QA
par: Zhang, Jing, et autres
Publié: (2025)
par: Zhang, Jing, et autres
Publié: (2025)
CoSQA+: Pioneering the Multi-Choice Code Search Benchmark with Test-Driven Agents
par: Gong, Jing, et autres
Publié: (2024)
par: Gong, Jing, et autres
Publié: (2024)
RealSec-bench: A Benchmark for Evaluating Secure Code Generation in Real-World Repositories
par: Wang, Yanlin, et autres
Publié: (2026)
par: Wang, Yanlin, et autres
Publié: (2026)
Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark
par: Zheng, Dewu, et autres
Publié: (2024)
par: Zheng, Dewu, et autres
Publié: (2024)
DRAINCODE: Stealthy Energy Consumption Attacks on Retrieval-Augmented Code Generation via Context Poisoning
par: Wang, Yanlin, et autres
Publié: (2026)
par: Wang, Yanlin, et autres
Publié: (2026)
LLM Hallucinations in Practical Code Generation: Phenomena, Mechanism, and Mitigation
par: Zhang, Ziyao, et autres
Publié: (2024)
par: Zhang, Ziyao, et autres
Publié: (2024)
EffiReasonTrans: RL-Optimized Reasoning for Code Translation
par: Wang, Yanlin, et autres
Publié: (2025)
par: Wang, Yanlin, et autres
Publié: (2025)
Evolving Triple Knowledge-Augmented LLMs for Code Translation in Repository Context
par: Ou, Guangsheng, et autres
Publié: (2025)
par: Ou, Guangsheng, et autres
Publié: (2025)
Beyond Functional Correctness: Investigating Coding Style Inconsistencies in Large Language Models
par: Wang, Yanlin, et autres
Publié: (2024)
par: Wang, Yanlin, et autres
Publié: (2024)
LogPrism: Unifying Structure and Variable Encoding for Effective Log Compression
par: Liu, Yang, et autres
Publié: (2026)
par: Liu, Yang, et autres
Publié: (2026)
Cast: Automated Resilience Testing for Production Cloud Service Systems
par: Chen, Zhuangbin, et autres
Publié: (2026)
par: Chen, Zhuangbin, et autres
Publié: (2026)
CITYWALK: Enhancing LLM-Based C++ Unit Test Generation via Project-Dependency Awareness and Language-Specific Knowledge
par: Zhang, Yuwei, et autres
Publié: (2025)
par: Zhang, Yuwei, et autres
Publié: (2025)
NumScout: Unveiling Numerical Defects in Smart Contracts using LLM-Pruning Symbolic Execution
par: Chen, Jiachi, et autres
Publié: (2025)
par: Chen, Jiachi, et autres
Publié: (2025)
Test smells in LLM-Generated Unit Tests
par: Ouédraogo, Wendkûuni C., et autres
Publié: (2024)
par: Ouédraogo, Wendkûuni C., et autres
Publié: (2024)
Bridging Generation and Training: A Systematic Review of Quality Issues in LLMs for Code
par: He, Kaifeng, et autres
Publié: (2026)
par: He, Kaifeng, et autres
Publié: (2026)
Hyperion: Unveiling DApp Inconsistencies using LLM and Dataflow-Guided Symbolic Execution
par: Yang, Shuo, et autres
Publié: (2024)
par: Yang, Shuo, et autres
Publié: (2024)
Enhancing LLM's Ability to Generate More Repository-Aware Unit Tests Through Precise Contextual Information Injection
par: Yin, Xin, et autres
Publié: (2025)
par: Yin, Xin, et autres
Publié: (2025)
SparseCoder: Identifier-Aware Sparse Transformer for File-Level Code Summarization
par: Wang, Yanlin, et autres
Publié: (2024)
par: Wang, Yanlin, et autres
Publié: (2024)
A Survey of Large Language Models for Code: Evolution, Benchmarking, and Future Trends
par: Zheng, Zibin, et autres
Publié: (2023)
par: Zheng, Zibin, et autres
Publié: (2023)
Efficiently Detecting Reentrancy Vulnerabilities in Complex Smart Contracts
par: Wang, Zexu, et autres
Publié: (2024)
par: Wang, Zexu, et autres
Publié: (2024)
TestART: Improving LLM-based Unit Testing via Co-evolution of Automated Generation and Repair Iteration
par: Gu, Siqi, et autres
Publié: (2024)
par: Gu, Siqi, et autres
Publié: (2024)
An Empirical Study of Interaction Bugs in ROS-based Software
par: Chen, Zhixiang, et autres
Publié: (2025)
par: Chen, Zhixiang, et autres
Publié: (2025)
Documents similaires
-
A Preliminary Study on the Robustness of Code Generation by Large Language Models
par: Li, Zike, et autres
Publié: (2025) -
Are Decoder-Only Large Language Models the Silver Bullet for Code Search?
par: Chen, Yuxuan, et autres
Publié: (2024) -
Architecture-Aware Multi-Design Generation for Repository-Level Feature Addition
par: Liu, Mingwei, et autres
Publié: (2026) -
Dynamic analysis enhances issue resolution
par: Liu, Mingwei, et autres
Publié: (2026) -
Build-Aware Incremental C-to-Rust Migration via Skeleton-First Translation and Historical Knowledge Reuse
par: Wang, Shengbo, et autres
Publié: (2026)