CL4SE: Benchmarking Context Learning on Software Engineering
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Haichuan, Zhang, Quanjun, Shang, Ye, Xie, Guoqing, Fang, Chunrong, Chen, Zhenyu, Xiao, Liang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution
di: Shang, Ye, et al.
Pubblicazione: (2026)
di: Shang, Ye, et al.
Pubblicazione: (2026)
ComPass: Contrastive Learning for Automated Patch Correctness Assessment in Program Repair
di: Zhang, Quanjun, et al.
Pubblicazione: (2026)
di: Zhang, Quanjun, et al.
Pubblicazione: (2026)
On the Effectiveness of Code Representation in Deep Learning-Based Automated Patch Correctness Assessment
di: Zhang, Quanjun, et al.
Pubblicazione: (2026)
di: Zhang, Quanjun, et al.
Pubblicazione: (2026)
EvoRepair: Enhancing Vulnerability Repair Agents Through Experience-Based Self-Evolution
di: Hu, Haichuan, et al.
Pubblicazione: (2026)
di: Hu, Haichuan, et al.
Pubblicazione: (2026)
SGAgent: Suggestion-Guided LLM-Based Multi-Agent Framework for Repository-Level Software Repair
di: Zhang, Quanjun, et al.
Pubblicazione: (2026)
di: Zhang, Quanjun, et al.
Pubblicazione: (2026)
ACTesting: Automated Cross-modal Testing Method of Text-to-Image Software
di: Gu, Siqi, et al.
Pubblicazione: (2023)
di: Gu, Siqi, et al.
Pubblicazione: (2023)
Large Language Models for Unit Testing: A Systematic Literature Review
di: Zhang, Quanjun, et al.
Pubblicazione: (2025)
di: Zhang, Quanjun, et al.
Pubblicazione: (2025)
A Survey on Large Language Models for Software Engineering
di: Zhang, Quanjun, et al.
Pubblicazione: (2023)
di: Zhang, Quanjun, et al.
Pubblicazione: (2023)
ATTest: Agent-Driven Tensor Testing for Deep Learning Library Modules
di: Zhan, Zhengyu, et al.
Pubblicazione: (2026)
di: Zhan, Zhengyu, et al.
Pubblicazione: (2026)
No Man is an Island: Towards Fully Automatic Programming by Code Search, Code Generation and Program Repair
di: Zhang, Quanjun, et al.
Pubblicazione: (2024)
di: Zhang, Quanjun, et al.
Pubblicazione: (2024)
A Large-scale Empirical Study on Fine-tuning Large Language Models for Unit Testing
di: Shang, Ye, et al.
Pubblicazione: (2024)
di: Shang, Ye, et al.
Pubblicazione: (2024)
TestBench: Evaluating Class-Level Test Case Generation Capability of Large Language Models
di: Zhang, Quanjun, et al.
Pubblicazione: (2024)
di: Zhang, Quanjun, et al.
Pubblicazione: (2024)
TSAPR: A Tree Search Framework For Automated Program Repair
di: Hu, Haichuan, et al.
Pubblicazione: (2025)
di: Hu, Haichuan, et al.
Pubblicazione: (2025)
A Critical Review of Large Language Model on Software Engineering: An Example from ChatGPT and Automated Program Repair
di: Zhang, Quanjun, et al.
Pubblicazione: (2023)
di: Zhang, Quanjun, et al.
Pubblicazione: (2023)
Repair-R1: Better Test Before Repair
di: Hu, Haichuan, et al.
Pubblicazione: (2025)
di: Hu, Haichuan, et al.
Pubblicazione: (2025)
Can GPT-O1 Kill All Bugs? An Evaluation of GPT-Family LLMs on QuixBugs
di: Hu, Haichuan, et al.
Pubblicazione: (2024)
di: Hu, Haichuan, et al.
Pubblicazione: (2024)
Machine Translation Testing via Syntactic Tree Pruning
di: Zhang, Quanjun, et al.
Pubblicazione: (2024)
di: Zhang, Quanjun, et al.
Pubblicazione: (2024)
A Systematic Literature Review on Large Language Models for Automated Program Repair
di: Zhang, Quanjun, et al.
Pubblicazione: (2024)
di: Zhang, Quanjun, et al.
Pubblicazione: (2024)
Vision-Based Mobile App GUI Testing: A Survey
di: Yu, Shengcheng, et al.
Pubblicazione: (2023)
di: Yu, Shengcheng, et al.
Pubblicazione: (2023)
APPT: Boosting Automated Patch Correctness Prediction via Fine-tuning Pre-trained Models
di: Zhang, Quanjun, et al.
Pubblicazione: (2023)
di: Zhang, Quanjun, et al.
Pubblicazione: (2023)
SWE-Skills-Bench: Do Agent Skills Actually Help in Real-World Software Engineering?
di: Han, Tingxu, et al.
Pubblicazione: (2026)
di: Han, Tingxu, et al.
Pubblicazione: (2026)
TestART: Improving LLM-based Unit Testing via Co-evolution of Automated Generation and Repair Iteration
di: Gu, Siqi, et al.
Pubblicazione: (2024)
di: Gu, Siqi, et al.
Pubblicazione: (2024)
Do Advanced Language Models Eliminate the Need for Prompt Engineering in Software Engineering?
di: Wang, Guoqing, et al.
Pubblicazione: (2024)
di: Wang, Guoqing, et al.
Pubblicazione: (2024)
Test Script Intention Generation for Mobile Application via GUI Image and Code Understanding
di: Yu, Shengcheng, et al.
Pubblicazione: (2021)
di: Yu, Shengcheng, et al.
Pubblicazione: (2021)
Improving Deep Assertion Generation via Fine-Tuning Retrieval-Augmented Pre-trained Language Models
di: Zhang, Quanjun, et al.
Pubblicazione: (2025)
di: Zhang, Quanjun, et al.
Pubblicazione: (2025)
GPU Temperature Simulation-Based Testing for In-Vehicle Deep Learning Frameworks
di: Zou, Yinglong, et al.
Pubblicazione: (2025)
di: Zou, Yinglong, et al.
Pubblicazione: (2025)
Improving Retrieval-Augmented Deep Assertion Generation via Joint Training
di: Zhang, Quanjun, et al.
Pubblicazione: (2025)
di: Zhang, Quanjun, et al.
Pubblicazione: (2025)
Scalpel: Automotive Deep Learning Framework Testing via Assembling Model Components
di: Zou, Yinglong, et al.
Pubblicazione: (2025)
di: Zou, Yinglong, et al.
Pubblicazione: (2025)
May the Feedback Be with You! Unlocking the Power of Feedback-Driven Deep Learning Framework Fuzzing via LLMs
di: Yang, Shaoyu, et al.
Pubblicazione: (2025)
di: Yang, Shaoyu, et al.
Pubblicazione: (2025)
Pre-trained Model-based Actionable Warning Identification: A Feasibility Study
di: Ge, Xiuting, et al.
Pubblicazione: (2024)
di: Ge, Xiuting, et al.
Pubblicazione: (2024)
Peeling Off the Cocoon: Unveiling Suppressed Golden Seeds for Mutational Greybox Fuzzing
di: Qian, Ruixiang, et al.
Pubblicazione: (2026)
di: Qian, Ruixiang, et al.
Pubblicazione: (2026)
Towards Automated Crowdsourced Testing via Personified-LLM
di: Yu, Shengcheng, et al.
Pubblicazione: (2026)
di: Yu, Shengcheng, et al.
Pubblicazione: (2026)
Effective, Platform-Independent GUI Testing via Image Embedding and Reinforcement Learning
di: Yu, Shengcheng, et al.
Pubblicazione: (2022)
di: Yu, Shengcheng, et al.
Pubblicazione: (2022)
Mutation-Based Deep Learning Framework Testing Method in JavaScript Environment
di: Zou, Yinglong, et al.
Pubblicazione: (2024)
di: Zou, Yinglong, et al.
Pubblicazione: (2024)
Deep Learning Framework Testing via Heuristic Guidance Based on Multiple Model Measurements
di: Zou, Yinglong, et al.
Pubblicazione: (2025)
di: Zou, Yinglong, et al.
Pubblicazione: (2025)
Log-based, Business-aware REST API Testing
di: Yang, Ding, et al.
Pubblicazione: (2026)
di: Yang, Ding, et al.
Pubblicazione: (2026)
Teaching and Learning Ethnography for Software Engineering Contexts
di: Dittrich, Yvonne, et al.
Pubblicazione: (2024)
di: Dittrich, Yvonne, et al.
Pubblicazione: (2024)
Static Code Analyzer Recommendation via Preference Mining
di: Ge, Xiuting, et al.
Pubblicazione: (2024)
di: Ge, Xiuting, et al.
Pubblicazione: (2024)
Demonstration Attack against In-Context Learning for Code Intelligence
di: Ge, Yifei, et al.
Pubblicazione: (2024)
di: Ge, Yifei, et al.
Pubblicazione: (2024)
Security of Language Models for Code: A Systematic Literature Review
di: Chen, Yuchen, et al.
Pubblicazione: (2024)
di: Chen, Yuchen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution
di: Shang, Ye, et al.
Pubblicazione: (2026) -
ComPass: Contrastive Learning for Automated Patch Correctness Assessment in Program Repair
di: Zhang, Quanjun, et al.
Pubblicazione: (2026) -
On the Effectiveness of Code Representation in Deep Learning-Based Automated Patch Correctness Assessment
di: Zhang, Quanjun, et al.
Pubblicazione: (2026) -
EvoRepair: Enhancing Vulnerability Repair Agents Through Experience-Based Self-Evolution
di: Hu, Haichuan, et al.
Pubblicazione: (2026) -
SGAgent: Suggestion-Guided LLM-Based Multi-Agent Framework for Repository-Level Software Repair
di: Zhang, Quanjun, et al.
Pubblicazione: (2026)