Rethinking the Value of Agent-Generated Tests for LLM-Based Software Engineering Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Zhi, Sun, Zhensu, Shi, Yuling, Peng, Chao, Gu, Xiaodong, Lo, David, Jiang, Lingxiao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Test vs Mutant: Adversarial LLM Agents for Robust Unit Test Generation
di: Chang, Pengyu, et al.
Pubblicazione: (2026)
di: Chang, Pengyu, et al.
Pubblicazione: (2026)
Same Signal, Different Semantics: A Cross-Framework Behavioral Analysis of Software Engineering Agents
di: Ma, Wei, et al.
Pubblicazione: (2026)
di: Ma, Wei, et al.
Pubblicazione: (2026)
LLM-Based Multi-Agent Systems for Software Engineering: Literature Review, Vision and the Road Ahead
di: He, Junda, et al.
Pubblicazione: (2024)
di: He, Junda, et al.
Pubblicazione: (2024)
Evaluating Software Development Agents: Patch Patterns, Code Quality, and Issue Complexity in Real-World GitHub Scenarios
di: Chen, Zhi, et al.
Pubblicazione: (2024)
di: Chen, Zhi, et al.
Pubblicazione: (2024)
Rethinking Code Complexity Through the Lens of Large Language Models
di: Xie, Chen, et al.
Pubblicazione: (2026)
di: Xie, Chen, et al.
Pubblicazione: (2026)
Trae Agent: An LLM-based Agent for Software Engineering with Test-time Scaling
di: Trae Research Team, et al.
Pubblicazione: (2025)
di: Trae Research Team, et al.
Pubblicazione: (2025)
LIDL: LLM Integration Defect Localization via Knowledge Graph-Enhanced Multi-Agent Analysis
di: Tan, Gou, et al.
Pubblicazione: (2026)
di: Tan, Gou, et al.
Pubblicazione: (2026)
Beyond Final Code: A Process-Oriented Error Analysis of Software Development Agents in Real-World GitHub Scenarios
di: Chen, Zhi, et al.
Pubblicazione: (2025)
di: Chen, Zhi, et al.
Pubblicazione: (2025)
CodeOCR: On the Effectiveness of Vision Language Models in Code Understanding
di: Shi, Yuling, et al.
Pubblicazione: (2026)
di: Shi, Yuling, et al.
Pubblicazione: (2026)
AI Coders Are Among Us: Rethinking Programming Language Grammar Towards Efficient Code Generation
di: Sun, Zhensu, et al.
Pubblicazione: (2024)
di: Sun, Zhensu, et al.
Pubblicazione: (2024)
Executing as You Generate: Hiding Execution Latency in LLM Code Generation
di: Sun, Zhensu, et al.
Pubblicazione: (2026)
di: Sun, Zhensu, et al.
Pubblicazione: (2026)
Think Like Human Developers: Harnessing Community Knowledge for Structured Code Reasoning
di: Yang, Chengran, et al.
Pubblicazione: (2025)
di: Yang, Chengran, et al.
Pubblicazione: (2025)
Bridging Developer Instructions and Code Completion Through Instruction-Aware Fill-in-the-Middle Paradigm
di: Sun, Zhensu, et al.
Pubblicazione: (2025)
di: Sun, Zhensu, et al.
Pubblicazione: (2025)
The Hidden Cost of Readability: How Code Formatting Silently Consumes Your LLM Budget
di: Pan, Dangfeng, et al.
Pubblicazione: (2025)
di: Pan, Dangfeng, et al.
Pubblicazione: (2025)
Evaluating LLM-Based 0-to-1 Software Generation in End-to-End CLI Tool Scenarios
di: Hu, Ruida, et al.
Pubblicazione: (2026)
di: Hu, Ruida, et al.
Pubblicazione: (2026)
SEAlign: Alignment Training for Software Engineering Agent
di: Zhang, Kechi, et al.
Pubblicazione: (2025)
di: Zhang, Kechi, et al.
Pubblicazione: (2025)
EffiSkill: Agent Skill Based Automated Code Efficiency Optimization
di: Wang, Zimu, et al.
Pubblicazione: (2026)
di: Wang, Zimu, et al.
Pubblicazione: (2026)
LLM-as-a-Judge for Software Engineering: Literature Review, Vision, and the Road Ahead
di: He, Junda, et al.
Pubblicazione: (2025)
di: He, Junda, et al.
Pubblicazione: (2025)
LogiAgent: Automated Logical Testing for REST Systems with LLM-Based Multi-Agents
di: Zhang, Ke, et al.
Pubblicazione: (2025)
di: Zhang, Ke, et al.
Pubblicazione: (2025)
In Line with Context: Repository-Level Code Generation via Context Inlining
di: Hu, Chao, et al.
Pubblicazione: (2026)
di: Hu, Chao, et al.
Pubblicazione: (2026)
Robustness, Security, Privacy, Explainability, Efficiency, and Usability of Large Language Models for Code
di: Yang, Zhou, et al.
Pubblicazione: (2024)
di: Yang, Zhou, et al.
Pubblicazione: (2024)
SWE-Debate: Competitive Multi-Agent Debate for Software Issue Resolution
di: Li, Han, et al.
Pubblicazione: (2025)
di: Li, Han, et al.
Pubblicazione: (2025)
Unified Software Engineering Agent as AI Software Engineer
di: Applis, Leonhard, et al.
Pubblicazione: (2025)
di: Applis, Leonhard, et al.
Pubblicazione: (2025)
REprompt: Prompt Generation for Intelligent Software Development Guided by Requirements Engineering
di: Shi, Junjie, et al.
Pubblicazione: (2026)
di: Shi, Junjie, et al.
Pubblicazione: (2026)
Large Language Model-Based Agents for Software Engineering: A Survey
di: Liu, Junwei, et al.
Pubblicazione: (2024)
di: Liu, Junwei, et al.
Pubblicazione: (2024)
Token Sugar: Making Source Code Sweeter for LLMs through Token-Efficient Shorthand
di: Sun, Zhensu, et al.
Pubblicazione: (2025)
di: Sun, Zhensu, et al.
Pubblicazione: (2025)
Efficient and Green Large Language Models for Software Engineering: Literature Review, Vision, and the Road Ahead
di: Shi, Jieke, et al.
Pubblicazione: (2024)
di: Shi, Jieke, et al.
Pubblicazione: (2024)
FDI: Attack Neural Code Generation Systems through User Feedback Channel
di: Sun, Zhensu, et al.
Pubblicazione: (2024)
di: Sun, Zhensu, et al.
Pubblicazione: (2024)
LLM-Assisted Empirical Software Engineering: Systematic Literature Review and Research Agenda
di: Gomes, Victoria, et al.
Pubblicazione: (2026)
di: Gomes, Victoria, et al.
Pubblicazione: (2026)
AgentSZZ: Teaching the LLM Agent to Play Detective with Bug-Inducing Commits
di: Lyu, Yunbo, et al.
Pubblicazione: (2026)
di: Lyu, Yunbo, et al.
Pubblicazione: (2026)
Knowledge-Based Multi-Agent Framework for Automated Software Architecture Design
di: Zhang, Yiran, et al.
Pubblicazione: (2025)
di: Zhang, Yiran, et al.
Pubblicazione: (2025)
From Human Interfaces to Agent Interfaces: Rethinking Software Design in the Age of AI-Native Systems
di: Wang, Shaolin, et al.
Pubblicazione: (2026)
di: Wang, Shaolin, et al.
Pubblicazione: (2026)
Generative Software Engineering
di: Huang, Yuan, et al.
Pubblicazione: (2024)
di: Huang, Yuan, et al.
Pubblicazione: (2024)
LoCoBench-Agent: An Interactive Benchmark for LLM Agents in Long-Context Software Engineering
di: Qiu, Jielin, et al.
Pubblicazione: (2025)
di: Qiu, Jielin, et al.
Pubblicazione: (2025)
Knowledge-Guided Multi-Agent Framework for Application-Level Software Code Generation
di: Xiong, Qian, et al.
Pubblicazione: (2025)
di: Xiong, Qian, et al.
Pubblicazione: (2025)
PAGENT: Learning to Patch Software Engineering Agents
di: Xue, Haoran, et al.
Pubblicazione: (2025)
di: Xue, Haoran, et al.
Pubblicazione: (2025)
Agent-Based Software Artifact Evaluation
di: Wu, Zhaonan, et al.
Pubblicazione: (2026)
di: Wu, Zhaonan, et al.
Pubblicazione: (2026)
Pruning the Unsurprising: Efficient LLM Reasoning via First-Token Surprisal
di: Zeng, Wenhao, et al.
Pubblicazione: (2025)
di: Zeng, Wenhao, et al.
Pubblicazione: (2025)
AgentForge: Execution-Grounded Multi-Agent LLM Framework for Autonomous Software Engineering
di: Kumar, Rajesh, et al.
Pubblicazione: (2026)
di: Kumar, Rajesh, et al.
Pubblicazione: (2026)
Thinking Longer, Not Larger: Enhancing Software Engineering Agents via Scaling Test-Time Compute
di: Ma, Yingwei, et al.
Pubblicazione: (2025)
di: Ma, Yingwei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Test vs Mutant: Adversarial LLM Agents for Robust Unit Test Generation
di: Chang, Pengyu, et al.
Pubblicazione: (2026) -
Same Signal, Different Semantics: A Cross-Framework Behavioral Analysis of Software Engineering Agents
di: Ma, Wei, et al.
Pubblicazione: (2026) -
LLM-Based Multi-Agent Systems for Software Engineering: Literature Review, Vision and the Road Ahead
di: He, Junda, et al.
Pubblicazione: (2024) -
Evaluating Software Development Agents: Patch Patterns, Code Quality, and Issue Complexity in Real-World GitHub Scenarios
di: Chen, Zhi, et al.
Pubblicazione: (2024) -
Rethinking Code Complexity Through the Lens of Large Language Models
di: Xie, Chen, et al.
Pubblicazione: (2026)