AgentStepper: Interactive Debugging of Software Development Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Hutter, Robert, Pradel, Michael |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Understanding Software Engineering Agents: A Study of Thought-Action-Result Trajectories
di: Bouzenia, Islem, et al.
Pubblicazione: (2025)
di: Bouzenia, Islem, et al.
Pubblicazione: (2025)
Towards Adaptive Software Agents for Debugging
di: Majdoub, Yacine, et al.
Pubblicazione: (2025)
di: Majdoub, Yacine, et al.
Pubblicazione: (2025)
RepairAgent: An Autonomous, LLM-Based Agent for Program Repair
di: Bouzenia, Islem, et al.
Pubblicazione: (2024)
di: Bouzenia, Islem, et al.
Pubblicazione: (2024)
You Name It, I Run It: An LLM Agent to Execute Tests of Arbitrary Projects
di: Bouzenia, Islem, et al.
Pubblicazione: (2024)
di: Bouzenia, Islem, et al.
Pubblicazione: (2024)
Debugging the Debuggers: Failure-Anchored Structured Recovery for Software Engineering Agents
di: Zhao, Chenyu, et al.
Pubblicazione: (2026)
di: Zhao, Chenyu, et al.
Pubblicazione: (2026)
Debug2Fix: Can Interactive Debugging Help Coding Agents Fix More Bugs?
di: Garg, Spandan, et al.
Pubblicazione: (2026)
di: Garg, Spandan, et al.
Pubblicazione: (2026)
Agentic AI Software Engineers: Programming with Trust
di: Roychoudhury, Abhik, et al.
Pubblicazione: (2025)
di: Roychoudhury, Abhik, et al.
Pubblicazione: (2025)
DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems
di: Ma, Ming, et al.
Pubblicazione: (2025)
di: Ma, Ming, et al.
Pubblicazione: (2025)
Treefix: Enabling Execution with a Tree of Prefixes
di: Souza, Beatriz, et al.
Pubblicazione: (2025)
di: Souza, Beatriz, et al.
Pubblicazione: (2025)
LoCoBench-Agent: An Interactive Benchmark for LLM Agents in Long-Context Software Engineering
di: Qiu, Jielin, et al.
Pubblicazione: (2025)
di: Qiu, Jielin, et al.
Pubblicazione: (2025)
AgentMesh: A Cooperative Multi-Agent Generative AI Framework for Software Development Automation
di: Khanzadeh, Sourena
Pubblicazione: (2025)
di: Khanzadeh, Sourena
Pubblicazione: (2025)
Agentsway -- Software Development Methodology for AI Agents-based Teams
di: Bandara, Eranga, et al.
Pubblicazione: (2025)
di: Bandara, Eranga, et al.
Pubblicazione: (2025)
COAST: Enhancing the Code Debugging Ability of LLMs through Communicative Agent Based Data Synthesis
di: Yang, Weiqing, et al.
Pubblicazione: (2024)
di: Yang, Weiqing, et al.
Pubblicazione: (2024)
Self-Evolving Software Agents
di: Robol, Marco, et al.
Pubblicazione: (2026)
di: Robol, Marco, et al.
Pubblicazione: (2026)
The OpenHands Software Agent SDK: A Composable and Extensible Foundation for Production Agents
di: Wang, Xingyao, et al.
Pubblicazione: (2025)
di: Wang, Xingyao, et al.
Pubblicazione: (2025)
AgileCoder: Dynamic Collaborative Agents for Software Development based on Agile Methodology
di: Nguyen, Minh Huynh, et al.
Pubblicazione: (2024)
di: Nguyen, Minh Huynh, et al.
Pubblicazione: (2024)
Unified Software Engineering Agent as AI Software Engineer
di: Applis, Leonhard, et al.
Pubblicazione: (2025)
di: Applis, Leonhard, et al.
Pubblicazione: (2025)
Evaluating LLM Agents on Automated Software Analysis Tasks
di: Bouzenia, Islem, et al.
Pubblicazione: (2026)
di: Bouzenia, Islem, et al.
Pubblicazione: (2026)
The Debugging Decay Index: Rethinking Debugging Strategies for Code LLMs
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)
Rethinking the Value of Agent-Generated Tests for LLM-Based Software Engineering Agents
di: Chen, Zhi, et al.
Pubblicazione: (2026)
di: Chen, Zhi, et al.
Pubblicazione: (2026)
HyperAgent: Generalist Software Engineering Agents to Solve Coding Tasks at Scale
di: Phan, Huy Nhat, et al.
Pubblicazione: (2024)
di: Phan, Huy Nhat, et al.
Pubblicazione: (2024)
Trae Agent: An LLM-based Agent for Software Engineering with Test-time Scaling
di: Trae Research Team, et al.
Pubblicazione: (2025)
di: Trae Research Team, et al.
Pubblicazione: (2025)
Every Software as an Agent: Blueprint and Case Study
di: Xu, Mengwei
Pubblicazione: (2025)
di: Xu, Mengwei
Pubblicazione: (2025)
AgentForge: Execution-Grounded Multi-Agent LLM Framework for Autonomous Software Engineering
di: Kumar, Rajesh, et al.
Pubblicazione: (2026)
di: Kumar, Rajesh, et al.
Pubblicazione: (2026)
EvoDev: An Iterative Feature-Driven Framework for End-to-End Software Development with LLM-based Agents
di: Liu, Junwei, et al.
Pubblicazione: (2025)
di: Liu, Junwei, et al.
Pubblicazione: (2025)
Software Development Life Cycle Perspective: A Survey of Benchmarks for Code Large Language Models and Agents
di: Wang, Kaixin, et al.
Pubblicazione: (2025)
di: Wang, Kaixin, et al.
Pubblicazione: (2025)
MASAI: Modular Architecture for Software-engineering AI Agents
di: Arora, Daman, et al.
Pubblicazione: (2024)
di: Arora, Daman, et al.
Pubblicazione: (2024)
An Empirical Study of Agent Developer Practices in AI Agent Frameworks
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
OpenHands: An Open Platform for AI Software Developers as Generalist Agents
di: Wang, Xingyao, et al.
Pubblicazione: (2024)
di: Wang, Xingyao, et al.
Pubblicazione: (2024)
Self-Evolving Multi-Agent Collaboration Networks for Software Development
di: Hu, Yue, et al.
Pubblicazione: (2024)
di: Hu, Yue, et al.
Pubblicazione: (2024)
Structurally Aligned Subtask-Level Memory for Software Engineering Agents
di: Shen, Kangning, et al.
Pubblicazione: (2026)
di: Shen, Kangning, et al.
Pubblicazione: (2026)
OpenComputer: Verifiable Software Worlds for Computer-Use Agents
di: Wei, Jinbiao, et al.
Pubblicazione: (2026)
di: Wei, Jinbiao, et al.
Pubblicazione: (2026)
ArchAgent: Scalable Legacy Software Architecture Recovery with LLMs
di: Pan, Rusheng, et al.
Pubblicazione: (2026)
di: Pan, Rusheng, et al.
Pubblicazione: (2026)
EvoClaw: Evaluating AI Agents on Continuous Software Evolution
di: Deng, Gangda, et al.
Pubblicazione: (2026)
di: Deng, Gangda, et al.
Pubblicazione: (2026)
TOM-SWE: User Mental Modeling For Software Engineering Agents
di: Zhou, Xuhui, et al.
Pubblicazione: (2025)
di: Zhou, Xuhui, et al.
Pubblicazione: (2025)
OrcaLoca: An LLM Agent Framework for Software Issue Localization
di: Yu, Zhongming, et al.
Pubblicazione: (2025)
di: Yu, Zhongming, et al.
Pubblicazione: (2025)
RepoDebug: Repository-Level Multi-Task and Multi-Language Debugging Evaluation of Large Language Models
di: Liu, Jingjing, et al.
Pubblicazione: (2025)
di: Liu, Jingjing, et al.
Pubblicazione: (2025)
Evaluating Software Development Agents: Patch Patterns, Code Quality, and Issue Complexity in Real-World GitHub Scenarios
di: Chen, Zhi, et al.
Pubblicazione: (2024)
di: Chen, Zhi, et al.
Pubblicazione: (2024)
CODESIM: Multi-Agent Code Generation and Problem Solving through Simulation-Driven Planning and Debugging
di: Islam, Md. Ashraful, et al.
Pubblicazione: (2025)
di: Islam, Md. Ashraful, et al.
Pubblicazione: (2025)
daVinci-Dev: Agent-native Mid-training for Software Engineering
di: Zeng, Ji, et al.
Pubblicazione: (2026)
di: Zeng, Ji, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Understanding Software Engineering Agents: A Study of Thought-Action-Result Trajectories
di: Bouzenia, Islem, et al.
Pubblicazione: (2025) -
Towards Adaptive Software Agents for Debugging
di: Majdoub, Yacine, et al.
Pubblicazione: (2025) -
RepairAgent: An Autonomous, LLM-Based Agent for Program Repair
di: Bouzenia, Islem, et al.
Pubblicazione: (2024) -
You Name It, I Run It: An LLM Agent to Execute Tests of Arbitrary Projects
di: Bouzenia, Islem, et al.
Pubblicazione: (2024) -
Debugging the Debuggers: Failure-Anchored Structured Recovery for Software Engineering Agents
di: Zhao, Chenyu, et al.
Pubblicazione: (2026)