Debugging the Debuggers: Failure-Anchored Structured Recovery for Software Engineering Agents
Fuente:
arXiv
Saved in:
| Main Authors: | Zhao, Chenyu, Zhang, Shenglin, Lin, Yihang, Gu, Wenwei, Chen, Zhimin, Sun, Yongqian, Pei, Dan, Bansal, Chetan, Rajmohan, Saravan, Ma, Minghua |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
EvidenT: An Evidence-Preserving Framework for Iterative System-Level Package Repair
by: Zhao, Chenyu, et al.
Published: (2026)
by: Zhao, Chenyu, et al.
Published: (2026)
Triage in Software Engineering: A Systematic Review of Research and Practice
by: Zhao, Yongxin, et al.
Published: (2025)
by: Zhao, Yongxin, et al.
Published: (2025)
Can Language Models Go Beyond Coding? Assessing the Capability of Language Models to Build Real-World Systems
by: Zhao, Chenyu, et al.
Published: (2025)
by: Zhao, Chenyu, et al.
Published: (2025)
A Benchmark for Language Models in Real-World System Building
by: Jin, Weilin, et al.
Published: (2026)
by: Jin, Weilin, et al.
Published: (2026)
UniDebugger: Hierarchical Multi-Agent Framework for Unified Software Debugging
by: Lee, Cheryl, et al.
Published: (2024)
by: Lee, Cheryl, et al.
Published: (2024)
Automated Root Causing of Cloud Incidents using In-Context Learning with GPT-4
by: Zhang, Xuchao, et al.
Published: (2024)
by: Zhang, Xuchao, et al.
Published: (2024)
Failure Diagnosis in Microservice Systems: A Comprehensive Survey and Analysis
by: Zhang, Shenglin, et al.
Published: (2024)
by: Zhang, Shenglin, et al.
Published: (2024)
DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems
by: Ma, Ming, et al.
Published: (2025)
by: Ma, Ming, et al.
Published: (2025)
AIOpsLab: A Holistic Framework to Evaluate AI Agents for Enabling Autonomous Clouds
by: Chen, Yinfang, et al.
Published: (2025)
by: Chen, Yinfang, et al.
Published: (2025)
Exploring LLM-based Agents for Root Cause Analysis
by: Roy, Devjeet, et al.
Published: (2024)
by: Roy, Devjeet, et al.
Published: (2024)
Which Types of Heterogeneity Matter for Root Cause Localization in Microservice Systems ?
by: Wang, Runzhou, et al.
Published: (2026)
by: Wang, Runzhou, et al.
Published: (2026)
eARCO: Efficient Automated Root Cause Analysis with Prompt Optimization
by: Goel, Drishti, et al.
Published: (2025)
by: Goel, Drishti, et al.
Published: (2025)
Continuous Benchmark Generation for Evaluating Enterprise-scale LLM Agents
by: Saxena, Divyanshu, et al.
Published: (2025)
by: Saxena, Divyanshu, et al.
Published: (2025)
Designing for Novice Debuggers: A Pilot Study on an AI-Assisted Debugging Tool
by: Kurniawan, Oka, et al.
Published: (2025)
by: Kurniawan, Oka, et al.
Published: (2025)
Enhancing Interpretability in Software Change Management with Chain-of-Thought Reasoning
by: Sun, Yongqian, et al.
Published: (2025)
by: Sun, Yongqian, et al.
Published: (2025)
Building AI Agents for Autonomous Clouds: Challenges and Design Principles
by: Shetty, Manish, et al.
Published: (2024)
by: Shetty, Manish, et al.
Published: (2024)
Towards Adaptive Software Agents for Debugging
by: Majdoub, Yacine, et al.
Published: (2025)
by: Majdoub, Yacine, et al.
Published: (2025)
The Visual Debugger Tool
by: Kräuter, Tim, et al.
Published: (2024)
by: Kräuter, Tim, et al.
Published: (2024)
AgentStepper: Interactive Debugging of Software Development Agents
by: Hutter, Robert, et al.
Published: (2026)
by: Hutter, Robert, et al.
Published: (2026)
A Grounded Theory of Debugging in Professional Software Engineering Practice
by: Li, Haolin, et al.
Published: (2026)
by: Li, Haolin, et al.
Published: (2026)
The Visual Debugger: Past, Present, and Future
by: Kräuter, Tim, et al.
Published: (2024)
by: Kräuter, Tim, et al.
Published: (2024)
Debug like a Human: A Large Language Model Debugger via Verifying Runtime Execution Step-by-step
by: Zhong, Li, et al.
Published: (2024)
by: Zhong, Li, et al.
Published: (2024)
ExeCoder: Empowering Large Language Models with Executability Representation for Code Translation
by: He, Minghua, et al.
Published: (2025)
by: He, Minghua, et al.
Published: (2025)
SWE-Arena: An Interactive Platform for Evaluating Foundation Models in Software Engineering
by: Zhao, Zhimin
Published: (2025)
by: Zhao, Zhimin
Published: (2025)
LogPurge: Log Data Purification for Anomaly Detection via Rule-Enhanced Filtering
by: Zhang, Shenglin, et al.
Published: (2025)
by: Zhang, Shenglin, et al.
Published: (2025)
An Interactive Debugger for Rust Trait Errors
by: Gray, Gavin, et al.
Published: (2025)
by: Gray, Gavin, et al.
Published: (2025)
DebugRepair: Enhancing LLM-Based Automated Program Repair via Self-Directed Debugging
by: Wu, Linhao, et al.
Published: (2026)
by: Wu, Linhao, et al.
Published: (2026)
WhyFlow: Interrogative Debugger for Sensemaking Taint Analysis
by: Yetiştiren, Burak, et al.
Published: (2025)
by: Yetiştiren, Burak, et al.
Published: (2025)
DebugTA: An LLM-Based Agent for Simplifying Debugging and Teaching in Programming Education
by: Fu, Lingyue, et al.
Published: (2025)
by: Fu, Lingyue, et al.
Published: (2025)
Agent That Debugs: Dynamic State-Guided Vulnerability Repair
by: Liu, Zhengyao, et al.
Published: (2025)
by: Liu, Zhengyao, et al.
Published: (2025)
Metamorphic Debugging for Accountable Software
by: Tizpaz-Niari, Saeid, et al.
Published: (2024)
by: Tizpaz-Niari, Saeid, et al.
Published: (2024)
Towards a Neural Debugger for Python
by: Beck, Maximilian, et al.
Published: (2026)
by: Beck, Maximilian, et al.
Published: (2026)
ArchAgent: Scalable Legacy Software Architecture Recovery with LLMs
by: Pan, Rusheng, et al.
Published: (2026)
by: Pan, Rusheng, et al.
Published: (2026)
RGD: Multi-LLM Based Agent Debugger via Refinement and Generation Guidance
by: Jin, Haolin, et al.
Published: (2024)
by: Jin, Haolin, et al.
Published: (2024)
Challenges and Practices in Quantum Software Testing and Debugging: Insights from Practitioners
by: Zappin, Jake, et al.
Published: (2025)
by: Zappin, Jake, et al.
Published: (2025)
Teaching Software Testing and Debugging with the Serious Game Sojourner under Sabotage
by: Straubinger, Philipp, et al.
Published: (2025)
by: Straubinger, Philipp, et al.
Published: (2025)
Unveiling the Energy Vampires: A Methodology for Debugging Software Energy Consumption
by: Roque, Enrique Barba, et al.
Published: (2024)
by: Roque, Enrique Barba, et al.
Published: (2024)
Unified Software Engineering Agent as AI Software Engineer
by: Applis, Leonhard, et al.
Published: (2025)
by: Applis, Leonhard, et al.
Published: (2025)
SyncMind: Measuring Agent Out-of-Sync Recovery in Collaborative Software Engineering
by: Guo, Xuehang, et al.
Published: (2025)
by: Guo, Xuehang, et al.
Published: (2025)
PaperDebugger: A Plugin-Based Multi-Agent System for In-Editor Academic Writing, Review, and Editing
by: Hou, Junyi, et al.
Published: (2025)
by: Hou, Junyi, et al.
Published: (2025)
Similar Items
-
EvidenT: An Evidence-Preserving Framework for Iterative System-Level Package Repair
by: Zhao, Chenyu, et al.
Published: (2026) -
Triage in Software Engineering: A Systematic Review of Research and Practice
by: Zhao, Yongxin, et al.
Published: (2025) -
Can Language Models Go Beyond Coding? Assessing the Capability of Language Models to Build Real-World Systems
by: Zhao, Chenyu, et al.
Published: (2025) -
A Benchmark for Language Models in Real-World System Building
by: Jin, Weilin, et al.
Published: (2026) -
UniDebugger: Hierarchical Multi-Agent Framework for Unified Software Debugging
by: Lee, Cheryl, et al.
Published: (2024)