EvidenT: An Evidence-Preserving Framework for Iterative System-Level Package Repair
Fuente:
arXiv
Saved in:
| Main Authors: | Zhao, Chenyu, Ma, Minghua, Zhang, Shenglin, Huang, Zeshun, Sun, Yongqian, Bansal, Chetan, Rajmohan, Saravan, Pei, Dan |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Can Language Models Go Beyond Coding? Assessing the Capability of Language Models to Build Real-World Systems
by: Zhao, Chenyu, et al.
Published: (2025)
by: Zhao, Chenyu, et al.
Published: (2025)
Debugging the Debuggers: Failure-Anchored Structured Recovery for Software Engineering Agents
by: Zhao, Chenyu, et al.
Published: (2026)
by: Zhao, Chenyu, et al.
Published: (2026)
A Benchmark for Language Models in Real-World System Building
by: Jin, Weilin, et al.
Published: (2026)
by: Jin, Weilin, et al.
Published: (2026)
Triage in Software Engineering: A Systematic Review of Research and Practice
by: Zhao, Yongxin, et al.
Published: (2025)
by: Zhao, Yongxin, et al.
Published: (2025)
Automated Root Causing of Cloud Incidents using In-Context Learning with GPT-4
by: Zhang, Xuchao, et al.
Published: (2024)
by: Zhang, Xuchao, et al.
Published: (2024)
Failure Diagnosis in Microservice Systems: A Comprehensive Survey and Analysis
by: Zhang, Shenglin, et al.
Published: (2024)
by: Zhang, Shenglin, et al.
Published: (2024)
eARCO: Efficient Automated Root Cause Analysis with Prompt Optimization
by: Goel, Drishti, et al.
Published: (2025)
by: Goel, Drishti, et al.
Published: (2025)
AIOpsLab: A Holistic Framework to Evaluate AI Agents for Enabling Autonomous Clouds
by: Chen, Yinfang, et al.
Published: (2025)
by: Chen, Yinfang, et al.
Published: (2025)
TrioXpert: An Automated Incident Management Framework for Microservice System
by: Sun, Yongqian, et al.
Published: (2025)
by: Sun, Yongqian, et al.
Published: (2025)
Exploring LLM-based Agents for Root Cause Analysis
by: Roy, Devjeet, et al.
Published: (2024)
by: Roy, Devjeet, et al.
Published: (2024)
Continuous Benchmark Generation for Evaluating Enterprise-scale LLM Agents
by: Saxena, Divyanshu, et al.
Published: (2025)
by: Saxena, Divyanshu, et al.
Published: (2025)
Which Types of Heterogeneity Matter for Root Cause Localization in Microservice Systems ?
by: Wang, Runzhou, et al.
Published: (2026)
by: Wang, Runzhou, et al.
Published: (2026)
LogPurge: Log Data Purification for Anomaly Detection via Rule-Enhanced Filtering
by: Zhang, Shenglin, et al.
Published: (2025)
by: Zhang, Shenglin, et al.
Published: (2025)
ExeCoder: Empowering Large Language Models with Executability Representation for Code Translation
by: He, Minghua, et al.
Published: (2025)
by: He, Minghua, et al.
Published: (2025)
Enhancing Interpretability in Software Change Management with Chain-of-Thought Reasoning
by: Sun, Yongqian, et al.
Published: (2025)
by: Sun, Yongqian, et al.
Published: (2025)
DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems
by: Ma, Ming, et al.
Published: (2025)
by: Ma, Ming, et al.
Published: (2025)
An Iterative Test-and-Repair Framework for Competitive Code Generation
by: Tang, Lingxiao, et al.
Published: (2026)
by: Tang, Lingxiao, et al.
Published: (2026)
Building AI Agents for Autonomous Clouds: Challenges and Design Principles
by: Shetty, Manish, et al.
Published: (2024)
by: Shetty, Manish, et al.
Published: (2024)
From Task to Tutorial: An Automated GUI Framework for Excel Tutorial Document and Video Creation
by: Xie, Yuhang, et al.
Published: (2025)
by: Xie, Yuhang, et al.
Published: (2025)
AllHands: Ask Me Anything on Large-scale Verbatim Feedback via Large Language Models
by: Zhang, Chaoyun, et al.
Published: (2024)
by: Zhang, Chaoyun, et al.
Published: (2024)
DynaFix: Iterative Automated Program Repair Driven by Execution-Level Dynamic Information
by: Huang, Zhili, et al.
Published: (2025)
by: Huang, Zhili, et al.
Published: (2025)
EviACT: An Evidence-to-Action Framework for Agentic Program Repair
by: Meng, Qianru, et al.
Published: (2026)
by: Meng, Qianru, et al.
Published: (2026)
Generality Is Not Enough: Zero-Label Cross-System Log-Based Anomaly Detection via Knowledge-Level Collaboration
by: Zhao, Xinlong, et al.
Published: (2025)
by: Zhao, Xinlong, et al.
Published: (2025)
ConAIR:Consistency-Augmented Iterative Interaction Framework to Enhance the Reliability of Code Generation
by: Dong, Jinhao, et al.
Published: (2024)
by: Dong, Jinhao, et al.
Published: (2024)
Well Begun is Half Done: Location-Aware and Trace-Guided Iterative Automated Vulnerability Repair
by: Ye, Zhenlei, et al.
Published: (2025)
by: Ye, Zhenlei, et al.
Published: (2025)
An Empirical Study on Package-Level Deprecation in Python Ecosystem
by: Zhong, Zhiqing, et al.
Published: (2024)
by: Zhong, Zhiqing, et al.
Published: (2024)
RepoGenesis: Benchmarking End-to-End Microservice Generation from Readme to Repository
by: Peng, Zhiyuan, et al.
Published: (2026)
by: Peng, Zhiyuan, et al.
Published: (2026)
SGAgent: Suggestion-Guided LLM-Based Multi-Agent Framework for Repository-Level Software Repair
by: Zhang, Quanjun, et al.
Published: (2026)
by: Zhang, Quanjun, et al.
Published: (2026)
DebugRepair: Enhancing LLM-Based Automated Program Repair via Self-Directed Debugging
by: Wu, Linhao, et al.
Published: (2026)
by: Wu, Linhao, et al.
Published: (2026)
Package-Aware Approach for Repository-Level Code Completion in Pharo
by: Abedelkader, Omar, et al.
Published: (2026)
by: Abedelkader, Omar, et al.
Published: (2026)
Package Dashboard: A Cross-Ecosystem Framework for Dual-Perspective Analysis of Software Packages
by: Liu, Ziheng, et al.
Published: (2025)
by: Liu, Ziheng, et al.
Published: (2025)
TSAPR: A Tree Search Framework For Automated Program Repair
by: Hu, Haichuan, et al.
Published: (2025)
by: Hu, Haichuan, et al.
Published: (2025)
PAFT: Preservation Aware Fine-Tuning for Minimal-Edit Program Repair
by: Yang, Boyang, et al.
Published: (2026)
by: Yang, Boyang, et al.
Published: (2026)
From Historical Patches to Repair Plans: Outcome-Conditioned Reasoning for Repository-Level Program Repair
by: Li, Chenglin, et al.
Published: (2026)
by: Li, Chenglin, et al.
Published: (2026)
LogLM: From Task-based to Instruction-based Automated Log Analysis
by: Liu, Yilun, et al.
Published: (2024)
by: Liu, Yilun, et al.
Published: (2024)
ITER: Iterative Neural Repair for Multi-Location Patches
by: Ye, He, et al.
Published: (2023)
by: Ye, He, et al.
Published: (2023)
VarParser: Unleashing the Neglected Power of Variables for LLM-based Log Parsing
by: Sun, Jinrui, et al.
Published: (2026)
by: Sun, Jinrui, et al.
Published: (2026)
Practical Guidelines for the Selection and Evaluation of Natural Language Processing Techniques in Requirements Engineering
by: Sabetzadeh, Mehrdad, et al.
Published: (2024)
by: Sabetzadeh, Mehrdad, et al.
Published: (2024)
Walk the Talk: Is Your Log-based Software Reliability Maintenance System Really Reliable?
by: He, Minghua, et al.
Published: (2025)
by: He, Minghua, et al.
Published: (2025)
VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities
by: Wang, Weizhe, et al.
Published: (2025)
by: Wang, Weizhe, et al.
Published: (2025)
Similar Items
-
Can Language Models Go Beyond Coding? Assessing the Capability of Language Models to Build Real-World Systems
by: Zhao, Chenyu, et al.
Published: (2025) -
Debugging the Debuggers: Failure-Anchored Structured Recovery for Software Engineering Agents
by: Zhao, Chenyu, et al.
Published: (2026) -
A Benchmark for Language Models in Real-World System Building
by: Jin, Weilin, et al.
Published: (2026) -
Triage in Software Engineering: A Systematic Review of Research and Practice
by: Zhao, Yongxin, et al.
Published: (2025) -
Automated Root Causing of Cloud Incidents using In-Context Learning with GPT-4
by: Zhang, Xuchao, et al.
Published: (2024)