RepoDebug: Repository-Level Multi-Task and Multi-Language Debugging Evaluation of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Jingjing, Liu, Zeming, Cheng, Zihao, He, Mengliang, Shi, Xiaoming, Guo, Yuhang, Zhu, Xiangrong, Guo, Yuanfang, Wang, Yunhong, Wang, Haifeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DebugBench: Evaluating Debugging Capability of Large Language Models
di: Tian, Runchu, et al.
Pubblicazione: (2024)
di: Tian, Runchu, et al.
Pubblicazione: (2024)
ToolSpectrum : Towards Personalized Tool Utilization for Large Language Models
di: Cheng, Zihao, et al.
Pubblicazione: (2025)
di: Cheng, Zihao, et al.
Pubblicazione: (2025)
Debugging with Open-Source Large Language Models: An Evaluation
di: Majdoub, Yacine, et al.
Pubblicazione: (2024)
di: Majdoub, Yacine, et al.
Pubblicazione: (2024)
Flow2Code: Evaluating Large Language Models for Flowchart-based Code Generation Capability
di: He, Mengliang, et al.
Pubblicazione: (2025)
di: He, Mengliang, et al.
Pubblicazione: (2025)
RepoScope: Leveraging Call Chain-Aware Multi-View Context for Repository-Level Code Generation
di: Liu, Yang, et al.
Pubblicazione: (2025)
di: Liu, Yang, et al.
Pubblicazione: (2025)
Precise Debugging Benchmark: Is Your Model Debugging or Regenerating?
di: Zhu, Wang Bill, et al.
Pubblicazione: (2026)
di: Zhu, Wang Bill, et al.
Pubblicazione: (2026)
DebugHarness: Emulating Human Dynamic Debugging for Autonomous Program Repair
di: Sun, Maolin, et al.
Pubblicazione: (2026)
di: Sun, Maolin, et al.
Pubblicazione: (2026)
DebugTA: An LLM-Based Agent for Simplifying Debugging and Teaching in Programming Education
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
ProDebug: An Automated Debugging System for Prolog
di: Brancas, Ricardo, et al.
Pubblicazione: (2026)
di: Brancas, Ricardo, et al.
Pubblicazione: (2026)
Timing Analysis Agent: Autonomous Multi-Corner Multi-Mode (MCMM) Timing Debugging with Timing Debug Relation Graph
di: Nainani, Jatin, et al.
Pubblicazione: (2025)
di: Nainani, Jatin, et al.
Pubblicazione: (2025)
Automated Multi-Source Debugging and Natural Language Error Explanation for Dashboard Applications
di: Tata, Devendra, et al.
Pubblicazione: (2026)
di: Tata, Devendra, et al.
Pubblicazione: (2026)
Large Language Model Guided Self-Debugging Code Generation
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)
RepoShapley: Shapley-Enhanced Context Filtering for Repository-Level Code Completion
di: Huo, Yu, et al.
Pubblicazione: (2026)
di: Huo, Yu, et al.
Pubblicazione: (2026)
Mutation Testing via Iterative Large Language Model-Driven Scientific Debugging
di: Straubinger, Philipp, et al.
Pubblicazione: (2025)
di: Straubinger, Philipp, et al.
Pubblicazione: (2025)
ChatDBG: Augmenting Debugging with Large Language Models
di: Levin, Kyla H., et al.
Pubblicazione: (2024)
di: Levin, Kyla H., et al.
Pubblicazione: (2024)
Architecture-Aware Multi-Design Generation for Repository-Level Feature Addition
di: Liu, Mingwei, et al.
Pubblicazione: (2026)
di: Liu, Mingwei, et al.
Pubblicazione: (2026)
SafeToolBench: Pioneering a Prospective Benchmark to Evaluating Tool Utilization Safety in LLMs
di: Xia, Hongfei, et al.
Pubblicazione: (2025)
di: Xia, Hongfei, et al.
Pubblicazione: (2025)
Fully Autonomous Programming using Iterative Multi-Agent Debugging with Large Language Models
di: Grishina, Anastasiia, et al.
Pubblicazione: (2025)
di: Grishina, Anastasiia, et al.
Pubblicazione: (2025)
Leveraging Print Debugging to Improve Code Generation in Large Language Models
di: Hu, Xueyu, et al.
Pubblicazione: (2024)
di: Hu, Xueyu, et al.
Pubblicazione: (2024)
RepoTransBench: A Real-World Multilingual Benchmark for Repository-Level Code Translation
di: Wang, Yanli, et al.
Pubblicazione: (2024)
di: Wang, Yanli, et al.
Pubblicazione: (2024)
Simulated Interactive Debugging
di: Noller, Yannic, et al.
Pubblicazione: (2025)
di: Noller, Yannic, et al.
Pubblicazione: (2025)
The Debugging Decay Index: Rethinking Debugging Strategies for Code LLMs
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)
RepoReviewer: A Local-First Multi-Agent Architecture for Repository-Level Code Review
di: Zhang, Peng
Pubblicazione: (2026)
di: Zhang, Peng
Pubblicazione: (2026)
Effective Large Language Model Debugging with Best-first Tree Search
di: Song, Jialin, et al.
Pubblicazione: (2024)
di: Song, Jialin, et al.
Pubblicazione: (2024)
UniDebugger: Hierarchical Multi-Agent Framework for Unified Software Debugging
di: Lee, Cheryl, et al.
Pubblicazione: (2024)
di: Lee, Cheryl, et al.
Pubblicazione: (2024)
ReposVul: A Repository-Level High-Quality Vulnerability Dataset
di: Wang, Xinchen, et al.
Pubblicazione: (2024)
di: Wang, Xinchen, et al.
Pubblicazione: (2024)
RepoMaster: Autonomous Exploration and Understanding of GitHub Repositories for Complex Task Solving
di: Wang, Huacan, et al.
Pubblicazione: (2025)
di: Wang, Huacan, et al.
Pubblicazione: (2025)
VeriDebug: A Unified LLM for Verilog Debugging via Contrastive Embedding and Guided Correction
di: Wang, Ning, et al.
Pubblicazione: (2025)
di: Wang, Ning, et al.
Pubblicazione: (2025)
DebugRepair: Enhancing LLM-Based Automated Program Repair via Self-Directed Debugging
di: Wu, Linhao, et al.
Pubblicazione: (2026)
di: Wu, Linhao, et al.
Pubblicazione: (2026)
Combining Logic with Large Language Models for Automatic Debugging and Repair of ASP Programs
di: Brancas, Ricardo, et al.
Pubblicazione: (2024)
di: Brancas, Ricardo, et al.
Pubblicazione: (2024)
RepoST: Scalable Repository-Level Coding Environment Construction with Sandbox Testing
di: Xie, Yiqing, et al.
Pubblicazione: (2025)
di: Xie, Yiqing, et al.
Pubblicazione: (2025)
RepoTransAgent: Multi-Agent LLM Framework for Repository-Aware Code Translation
di: Guan, Ziqi, et al.
Pubblicazione: (2025)
di: Guan, Ziqi, et al.
Pubblicazione: (2025)
RustRepoTrans: Repository-level Code Translation Benchmark Targeting Rust
di: Ou, Guangsheng, et al.
Pubblicazione: (2024)
di: Ou, Guangsheng, et al.
Pubblicazione: (2024)
MLDebugging: Towards Benchmarking Code Debugging Across Multi-Library Scenarios
di: Huang, Jinyang, et al.
Pubblicazione: (2025)
di: Huang, Jinyang, et al.
Pubblicazione: (2025)
RepoGenReflex: Enhancing Repository-Level Code Completion with Verbal Reinforcement and Retrieval-Augmented Generation
di: Wang, Jicheng, et al.
Pubblicazione: (2024)
di: Wang, Jicheng, et al.
Pubblicazione: (2024)
Online and Interactive Bayesian Inference Debugging
di: Nussbaumer, Nathanael, et al.
Pubblicazione: (2025)
di: Nussbaumer, Nathanael, et al.
Pubblicazione: (2025)
Agent That Debugs: Dynamic State-Guided Vulnerability Repair
di: Liu, Zhengyao, et al.
Pubblicazione: (2025)
di: Liu, Zhengyao, et al.
Pubblicazione: (2025)
Enhancing Debugging Skills with AI-Powered Assistance: A Real-Time Tool for Debugging Support
di: Artser, Elizaveta, et al.
Pubblicazione: (2026)
di: Artser, Elizaveta, et al.
Pubblicazione: (2026)
WDD: Weighted Delta Debugging
di: Zhou, Xintong, et al.
Pubblicazione: (2024)
di: Zhou, Xintong, et al.
Pubblicazione: (2024)
Debug2Fix: Can Interactive Debugging Help Coding Agents Fix More Bugs?
di: Garg, Spandan, et al.
Pubblicazione: (2026)
di: Garg, Spandan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
DebugBench: Evaluating Debugging Capability of Large Language Models
di: Tian, Runchu, et al.
Pubblicazione: (2024) -
ToolSpectrum : Towards Personalized Tool Utilization for Large Language Models
di: Cheng, Zihao, et al.
Pubblicazione: (2025) -
Debugging with Open-Source Large Language Models: An Evaluation
di: Majdoub, Yacine, et al.
Pubblicazione: (2024) -
Flow2Code: Evaluating Large Language Models for Flowchart-based Code Generation Capability
di: He, Mengliang, et al.
Pubblicazione: (2025) -
RepoScope: Leveraging Call Chain-Aware Multi-View Context for Repository-Level Code Generation
di: Liu, Yang, et al.
Pubblicazione: (2025)