MLDebugging: Towards Benchmarking Code Debugging Across Multi-Library Scenarios
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Jinyang, Feng, Xiachong, Chen, Qiguang, Zhao, Hanjie, Cheng, Zihui, Bai, Jiesong, Zhou, Jingxuan, Li, Min, Qin, Libo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Agent That Debugs: Dynamic State-Guided Vulnerability Repair
di: Liu, Zhengyao, et al.
Pubblicazione: (2025)
di: Liu, Zhengyao, et al.
Pubblicazione: (2025)
Guided Debugging of Auto-Translated Code Using Differential Testing
di: Wu, Shengnan, et al.
Pubblicazione: (2025)
di: Wu, Shengnan, et al.
Pubblicazione: (2025)
Toward a Better Understanding of Probabilistic Delta Debugging
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
Precise Debugging Benchmark: Is Your Model Debugging or Regenerating?
di: Zhu, Wang Bill, et al.
Pubblicazione: (2026)
di: Zhu, Wang Bill, et al.
Pubblicazione: (2026)
The Debugging Decay Index: Rethinking Debugging Strategies for Code LLMs
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)
DebugHarness: Emulating Human Dynamic Debugging for Autonomous Program Repair
di: Sun, Maolin, et al.
Pubblicazione: (2026)
di: Sun, Maolin, et al.
Pubblicazione: (2026)
Towards Practical and Useful Automated Program Repair for Debugging
di: Xin, Qi, et al.
Pubblicazione: (2024)
di: Xin, Qi, et al.
Pubblicazione: (2024)
RepoDebug: Repository-Level Multi-Task and Multi-Language Debugging Evaluation of Large Language Models
di: Liu, Jingjing, et al.
Pubblicazione: (2025)
di: Liu, Jingjing, et al.
Pubblicazione: (2025)
DePro: Understanding the Role of LLMs in Debugging Competitive Programming Code
di: Parvez, Nabiha, et al.
Pubblicazione: (2026)
di: Parvez, Nabiha, et al.
Pubblicazione: (2026)
Debugging WebAssembly? Put some Whamm on it!
di: Gilbert, Elizabeth, et al.
Pubblicazione: (2025)
di: Gilbert, Elizabeth, et al.
Pubblicazione: (2025)
Debug2Fix: Can Interactive Debugging Help Coding Agents Fix More Bugs?
di: Garg, Spandan, et al.
Pubblicazione: (2026)
di: Garg, Spandan, et al.
Pubblicazione: (2026)
Revisit Self-Debugging with Self-Generated Tests for Code Generation
di: Chen, Xiancai, et al.
Pubblicazione: (2025)
di: Chen, Xiancai, et al.
Pubblicazione: (2025)
Towards Adaptive Software Agents for Debugging
di: Majdoub, Yacine, et al.
Pubblicazione: (2025)
di: Majdoub, Yacine, et al.
Pubblicazione: (2025)
Simulated Interactive Debugging
di: Noller, Yannic, et al.
Pubblicazione: (2025)
di: Noller, Yannic, et al.
Pubblicazione: (2025)
DebugTA: An LLM-Based Agent for Simplifying Debugging and Teaching in Programming Education
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
Enhancing LLM Code Generation: A Systematic Evaluation of Multi-Agent Collaboration and Runtime Debugging for Improved Accuracy, Reliability, and Latency
di: Ashrafi, Nazmus, et al.
Pubblicazione: (2025)
di: Ashrafi, Nazmus, et al.
Pubblicazione: (2025)
BugSpotter: Automated Generation of Code Debugging Exercises
di: Pădurean, Victor-Alexandru, et al.
Pubblicazione: (2024)
di: Pădurean, Victor-Alexandru, et al.
Pubblicazione: (2024)
UniDebugger: Hierarchical Multi-Agent Framework for Unified Software Debugging
di: Lee, Cheryl, et al.
Pubblicazione: (2024)
di: Lee, Cheryl, et al.
Pubblicazione: (2024)
An Exploratory Eye Tracking Study on How Developers Classify and Debug Python Code in Different Paradigms
di: Flint, Samuel W., et al.
Pubblicazione: (2025)
di: Flint, Samuel W., et al.
Pubblicazione: (2025)
DebugRepair: Enhancing LLM-Based Automated Program Repair via Self-Directed Debugging
di: Wu, Linhao, et al.
Pubblicazione: (2026)
di: Wu, Linhao, et al.
Pubblicazione: (2026)
ISS-Scenario: Scenario-based Testing in CARLA
di: Li, Renjue, et al.
Pubblicazione: (2024)
di: Li, Renjue, et al.
Pubblicazione: (2024)
Learning Code-Edit Embedding to Model Student Debugging Behavior
di: Heickal, Hasnain, et al.
Pubblicazione: (2025)
di: Heickal, Hasnain, et al.
Pubblicazione: (2025)
Large Language Model Guided Self-Debugging Code Generation
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)
ProDebug: An Automated Debugging System for Prolog
di: Brancas, Ricardo, et al.
Pubblicazione: (2026)
di: Brancas, Ricardo, et al.
Pubblicazione: (2026)
Timing Analysis Agent: Autonomous Multi-Corner Multi-Mode (MCMM) Timing Debugging with Timing Debug Relation Graph
di: Nainani, Jatin, et al.
Pubblicazione: (2025)
di: Nainani, Jatin, et al.
Pubblicazione: (2025)
AtPatch: Debugging Transformers via Hot-Fixing Over-Attention
di: Weng, Shihao, et al.
Pubblicazione: (2026)
di: Weng, Shihao, et al.
Pubblicazione: (2026)
Analyzing and Debugging Normative Requirements via Satisfiability Checking
di: Feng, Nick, et al.
Pubblicazione: (2024)
di: Feng, Nick, et al.
Pubblicazione: (2024)
WDD: Weighted Delta Debugging
di: Zhou, Xintong, et al.
Pubblicazione: (2024)
di: Zhou, Xintong, et al.
Pubblicazione: (2024)
Online and Interactive Bayesian Inference Debugging
di: Nussbaumer, Nathanael, et al.
Pubblicazione: (2025)
di: Nussbaumer, Nathanael, et al.
Pubblicazione: (2025)
Learning to Debug: LLM-Organized Knowledge Trees for Solving RTL Assertion Failures
di: Bai, Yunsheng, et al.
Pubblicazione: (2025)
di: Bai, Yunsheng, et al.
Pubblicazione: (2025)
Leveraging Print Debugging to Improve Code Generation in Large Language Models
di: Hu, Xueyu, et al.
Pubblicazione: (2024)
di: Hu, Xueyu, et al.
Pubblicazione: (2024)
Debugging Performance Issues in WebAssembly Runtimes via Mutation-based Inference
di: Zeng, Ruiying, et al.
Pubblicazione: (2026)
di: Zeng, Ruiying, et al.
Pubblicazione: (2026)
Industrial Code Quality Benchmarks: Toward Gamification of Software Maintainability
di: Borg, Markus, et al.
Pubblicazione: (2024)
di: Borg, Markus, et al.
Pubblicazione: (2024)
ScenEval: A Benchmark for Scenario-Based Evaluation of Code Generation
di: Paul, Debalina Ghosh, et al.
Pubblicazione: (2024)
di: Paul, Debalina Ghosh, et al.
Pubblicazione: (2024)
Locating Buggy Segments in Quantum Program Debugging
di: Sato, Naoto, et al.
Pubblicazione: (2023)
di: Sato, Naoto, et al.
Pubblicazione: (2023)
From Code to Correctness: Closing the Last Mile of Code Generation with Hierarchical Debugging
di: Shi, Yuling, et al.
Pubblicazione: (2024)
di: Shi, Yuling, et al.
Pubblicazione: (2024)
Benchmarking ChatGPT, Codeium, and GitHub Copilot: A Comparative Study of AI-Driven Programming and Debugging Assistants
di: Ovi, Md Sultanul Islam, et al.
Pubblicazione: (2024)
di: Ovi, Md Sultanul Islam, et al.
Pubblicazione: (2024)
DebugBench: Evaluating Debugging Capability of Large Language Models
di: Tian, Runchu, et al.
Pubblicazione: (2024)
di: Tian, Runchu, et al.
Pubblicazione: (2024)
Structural Verification for Reliable EDA Code Generation without Tool-in-the-Loop Debugging
di: Jayasuriya, Dinithi, et al.
Pubblicazione: (2026)
di: Jayasuriya, Dinithi, et al.
Pubblicazione: (2026)
CodeMMLU: A Multi-Task Benchmark for Assessing Code Understanding & Reasoning Capabilities of CodeLLMs
di: Manh, Dung Nguyen, et al.
Pubblicazione: (2024)
di: Manh, Dung Nguyen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Agent That Debugs: Dynamic State-Guided Vulnerability Repair
di: Liu, Zhengyao, et al.
Pubblicazione: (2025) -
Guided Debugging of Auto-Translated Code Using Differential Testing
di: Wu, Shengnan, et al.
Pubblicazione: (2025) -
Toward a Better Understanding of Probabilistic Delta Debugging
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024) -
Precise Debugging Benchmark: Is Your Model Debugging or Regenerating?
di: Zhu, Wang Bill, et al.
Pubblicazione: (2026) -
The Debugging Decay Index: Rethinking Debugging Strategies for Code LLMs
di: Adnan, Muntasir, et al.
Pubblicazione: (2025)