NL-Debugging: Exploiting Natural Language as an Intermediate Representation for Code Debugging
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Weiming, Li, Qingyao, Dai, Xinyi, Chen, Jizheng, Du, Kounianhua, Liu, Weiwen, Wang, Yasheng, Tang, Ruiming, Yu, Yong, Zhang, Weinan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LogitsCoder: Towards Efficient Chain-of-Thought Path Search via Logits Preference Decoding for Code Generation
by: Chen, Jizheng, et al.
Published: (2026)
by: Chen, Jizheng, et al.
Published: (2026)
RethinkMCTS: Refining Erroneous Thoughts in Monte Carlo Tree Search for Code Generation
by: Li, Qingyao, et al.
Published: (2024)
by: Li, Qingyao, et al.
Published: (2024)
DebugTA: An LLM-Based Agent for Simplifying Debugging and Teaching in Programming Education
by: Fu, Lingyue, et al.
Published: (2025)
by: Fu, Lingyue, et al.
Published: (2025)
CodeGRAG: Bridging the Gap between Natural Language and Programming Language via Graphical Retrieval Augmented Generation
by: Du, Kounianhua, et al.
Published: (2024)
by: Du, Kounianhua, et al.
Published: (2024)
LLM4CD: Leveraging Large Language Models for Open-World Knowledge Augmented Cognitive Diagnosis
by: Zhang, Weiming, et al.
Published: (2025)
by: Zhang, Weiming, et al.
Published: (2025)
Boost, Disentangle, and Customize: A Robust System2-to-System1 Pipeline for Code Generation
by: Du, Kounianhua, et al.
Published: (2025)
by: Du, Kounianhua, et al.
Published: (2025)
Learning Structure and Knowledge Aware Representation with Large Language Models for Concept Recommendation
by: Li, Qingyao, et al.
Published: (2024)
by: Li, Qingyao, et al.
Published: (2024)
ELCoRec: Enhance Language Understanding with Co-Propagation of Numerical and Categorical Features for Recommendation
by: Chen, Jizheng, et al.
Published: (2024)
by: Chen, Jizheng, et al.
Published: (2024)
ATGen: Adversarial Reinforcement Learning for Test Case Generation
by: Li, Qingyao, et al.
Published: (2025)
by: Li, Qingyao, et al.
Published: (2025)
Adapting Large Language Models for Education: Foundational Capabilities, Potentials, and Challenges
by: Li, Qingyao, et al.
Published: (2023)
by: Li, Qingyao, et al.
Published: (2023)
A Survey on Multi-Turn Interaction Capabilities of Large Language Models
by: Zhang, Chen, et al.
Published: (2025)
by: Zhang, Chen, et al.
Published: (2025)
MdEval: Massively Multilingual Code Debugging
by: Liu, Shukai, et al.
Published: (2024)
by: Liu, Shukai, et al.
Published: (2024)
LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
by: Zhang, Kangning, et al.
Published: (2025)
by: Zhang, Kangning, et al.
Published: (2025)
PolyDebug: A Framework for Polyglot Debugging
by: Houdaille, Philémon, et al.
Published: (2025)
by: Houdaille, Philémon, et al.
Published: (2025)
DisCo: Towards Harmonious Disentanglement and Collaboration between Tabular and Semantic Space for Recommendation
by: Du, Kounianhua, et al.
Published: (2024)
by: Du, Kounianhua, et al.
Published: (2024)
Large Language Models Make Sample-Efficient Recommender Systems
by: Lin, Jianghao, et al.
Published: (2024)
by: Lin, Jianghao, et al.
Published: (2024)
DebugBench: Evaluating Debugging Capability of Large Language Models
by: Tian, Runchu, et al.
Published: (2024)
by: Tian, Runchu, et al.
Published: (2024)
ProDebug: An Automated Debugging System for Prolog
by: Brancas, Ricardo, et al.
Published: (2026)
by: Brancas, Ricardo, et al.
Published: (2026)
Precise Debugging Benchmark: Is Your Model Debugging or Regenerating?
by: Zhu, Wang Bill, et al.
Published: (2026)
by: Zhu, Wang Bill, et al.
Published: (2026)
MassTool: A Multi-Task Search-Based Tool Retrieval Framework for Large Language Models
by: Lin, Jianghao, et al.
Published: (2025)
by: Lin, Jianghao, et al.
Published: (2025)
WDD: Weighted Delta Debugging
by: Zhou, Xintong, et al.
Published: (2024)
by: Zhou, Xintong, et al.
Published: (2024)
Hear Your Code Fail, Voice-Assisted Debugging for Python
by: Amiri, Sayed Mahbub Hasan, et al.
Published: (2025)
by: Amiri, Sayed Mahbub Hasan, et al.
Published: (2025)
SINKT: A Structure-Aware Inductive Knowledge Tracing Model with Large Language Model
by: Fu, Lingyue, et al.
Published: (2024)
by: Fu, Lingyue, et al.
Published: (2024)
Leveraging Print Debugging to Improve Code Generation in Large Language Models
by: Hu, Xueyu, et al.
Published: (2024)
by: Hu, Xueyu, et al.
Published: (2024)
Adaptive Tool Use in Large Language Models with Meta-Cognition Trigger
by: Li, Wenjun, et al.
Published: (2025)
by: Li, Wenjun, et al.
Published: (2025)
CoIR: A Comprehensive Benchmark for Code Information Retrieval Models
by: Li, Xiangyang, et al.
Published: (2024)
by: Li, Xiangyang, et al.
Published: (2024)
Debugging Functional Programs by Interpretation
by: Whitington, John
Published: (2024)
by: Whitington, John
Published: (2024)
From Code to Correctness: Closing the Last Mile of Code Generation with Hierarchical Debugging
by: Shi, Yuling, et al.
Published: (2024)
by: Shi, Yuling, et al.
Published: (2024)
FlowFPX: Nimble Tools for Debugging Floating-Point Exceptions
by: Allred, Taylor, et al.
Published: (2024)
by: Allred, Taylor, et al.
Published: (2024)
Debugging Tabular Log as Dynamic Graphs
by: Liang, Chumeng, et al.
Published: (2025)
by: Liang, Chumeng, et al.
Published: (2025)
Learning Code-Edit Embedding to Model Student Debugging Behavior
by: Heickal, Hasnain, et al.
Published: (2025)
by: Heickal, Hasnain, et al.
Published: (2025)
Generative Representational Learning of Foundation Models for Recommendation
by: Zhou, Zheli, et al.
Published: (2025)
by: Zhou, Zheli, et al.
Published: (2025)
Interactive Prompt Debugging with Sequence Salience
by: Tenney, Ian, et al.
Published: (2024)
by: Tenney, Ian, et al.
Published: (2024)
Humanity's Last Code Exam: Can Advanced LLMs Conquer Human's Hardest Code Competition?
by: Li, Xiangyang, et al.
Published: (2025)
by: Li, Xiangyang, et al.
Published: (2025)
AdverMCTS: Combating Pseudo-Correctness in Code Generation via Adversarial Monte Carlo Tree Search
by: Li, Qingyao, et al.
Published: (2026)
by: Li, Qingyao, et al.
Published: (2026)
Metamorphic Debugging for Accountable Software
by: Tizpaz-Niari, Saeid, et al.
Published: (2024)
by: Tizpaz-Niari, Saeid, et al.
Published: (2024)
Spreadsheet Debugging
by: Ayalew, Yirsaw, et al.
Published: (2008)
by: Ayalew, Yirsaw, et al.
Published: (2008)
Modular Representation Compression: Adapting LLMs for Efficient and Effective Recommendations
by: Xi, Yunjia, et al.
Published: (2026)
by: Xi, Yunjia, et al.
Published: (2026)
CodeApex: A Bilingual Programming Evaluation Benchmark for Large Language Models
by: Fu, Lingyue, et al.
Published: (2023)
by: Fu, Lingyue, et al.
Published: (2023)
Visualizing the Evaluation of Functional Programs for Debugging
by: Whitington, John, et al.
Published: (2024)
by: Whitington, John, et al.
Published: (2024)
Similar Items
-
LogitsCoder: Towards Efficient Chain-of-Thought Path Search via Logits Preference Decoding for Code Generation
by: Chen, Jizheng, et al.
Published: (2026) -
RethinkMCTS: Refining Erroneous Thoughts in Monte Carlo Tree Search for Code Generation
by: Li, Qingyao, et al.
Published: (2024) -
DebugTA: An LLM-Based Agent for Simplifying Debugging and Teaching in Programming Education
by: Fu, Lingyue, et al.
Published: (2025) -
CodeGRAG: Bridging the Gap between Natural Language and Programming Language via Graphical Retrieval Augmented Generation
by: Du, Kounianhua, et al.
Published: (2024) -
LLM4CD: Leveraging Large Language Models for Open-World Knowledge Augmented Cognitive Diagnosis
by: Zhang, Weiming, et al.
Published: (2025)