Enregistré dans:
| Auteurs principaux: | Lin, Zi, Shen, Sheng, Kulikov, Ilia, Shang, Jingbo, Weston, Jason, Nie, Yixin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2502.14948 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SolSearch: An LLM-Driven Framework for Efficient SAT-Solving Code Generation
par: Sheng, Junjie, et autres
Publié: (2025)
par: Sheng, Junjie, et autres
Publié: (2025)
CodeDPO: Aligning Code Models with Self Generated and Verified Source Code
par: Zhang, Kechi, et autres
Publié: (2024)
par: Zhang, Kechi, et autres
Publié: (2024)
Debug like a Human: A Large Language Model Debugger via Verifying Runtime Execution Step-by-step
par: Zhong, Li, et autres
Publié: (2024)
par: Zhong, Li, et autres
Publié: (2024)
Clover: Closed-Loop Verifiable Code Generation
par: Sun, Chuyue, et autres
Publié: (2023)
par: Sun, Chuyue, et autres
Publié: (2023)
An Iterative Test-and-Repair Framework for Competitive Code Generation
par: Tang, Lingxiao, et autres
Publié: (2026)
par: Tang, Lingxiao, et autres
Publié: (2026)
Revisit Self-Debugging with Self-Generated Tests for Code Generation
par: Chen, Xiancai, et autres
Publié: (2025)
par: Chen, Xiancai, et autres
Publié: (2025)
Self-planning Code Generation with Large Language Models
par: Jiang, Xue, et autres
Publié: (2023)
par: Jiang, Xue, et autres
Publié: (2023)
VerifyThisBench: Generating Code, Specifications, and Proofs All at Once
par: Deng, Xun, et autres
Publié: (2025)
par: Deng, Xun, et autres
Publié: (2025)
Efficient Incremental Code Coverage Analysis for Regression Test Suites
par: Wang, Jiale Amber, et autres
Publié: (2024)
par: Wang, Jiale Amber, et autres
Publié: (2024)
Understanding Self-Admitted Technical Debt in Test Code: An Empirical Study
par: Nakamura, Ibuki, et autres
Publié: (2025)
par: Nakamura, Ibuki, et autres
Publié: (2025)
PlayCoder: Making LLM-Generated GUI Code Playable
par: Peng, Zhiyuan, et autres
Publié: (2026)
par: Peng, Zhiyuan, et autres
Publié: (2026)
VeriScale: Adversarial Test-Suite Scaling for Verifiable Code Generation
par: Bai, Yifan, et autres
Publié: (2026)
par: Bai, Yifan, et autres
Publié: (2026)
DSTC: Direct Preference Learning with Only Self-Generated Tests and Code to Improve Code LMs
par: Liu, Zhihan, et autres
Publié: (2024)
par: Liu, Zhihan, et autres
Publié: (2024)
WybeCoder: Verified Imperative Code Generation
par: Gloeckle, Fabian, et autres
Publié: (2026)
par: Gloeckle, Fabian, et autres
Publié: (2026)
DEFT: Differentiable Automatic Test Pattern Generation
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
Effective Random Test Generation for Deep Learning Compilers
par: Ren, Luyao, et autres
Publié: (2023)
par: Ren, Luyao, et autres
Publié: (2023)
CRScore++: Reinforcement Learning with Verifiable Tool and AI Feedback for Code Review
par: Kapadnis, Manav Nitin, et autres
Publié: (2025)
par: Kapadnis, Manav Nitin, et autres
Publié: (2025)
CasModaTest: A Cascaded and Model-agnostic Self-directed Framework for Unit Test Generation
par: Ni, Chao, et autres
Publié: (2024)
par: Ni, Chao, et autres
Publié: (2024)
CodeCoR: An LLM-Based Self-Reflective Multi-Agent Framework for Code Generation
par: Pan, Ruwei, et autres
Publié: (2025)
par: Pan, Ruwei, et autres
Publié: (2025)
Klear-CodeTest: Scalable Test Case Generation for Code Reinforcement Learning
par: Fu, Jia, et autres
Publié: (2025)
par: Fu, Jia, et autres
Publié: (2025)
ExecVerify: White-Box RL with Verifiable Stepwise Rewards for Code Execution Reasoning
par: Tang, Lingxiao, et autres
Publié: (2026)
par: Tang, Lingxiao, et autres
Publié: (2026)
Detect Repair Verify for Securing LLM Generated Code: A Multi-Language Empirical Study
par: Cheng, Cheng
Publié: (2026)
par: Cheng, Cheng
Publié: (2026)
Interleaved Learning and Exploration: A Self-Adaptive Fuzz Testing Framework for MLIR
par: Sun, Zeyu, et autres
Publié: (2025)
par: Sun, Zeyu, et autres
Publié: (2025)
ACE: Self-Evolving LLM Coding Framework via Adversarial Unit Test Generation and Preference Optimization
par: Huang, Yixu, et autres
Publié: (2026)
par: Huang, Yixu, et autres
Publié: (2026)
WebVIA: A Web-based Vision-Language Agentic Framework for Interactive and Verifiable UI-to-Code Generation
par: Xu, Mingde, et autres
Publié: (2025)
par: Xu, Mingde, et autres
Publié: (2025)
Detect--Repair--Verify for LLM-Generated Code: A Multi-Language, Multi-Granularity Empirical Study
par: Cheng, Cheng
Publié: (2026)
par: Cheng, Cheng
Publié: (2026)
VeCoGen: Automating Generation of Formally Verified C Code with Large Language Models
par: Sevenhuijsen, Merlijn, et autres
Publié: (2024)
par: Sevenhuijsen, Merlijn, et autres
Publié: (2024)
R2Code: A Self-Reflective LLM Framework for Requirements-to-Code Traceability
par: Wang, Yifei, et autres
Publié: (2026)
par: Wang, Yifei, et autres
Publié: (2026)
Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution
par: Shang, Ye, et autres
Publié: (2026)
par: Shang, Ye, et autres
Publié: (2026)
BlueCodeAgent: A Blue Teaming Agent Enabled by Automated Red Teaming for CodeGen AI
par: Guo, Chengquan, et autres
Publié: (2025)
par: Guo, Chengquan, et autres
Publié: (2025)
ATLAS: Automated Toolkit for Large-Scale Verified Code Synthesis
par: Baksys, Mantas, et autres
Publié: (2025)
par: Baksys, Mantas, et autres
Publié: (2025)
TALM: Dynamic Tree-Structured Multi-Agent Framework with Long-Term Memory for Scalable Code Generation
par: Shen, Ming-Tung, et autres
Publié: (2025)
par: Shen, Ming-Tung, et autres
Publié: (2025)
Failure-Aware Enhancements for Large Language Model (LLM) Code Generation: An Empirical Study on Decision Framework
par: Shen, Jianru, et autres
Publié: (2026)
par: Shen, Jianru, et autres
Publié: (2026)
A Regression Testing Framework with Automated Assertion Generation for Machine Learning Notebooks
par: Yao, Yingao Elaine, et autres
Publié: (2025)
par: Yao, Yingao Elaine, et autres
Publié: (2025)
A First Look at the Self-Admitted Technical Debt in Test Code: Taxonomy and Detection
par: Islam, Shahidul, et autres
Publié: (2025)
par: Islam, Shahidul, et autres
Publié: (2025)
TENET: Leveraging Tests Beyond Validation for Code Generation
par: Hu, Yiran, et autres
Publié: (2025)
par: Hu, Yiran, et autres
Publié: (2025)
CYCLE: Learning to Self-Refine the Code Generation
par: Ding, Yangruibo, et autres
Publié: (2024)
par: Ding, Yangruibo, et autres
Publié: (2024)
Model Cascading for Code: A Cascaded Black-Box Multi-Model Framework for Cost-Efficient Code Completion with Self-Testing
par: Chen, Boyuan, et autres
Publié: (2024)
par: Chen, Boyuan, et autres
Publié: (2024)
Verifying LLM-Generated Code in the Context of Software Verification with Ada/SPARK
par: Cramer, Marcos, et autres
Publié: (2025)
par: Cramer, Marcos, et autres
Publié: (2025)
Can LLMs Solve Science or Just Write Code? Evaluating Quantum Solver Generation
par: Baresi, Luciano, et autres
Publié: (2026)
par: Baresi, Luciano, et autres
Publié: (2026)
Documents similaires
-
SolSearch: An LLM-Driven Framework for Efficient SAT-Solving Code Generation
par: Sheng, Junjie, et autres
Publié: (2025) -
CodeDPO: Aligning Code Models with Self Generated and Verified Source Code
par: Zhang, Kechi, et autres
Publié: (2024) -
Debug like a Human: A Large Language Model Debugger via Verifying Runtime Execution Step-by-step
par: Zhong, Li, et autres
Publié: (2024) -
Clover: Closed-Loop Verifiable Code Generation
par: Sun, Chuyue, et autres
Publié: (2023) -
An Iterative Test-and-Repair Framework for Competitive Code Generation
par: Tang, Lingxiao, et autres
Publié: (2026)