PerfCodeGen: Improving Performance of LLM Generated Code with Execution Feedback
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Peng, Yun, Gotmare, Akhilesh Deepak, Lyu, Michael, Xiong, Caiming, Savarese, Silvio, Sahoo, Doyen |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
INDICT: Code Generation with Internal Dialogues of Critiques for Both Security and Helpfulness
par: Le, Hung, et autres
Publié: (2024)
par: Le, Hung, et autres
Publié: (2024)
GenX: Mastering Code and Test Generation with Execution Feedback
par: Wang, Nan, et autres
Publié: (2024)
par: Wang, Nan, et autres
Publié: (2024)
PerfCodeBench: Benchmarking LLMs for System-Level High-Performance Code Optimization
par: Jing, Huihao, et autres
Publié: (2026)
par: Jing, Huihao, et autres
Publié: (2026)
CodeBenchGen: Creating Scalable Execution-based Code Generation Benchmarks
par: Xie, Yiqing, et autres
Publié: (2024)
par: Xie, Yiqing, et autres
Publié: (2024)
Python Symbolic Execution with LLM-powered Code Generation
par: Wang, Wenhan, et autres
Publié: (2024)
par: Wang, Wenhan, et autres
Publié: (2024)
Defusing Logic Bombs in Symbolic Execution with LLM-Generated Ghost Code
par: Bouras, Dimitrios Stamatios, et autres
Publié: (2026)
par: Bouras, Dimitrios Stamatios, et autres
Publié: (2026)
CodeTree: Agent-guided Tree Search for Code Generation with Large Language Models
par: Li, Jierui, et autres
Publié: (2024)
par: Li, Jierui, et autres
Publié: (2024)
StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback
par: Dou, Shihan, et autres
Publié: (2024)
par: Dou, Shihan, et autres
Publié: (2024)
Executing as You Generate: Hiding Execution Latency in LLM Code Generation
par: Sun, Zhensu, et autres
Publié: (2026)
par: Sun, Zhensu, et autres
Publié: (2026)
CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
par: Jiang, Xue, et autres
Publié: (2025)
par: Jiang, Xue, et autres
Publié: (2025)
Improving Small Language Models for Code Generation with Reinforcement Learning from Verification Feedback
par: Skopin, Egor, et autres
Publié: (2026)
par: Skopin, Egor, et autres
Publié: (2026)
Code Fingerprints: Disentangled Attribution of LLM-Generated Code
par: Guo, Jiaxun, et autres
Publié: (2026)
par: Guo, Jiaxun, et autres
Publié: (2026)
Talk Less, Verify More: Improving LLM Assistants with Semantic Checks and Execution Feedback
par: Sun, Yan, et autres
Publié: (2026)
par: Sun, Yan, et autres
Publié: (2026)
Iterative Refinement of Project-Level Code Context for Precise Code Generation with Compiler Feedback
par: Bi, Zhangqian, et autres
Publié: (2024)
par: Bi, Zhangqian, et autres
Publié: (2024)
CodeSpecBench: Benchmarking LLMs for Executable Behavioral Specification Generation
par: Chen, Zaoyu, et autres
Publié: (2026)
par: Chen, Zaoyu, et autres
Publié: (2026)
OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement
par: Zheng, Tianyu, et autres
Publié: (2024)
par: Zheng, Tianyu, et autres
Publié: (2024)
CodeHalu: Investigating Code Hallucinations in LLMs via Execution-based Verification
par: Tian, Yuchen, et autres
Publié: (2024)
par: Tian, Yuchen, et autres
Publié: (2024)
DuET: Dual Execution for Test Output Prediction with Generated Code and Pseudocode
par: Han, Hojae, et autres
Publié: (2026)
par: Han, Hojae, et autres
Publié: (2026)
StepCodeReasoner: Aligning Code Reasoning with Stepwise Execution Traces via Reinforcement Learning
par: Wang, Hao, et autres
Publié: (2026)
par: Wang, Hao, et autres
Publié: (2026)
PerfRL: A Small Language Model Framework for Efficient Code Optimization
par: Duan, Shukai, et autres
Publié: (2023)
par: Duan, Shukai, et autres
Publié: (2023)
EffiPair: Improving the Efficiency of LLM-generated Code with Relative Contrastive Feedback
par: Hajizadeh, Samira, et autres
Publié: (2026)
par: Hajizadeh, Samira, et autres
Publié: (2026)
Evaluating and Achieving Controllable Code Completion in Code LLM
par: Zhang, Jiajun, et autres
Publié: (2026)
par: Zhang, Jiajun, et autres
Publié: (2026)
LLMSniffer: Detecting LLM-Generated Code via GraphCodeBERT and Supervised Contrastive Learning
par: Dihan, Mahir Labib, et autres
Publié: (2026)
par: Dihan, Mahir Labib, et autres
Publié: (2026)
CodeFlowBench: A Multi-turn, Iterative Benchmark for Complex Code Generation
par: Wang, Sizhe, et autres
Publié: (2025)
par: Wang, Sizhe, et autres
Publié: (2025)
ArtifactsBench: Bridging the Visual-Interactive Gap in LLM Code Generation Evaluation
par: Zhang, Chenchen, et autres
Publié: (2025)
par: Zhang, Chenchen, et autres
Publié: (2025)
Novel Preprocessing Technique for Data Embedding in Engineering Code Generation Using Large Language Model
par: Lin, Yu-Chen, et autres
Publié: (2023)
par: Lin, Yu-Chen, et autres
Publié: (2023)
Agent-Diff: Benchmarking LLM Agents on Enterprise API Tasks via Code Execution with State-Diff-Based Evaluation
par: Pysklo, Hubert M., et autres
Publié: (2026)
par: Pysklo, Hubert M., et autres
Publié: (2026)
Improving Code Generation by Training with Natural Language Feedback
par: Chen, Angelica, et autres
Publié: (2023)
par: Chen, Angelica, et autres
Publié: (2023)
ConvCodeWorld: Benchmarking Conversational Code Generation in Reproducible Feedback Environments
par: Han, Hojae, et autres
Publié: (2025)
par: Han, Hojae, et autres
Publié: (2025)
Measuring LLM Code Generation Stability via Structural Entropy
par: Song, Yewei, et autres
Publié: (2025)
par: Song, Yewei, et autres
Publié: (2025)
Showing LLM-Generated Code Selectively Based on Confidence of LLMs
par: Li, Jia, et autres
Publié: (2024)
par: Li, Jia, et autres
Publié: (2024)
BigCodeArena: Unveiling More Reliable Human Preferences in Code Generation via Execution
par: Zhuo, Terry Yue, et autres
Publié: (2025)
par: Zhuo, Terry Yue, et autres
Publié: (2025)
Evaluation of Code LLMs on Geospatial Code Generation
par: Gramacki, Piotr, et autres
Publié: (2024)
par: Gramacki, Piotr, et autres
Publié: (2024)
CodeUltraFeedback: An LLM-as-a-Judge Dataset for Aligning Large Language Models to Coding Preferences
par: Weyssow, Martin, et autres
Publié: (2024)
par: Weyssow, Martin, et autres
Publié: (2024)
CodeContests-O: Powering LLMs via Feedback-Driven Iterative Test Case Generation
par: Cai, Jianfeng, et autres
Publié: (2026)
par: Cai, Jianfeng, et autres
Publié: (2026)
Coffee: Boost Your Code LLMs by Fixing Bugs with Feedback
par: Moon, Seungjun, et autres
Publié: (2023)
par: Moon, Seungjun, et autres
Publié: (2023)
Leveraging Print Debugging to Improve Code Generation in Large Language Models
par: Hu, Xueyu, et autres
Publié: (2024)
par: Hu, Xueyu, et autres
Publié: (2024)
VersiCode: Towards Version-controllable Code Generation
par: Wu, Tongtong, et autres
Publié: (2024)
par: Wu, Tongtong, et autres
Publié: (2024)
CodeScope: An Execution-based Multilingual Multitask Multidimensional Benchmark for Evaluating LLMs on Code Understanding and Generation
par: Yan, Weixiang, et autres
Publié: (2023)
par: Yan, Weixiang, et autres
Publié: (2023)
Improving Code Localization with Repository Memory
par: Wang, Boshi, et autres
Publié: (2025)
par: Wang, Boshi, et autres
Publié: (2025)
Documents similaires
-
INDICT: Code Generation with Internal Dialogues of Critiques for Both Security and Helpfulness
par: Le, Hung, et autres
Publié: (2024) -
GenX: Mastering Code and Test Generation with Execution Feedback
par: Wang, Nan, et autres
Publié: (2024) -
PerfCodeBench: Benchmarking LLMs for System-Level High-Performance Code Optimization
par: Jing, Huihao, et autres
Publié: (2026) -
CodeBenchGen: Creating Scalable Execution-based Code Generation Benchmarks
par: Xie, Yiqing, et autres
Publié: (2024) -
Python Symbolic Execution with LLM-powered Code Generation
par: Wang, Wenhan, et autres
Publié: (2024)