Towards Exception Safety Code Generation with Intermediate Representation Agents Framework
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Xuanming, Chen, Yuxuan, Yuan, Yuan, Huang, Minlie |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Seeker: Towards Exception Safety Code Generation with Intermediate Language Agents Framework
por: Zhang, Xuanming, et al.
Publicado: (2024)
por: Zhang, Xuanming, et al.
Publicado: (2024)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
por: Li, Jia, et al.
Publicado: (2024)
por: Li, Jia, et al.
Publicado: (2024)
EvoCodeBench: An Evolving Code Generation Benchmark Aligned with Real-World Code Repositories
por: Li, Jia, et al.
Publicado: (2024)
por: Li, Jia, et al.
Publicado: (2024)
VersiCode: Towards Version-controllable Code Generation
por: Wu, Tongtong, et al.
Publicado: (2024)
por: Wu, Tongtong, et al.
Publicado: (2024)
DevEval: A Manually-Annotated Code Generation Benchmark Aligned with Real-World Code Repositories
por: Li, Jia, et al.
Publicado: (2024)
por: Li, Jia, et al.
Publicado: (2024)
Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks
por: Zhao, Songwen, et al.
Publicado: (2025)
por: Zhao, Songwen, et al.
Publicado: (2025)
Enhancing Code LLMs with Reinforcement Learning in Code Generation: A Survey
por: Wang, Junqiao, et al.
Publicado: (2024)
por: Wang, Junqiao, et al.
Publicado: (2024)
KCoEvo: A Knowledge Graph Augmented Framework for Evolutionary Code Generation
por: Kang, Jiazhen, et al.
Publicado: (2026)
por: Kang, Jiazhen, et al.
Publicado: (2026)
Dafny as Verification-Aware Intermediate Language for Code Generation
por: Li, Yue Chen, et al.
Publicado: (2025)
por: Li, Yue Chen, et al.
Publicado: (2025)
CodeSpecBench: Benchmarking LLMs for Executable Behavioral Specification Generation
por: Chen, Zaoyu, et al.
Publicado: (2026)
por: Chen, Zaoyu, et al.
Publicado: (2026)
Measuring the Influence of Incorrect Code on Test Generation
por: Huang, Dong, et al.
Publicado: (2024)
por: Huang, Dong, et al.
Publicado: (2024)
Generating Equivalent Representations of Code By A Self-Reflection Approach
por: Li, Jia, et al.
Publicado: (2024)
por: Li, Jia, et al.
Publicado: (2024)
Selective Prompt Anchoring for Code Generation
por: Tian, Yuan, et al.
Publicado: (2024)
por: Tian, Yuan, et al.
Publicado: (2024)
EffiBench: Benchmarking the Efficiency of Automatically Generated Code
por: Huang, Dong, et al.
Publicado: (2024)
por: Huang, Dong, et al.
Publicado: (2024)
Automatically Benchmarking LLM Code Agents through Agent-Driven Annotation and Evaluation
por: Fu, Lingyue, et al.
Publicado: (2025)
por: Fu, Lingyue, et al.
Publicado: (2025)
From Code Foundation Models to Agents and Applications: A Comprehensive Survey and Practical Guide to Code Intelligence
por: Yang, Jian, et al.
Publicado: (2025)
por: Yang, Jian, et al.
Publicado: (2025)
SWE-Pruner: Self-Adaptive Context Pruning for Coding Agents
por: Wang, Yuhang, et al.
Publicado: (2026)
por: Wang, Yuhang, et al.
Publicado: (2026)
Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval
por: Wang, Jiexin, et al.
Publicado: (2024)
por: Wang, Jiexin, et al.
Publicado: (2024)
Code Fingerprints: Disentangled Attribution of LLM-Generated Code
por: Guo, Jiaxun, et al.
Publicado: (2026)
por: Guo, Jiaxun, et al.
Publicado: (2026)
Is Your Benchmark (Still) Useful? Dynamic Benchmarking for Code Language Models
por: Guan, Batu, et al.
Publicado: (2025)
por: Guan, Batu, et al.
Publicado: (2025)
Unveiling the Power of Intermediate Representations for Static Analysis: A Survey
por: Zhang, Bowen, et al.
Publicado: (2024)
por: Zhang, Bowen, et al.
Publicado: (2024)
ProjectEval: A Benchmark for Programming Agents Automated Evaluation on Project-Level Code Generation
por: Liu, Kaiyuan, et al.
Publicado: (2025)
por: Liu, Kaiyuan, et al.
Publicado: (2025)
SceneGenAgent: Precise Industrial Scene Generation with Coding Agent
por: Xia, Xiao, et al.
Publicado: (2024)
por: Xia, Xiao, et al.
Publicado: (2024)
CoreCodeBench: Decoupling Code Intelligence via Fine-Grained Repository-Level Tasks
por: Fu, Lingyue, et al.
Publicado: (2025)
por: Fu, Lingyue, et al.
Publicado: (2025)
GenX: Mastering Code and Test Generation with Execution Feedback
por: Wang, Nan, et al.
Publicado: (2024)
por: Wang, Nan, et al.
Publicado: (2024)
Evaluation of Code LLMs on Geospatial Code Generation
por: Gramacki, Piotr, et al.
Publicado: (2024)
por: Gramacki, Piotr, et al.
Publicado: (2024)
EffiLearner: Enhancing Efficiency of Generated Code via Self-Optimization
por: Huang, Dong, et al.
Publicado: (2024)
por: Huang, Dong, et al.
Publicado: (2024)
FairCoder: Evaluating Social Bias of LLMs in Code Generation
por: Du, Yongkang, et al.
Publicado: (2025)
por: Du, Yongkang, et al.
Publicado: (2025)
Iterative Refinement of Project-Level Code Context for Precise Code Generation with Compiler Feedback
por: Bi, Zhangqian, et al.
Publicado: (2024)
por: Bi, Zhangqian, et al.
Publicado: (2024)
DevEval: Evaluating Code Generation in Practical Software Projects
por: Li, Jia, et al.
Publicado: (2024)
por: Li, Jia, et al.
Publicado: (2024)
AgentPack: A Dataset of Code Changes, Co-Authored by Agents and Humans
por: Zi, Yangtian, et al.
Publicado: (2025)
por: Zi, Yangtian, et al.
Publicado: (2025)
EffiSkill: Agent Skill Based Automated Code Efficiency Optimization
por: Wang, Zimu, et al.
Publicado: (2026)
por: Wang, Zimu, et al.
Publicado: (2026)
AutoCodeBench: Large Language Models are Automatic Code Benchmark Generators
por: Chou, Jason, et al.
Publicado: (2025)
por: Chou, Jason, et al.
Publicado: (2025)
Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses
por: Lin, Jiahang, et al.
Publicado: (2026)
por: Lin, Jiahang, et al.
Publicado: (2026)
BeyondSWE: Can Current Code Agent Survive Beyond Single-Repo Bug Fixing?
por: Chen, Guoxin, et al.
Publicado: (2026)
por: Chen, Guoxin, et al.
Publicado: (2026)
VisCoder2: Building Multi-Language Visualization Coding Agents
por: Ni, Yuansheng, et al.
Publicado: (2025)
por: Ni, Yuansheng, et al.
Publicado: (2025)
CodeFlowBench: A Multi-turn, Iterative Benchmark for Complex Code Generation
por: Wang, Sizhe, et al.
Publicado: (2025)
por: Wang, Sizhe, et al.
Publicado: (2025)
StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback
por: Dou, Shihan, et al.
Publicado: (2024)
por: Dou, Shihan, et al.
Publicado: (2024)
CodeRAG-Bench: Can Retrieval Augment Code Generation?
por: Wang, Zora Zhiruo, et al.
Publicado: (2024)
por: Wang, Zora Zhiruo, et al.
Publicado: (2024)
FEA-Bench: A Benchmark for Evaluating Repository-Level Code Generation for Feature Implementation
por: Li, Wei, et al.
Publicado: (2025)
por: Li, Wei, et al.
Publicado: (2025)
Ejemplares similares
-
Seeker: Towards Exception Safety Code Generation with Intermediate Language Agents Framework
por: Zhang, Xuanming, et al.
Publicado: (2024) -
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
por: Li, Jia, et al.
Publicado: (2024) -
EvoCodeBench: An Evolving Code Generation Benchmark Aligned with Real-World Code Repositories
por: Li, Jia, et al.
Publicado: (2024) -
VersiCode: Towards Version-controllable Code Generation
por: Wu, Tongtong, et al.
Publicado: (2024) -
DevEval: A Manually-Annotated Code Generation Benchmark Aligned with Real-World Code Repositories
por: Li, Jia, et al.
Publicado: (2024)