Assessing Code Generation with Intermediate Languages
Fuente:
arXiv
Saved in:
| Main Authors: | Deng, Xun, Zhong, Sicheng, Dong, Honghua, Hu, Jingyu, Beillahi, Sidi Mohamed, Si, Xujie, Long, Fan |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
VerifyThisBench: Generating Code, Specifications, and Proofs All at Once
by: Deng, Xun, et al.
Published: (2025)
by: Deng, Xun, et al.
Published: (2025)
FlashSyn: Flash Loan Attack Synthesis via Counter Example Driven Approximation
by: Chen, Zhiyang, et al.
Published: (2022)
by: Chen, Zhiyang, et al.
Published: (2022)
Safeguarding DeFi Smart Contracts against Oracle Deviations
by: Deng, Xun, et al.
Published: (2024)
by: Deng, Xun, et al.
Published: (2024)
TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories
by: Dong, Honghua, et al.
Published: (2025)
by: Dong, Honghua, et al.
Published: (2025)
OpenTracer: A Dynamic Transaction Trace Analyzer for Smart Contract Invariant Generation and Beyond
by: Chen, Zhiyang, et al.
Published: (2024)
by: Chen, Zhiyang, et al.
Published: (2024)
RAG-Verus: Repository-Level Program Verification with LLMs using Retrieval Augmented Generation
by: Zhong, Sicheng, et al.
Published: (2025)
by: Zhong, Sicheng, et al.
Published: (2025)
Demystifying Invariant Effectiveness for Securing Smart Contracts
by: Chen, Zhiyang, et al.
Published: (2024)
by: Chen, Zhiyang, et al.
Published: (2024)
Scam2Prompt: A Scalable Framework for Auditing Malicious Scam Endpoints in Production LLMs
by: Chen, Zhiyang, et al.
Published: (2025)
by: Chen, Zhiyang, et al.
Published: (2025)
Towards Repository-Level Program Verification with Large Language Models
by: Zhong, Si Cheng, et al.
Published: (2025)
by: Zhong, Si Cheng, et al.
Published: (2025)
Enforcing Control Flow Integrity on DeFi Smart Contracts
by: Chen, Zhiyang, et al.
Published: (2025)
by: Chen, Zhiyang, et al.
Published: (2025)
Code Repair with LLMs gives an Exploration-Exploitation Tradeoff
by: Tang, Hao, et al.
Published: (2024)
by: Tang, Hao, et al.
Published: (2024)
CuTeGen: An LLM-Based Agentic Framework for Generation and Optimization of High-Performance GPU Kernels using CuTe
by: Saba, Tara, et al.
Published: (2026)
by: Saba, Tara, et al.
Published: (2026)
Assessing Small Language Models for Code Generation: An Empirical Study with Benchmarks
by: Hasan, Md Mahade, et al.
Published: (2025)
by: Hasan, Md Mahade, et al.
Published: (2025)
Beyond Code Generation: Assessing Code LLM Maturity with Postconditions
by: He, Fusen, et al.
Published: (2024)
by: He, Fusen, et al.
Published: (2024)
Seeker: Towards Exception Safety Code Generation with Intermediate Language Agents Framework
by: Zhang, Xuanming, et al.
Published: (2024)
by: Zhang, Xuanming, et al.
Published: (2024)
Chart2Code-MoLA: Efficient Multi-Modal Code Generation via Adaptive Expert Routing
by: Wang, Yifei, et al.
Published: (2025)
by: Wang, Yifei, et al.
Published: (2025)
Binary Code Similarity Detection via Graph Contrastive Learning on Intermediate Representations
by: Shang, Xiuwei, et al.
Published: (2024)
by: Shang, Xiuwei, et al.
Published: (2024)
Assessing the Impact of Requirement Ambiguity on LLM-based Function-Level Code Generation
by: Yang, Di, et al.
Published: (2026)
by: Yang, Di, et al.
Published: (2026)
NL in the Middle: Code Translation with LLMs and Intermediate Representations
by: Tai, Chi-en Amy, et al.
Published: (2025)
by: Tai, Chi-en Amy, et al.
Published: (2025)
A Benchmark for Evaluating Repository-Level Code Agents with Intermediate Reasoning on Feature Addition Task
by: Liu, Shuhan, et al.
Published: (2026)
by: Liu, Shuhan, et al.
Published: (2026)
Assessing AI-Based Code Assistants in Method Generation Tasks
by: Corso, Vincenzo, et al.
Published: (2024)
by: Corso, Vincenzo, et al.
Published: (2024)
A Hybrid Approach for EMF Code Generation:Code Templates Meet Large Language Models
by: He, Xiao, et al.
Published: (2025)
by: He, Xiao, et al.
Published: (2025)
Assessing and Improving the Representativeness of Code Generation Benchmarks Using Knowledge Units (KUs) of Programming Languages -- An Empirical Study
by: Ahasanuzzaman, Md, et al.
Published: (2026)
by: Ahasanuzzaman, Md, et al.
Published: (2026)
Assessing Coherency and Consistency of Code Execution Reasoning by Large Language Models
by: Liu, Changshu, et al.
Published: (2025)
by: Liu, Changshu, et al.
Published: (2025)
When is Generated Code Difficult to Comprehend? Assessing AI Agent Python Code Proficiency in the Wild
by: Temkulkiat, Nanthit, et al.
Published: (2026)
by: Temkulkiat, Nanthit, et al.
Published: (2026)
Self-planning Code Generation with Large Language Models
by: Jiang, Xue, et al.
Published: (2023)
by: Jiang, Xue, et al.
Published: (2023)
Assessing Correctness in LLM-Based Code Generation via Uncertainty Estimation
by: Sharma, Arindam, et al.
Published: (2025)
by: Sharma, Arindam, et al.
Published: (2025)
SAT-DIFF: A Tree Diffing Framework Using SAT Solving
by: Geng, Chuqin, et al.
Published: (2024)
by: Geng, Chuqin, et al.
Published: (2024)
Towards Exception Safety Code Generation with Intermediate Representation Agents Framework
by: Zhang, Xuanming, et al.
Published: (2024)
by: Zhang, Xuanming, et al.
Published: (2024)
Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation
by: Sarker, Laboni, et al.
Published: (2024)
by: Sarker, Laboni, et al.
Published: (2024)
TaskEval: Assessing Difficulty of Code Generation Tasks for Large Language Models
by: Tambon, Florian, et al.
Published: (2024)
by: Tambon, Florian, et al.
Published: (2024)
CodeScore: Evaluating Code Generation by Learning Code Execution
by: Dong, Yihong, et al.
Published: (2023)
by: Dong, Yihong, et al.
Published: (2023)
On the Effectiveness of Large Language Models in Domain-Specific Code Generation
by: Gu, Xiaodong, et al.
Published: (2023)
by: Gu, Xiaodong, et al.
Published: (2023)
Where Is Self-admitted Code Generated by Large Language Models on GitHub?
by: Yu, Xiao, et al.
Published: (2024)
by: Yu, Xiao, et al.
Published: (2024)
Beyond Strict Rules: Assessing the Effectiveness of Large Language Models for Code Smell Detection
by: Souza, Saymon, et al.
Published: (2026)
by: Souza, Saymon, et al.
Published: (2026)
AI builds, We Analyze: An Empirical Study of AI-Generated Build Code Quality
by: Ghammam, Anwar, et al.
Published: (2026)
by: Ghammam, Anwar, et al.
Published: (2026)
CodeMapper: A Language-Agnostic Approach to Mapping Code Regions Across Commits
by: Hu, Huimin, et al.
Published: (2025)
by: Hu, Huimin, et al.
Published: (2025)
Deep Assessment of Code Review Generation Approaches: Beyond Lexical Similarity
by: Jiang, Yanjie, et al.
Published: (2025)
by: Jiang, Yanjie, et al.
Published: (2025)
Can Language Models Go Beyond Coding? Assessing the Capability of Language Models to Build Real-World Systems
by: Zhao, Chenyu, et al.
Published: (2025)
by: Zhao, Chenyu, et al.
Published: (2025)
No Need to Lift a Finger Anymore? Assessing the Quality of Code Generation by ChatGPT
by: Liu, Zhijie, et al.
Published: (2023)
by: Liu, Zhijie, et al.
Published: (2023)
Similar Items
-
VerifyThisBench: Generating Code, Specifications, and Proofs All at Once
by: Deng, Xun, et al.
Published: (2025) -
FlashSyn: Flash Loan Attack Synthesis via Counter Example Driven Approximation
by: Chen, Zhiyang, et al.
Published: (2022) -
Safeguarding DeFi Smart Contracts against Oracle Deviations
by: Deng, Xun, et al.
Published: (2024) -
TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories
by: Dong, Honghua, et al.
Published: (2025) -
OpenTracer: A Dynamic Transaction Trace Analyzer for Smart Contract Invariant Generation and Beyond
by: Chen, Zhiyang, et al.
Published: (2024)