A Survey of Large Language Models for Code: Evolution, Benchmarking, and Future Trends
Fuente:
arXiv
Salvato in:
| Autori principali: | Zheng, Zibin, Ning, Kaiwen, Wang, Yanlin, Zhang, Jingwen, Zheng, Dewu, Ye, Mingxi, Chen, Jiachi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HumanEvo: An Evolution-aware Benchmark for More Realistic Evaluation of Repository-level Code Generation
di: Zheng, Dewu, et al.
Pubblicazione: (2024)
di: Zheng, Dewu, et al.
Pubblicazione: (2024)
Towards an Understanding of Large Language Models in Software Engineering Tasks
di: Zheng, Zibin, et al.
Pubblicazione: (2023)
di: Zheng, Zibin, et al.
Pubblicazione: (2023)
Defining and Detecting the Defects of the Large Language Model-based Autonomous Agents
di: Ning, Kaiwen, et al.
Pubblicazione: (2024)
di: Ning, Kaiwen, et al.
Pubblicazione: (2024)
RMCBench: Benchmarking Large Language Models' Resistance to Malicious Code
di: Chen, Jiachi, et al.
Pubblicazione: (2024)
di: Chen, Jiachi, et al.
Pubblicazione: (2024)
SmartReco: Detecting Read-Only Reentrancy via Fine-Grained Cross-DApp Analysis
di: Zhang, Jingwen, et al.
Pubblicazione: (2024)
di: Zhang, Jingwen, et al.
Pubblicazione: (2024)
DAppSCAN: Building Large-Scale Datasets for Smart Contract Weaknesses in DApp Projects
di: Zheng, Zibin, et al.
Pubblicazione: (2023)
di: Zheng, Zibin, et al.
Pubblicazione: (2023)
Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark
di: Zheng, Dewu, et al.
Pubblicazione: (2024)
di: Zheng, Dewu, et al.
Pubblicazione: (2024)
An Empirical Study on Low-Code Programming using Traditional vs Large Language Model Support
di: Liu, Yongkun, et al.
Pubblicazione: (2024)
di: Liu, Yongkun, et al.
Pubblicazione: (2024)
MCGMark: An Encodable and Robust Online Watermark for Tracing LLM-Generated Malicious Code
di: Ning, Kaiwen, et al.
Pubblicazione: (2024)
di: Ning, Kaiwen, et al.
Pubblicazione: (2024)
LLM Hallucinations in Practical Code Generation: Phenomena, Mechanism, and Mitigation
di: Zhang, Ziyao, et al.
Pubblicazione: (2024)
di: Zhang, Ziyao, et al.
Pubblicazione: (2024)
Beyond Functional Correctness: Investigating Coding Style Inconsistencies in Large Language Models
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
SimpleDevQA: Benchmarking Large Language Models on Development Knowledge QA
di: Zhang, Jing, et al.
Pubblicazione: (2025)
di: Zhang, Jing, et al.
Pubblicazione: (2025)
RLCoder: Reinforcement Learning for Repository-Level Code Completion
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
Identifying Smart Contract Security Issues in Code Snippets from Stack Overflow
di: Chen, Jiachi, et al.
Pubblicazione: (2024)
di: Chen, Jiachi, et al.
Pubblicazione: (2024)
RealSec-bench: A Benchmark for Evaluating Secure Code Generation in Real-World Repositories
di: Wang, Yanlin, et al.
Pubblicazione: (2026)
di: Wang, Yanlin, et al.
Pubblicazione: (2026)
Efficiently Detecting Reentrancy Vulnerabilities in Complex Smart Contracts
di: Wang, Zexu, et al.
Pubblicazione: (2024)
di: Wang, Zexu, et al.
Pubblicazione: (2024)
V2E: Validating Smart Contract Vulnerabilities through Profit-driven Exploit Generation and Execution
di: Zhang, Jingwen, et al.
Pubblicazione: (2026)
di: Zhang, Jingwen, et al.
Pubblicazione: (2026)
Towards an Understanding of Context Utilization in Code Intelligence
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
FeedbackEval: A Benchmark for Evaluating Large Language Models in Feedback-Driven Code Repair Tasks
di: Dai, Dekun, et al.
Pubblicazione: (2025)
di: Dai, Dekun, et al.
Pubblicazione: (2025)
A Preliminary Study on the Robustness of Code Generation by Large Language Models
di: Li, Zike, et al.
Pubblicazione: (2025)
di: Li, Zike, et al.
Pubblicazione: (2025)
When to Stop? Towards Efficient Code Generation in LLMs with Excess Token Prevention
di: Guo, Lianghong, et al.
Pubblicazione: (2024)
di: Guo, Lianghong, et al.
Pubblicazione: (2024)
RustRepoTrans: Repository-level Code Translation Benchmark Targeting Rust
di: Ou, Guangsheng, et al.
Pubblicazione: (2024)
di: Ou, Guangsheng, et al.
Pubblicazione: (2024)
EffiReasonTrans: RL-Optimized Reasoning for Code Translation
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
Are Decoder-Only Large Language Models the Silver Bullet for Code Search?
di: Chen, Yuxuan, et al.
Pubblicazione: (2024)
di: Chen, Yuxuan, et al.
Pubblicazione: (2024)
SSR: Safeguarding Staking Rewards by Defining and Detecting Logical Defects in DeFi Staking
di: Lin, Zewei, et al.
Pubblicazione: (2026)
di: Lin, Zewei, et al.
Pubblicazione: (2026)
A Hierarchical and Evolvable Benchmark for Fine-Grained Code Instruction Following with Multi-Turn Feedback
di: Duan, Guoliang, et al.
Pubblicazione: (2025)
di: Duan, Guoliang, et al.
Pubblicazione: (2025)
AlignCoder: Aligning Retrieval with Target Intent for Repository-Level Code Completion
di: Jiang, Tianyue, et al.
Pubblicazione: (2026)
di: Jiang, Tianyue, et al.
Pubblicazione: (2026)
An Empirical Study of Agent Developer Practices in AI Agent Frameworks
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
Copy-and-Paste? Identifying EVM-Inequivalent Code Smells in Multi-chain Reuse Contracts
di: Wang, Zexu, et al.
Pubblicazione: (2025)
di: Wang, Zexu, et al.
Pubblicazione: (2025)
OmniGIRL: A Multilingual and Multimodal Benchmark for GitHub Issue Resolution
di: Guo, Lianghong, et al.
Pubblicazione: (2025)
di: Guo, Lianghong, et al.
Pubblicazione: (2025)
SparseCoder: Identifier-Aware Sparse Transformer for File-Level Code Summarization
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
ParityFuzz: Finding Inconsistencies across Solidity Compilers via Fine-Grained Mutation and Differential Analysis
di: Su, Bowei, et al.
Pubblicazione: (2026)
di: Su, Bowei, et al.
Pubblicazione: (2026)
DRAINCODE: Stealthy Energy Consumption Attacks on Retrieval-Augmented Code Generation via Context Poisoning
di: Wang, Yanlin, et al.
Pubblicazione: (2026)
di: Wang, Yanlin, et al.
Pubblicazione: (2026)
You Augment Me: Exploring ChatGPT-based Data Augmentation for Semantic Code Search
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
RustEvo^2: An Evolving Benchmark for API Evolution in LLM-based Rust Code Generation
di: Liang, Linxi, et al.
Pubblicazione: (2025)
di: Liang, Linxi, et al.
Pubblicazione: (2025)
NumScout: Unveiling Numerical Defects in Smart Contracts using LLM-Pruning Symbolic Execution
di: Chen, Jiachi, et al.
Pubblicazione: (2025)
di: Chen, Jiachi, et al.
Pubblicazione: (2025)
CoSQA+: Pioneering the Multi-Choice Code Search Benchmark with Test-Driven Agents
di: Gong, Jing, et al.
Pubblicazione: (2024)
di: Gong, Jing, et al.
Pubblicazione: (2024)
Definition and Detection of Centralization Defects in Smart Contracts
di: Lin, Zewei, et al.
Pubblicazione: (2024)
di: Lin, Zewei, et al.
Pubblicazione: (2024)
Hyperion: Unveiling DApp Inconsistencies using LLM and Dataflow-Guided Symbolic Execution
di: Yang, Shuo, et al.
Pubblicazione: (2024)
di: Yang, Shuo, et al.
Pubblicazione: (2024)
RepoTransBench: A Real-World Multilingual Benchmark for Repository-Level Code Translation
di: Wang, Yanli, et al.
Pubblicazione: (2024)
di: Wang, Yanli, et al.
Pubblicazione: (2024)
Documenti analoghi
-
HumanEvo: An Evolution-aware Benchmark for More Realistic Evaluation of Repository-level Code Generation
di: Zheng, Dewu, et al.
Pubblicazione: (2024) -
Towards an Understanding of Large Language Models in Software Engineering Tasks
di: Zheng, Zibin, et al.
Pubblicazione: (2023) -
Defining and Detecting the Defects of the Large Language Model-based Autonomous Agents
di: Ning, Kaiwen, et al.
Pubblicazione: (2024) -
RMCBench: Benchmarking Large Language Models' Resistance to Malicious Code
di: Chen, Jiachi, et al.
Pubblicazione: (2024) -
SmartReco: Detecting Read-Only Reentrancy via Fine-Grained Cross-DApp Analysis
di: Zhang, Jingwen, et al.
Pubblicazione: (2024)