Evaluating and Achieving Controllable Code Completion in Code LLM
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Jiajun, Cui, Zeyu, Zhang, Lei, Yang, Jian, Yang, Jiaxi, Liu, Qiang, Wang, Zilei, Hui, Binyuan, Wang, Liang, Lin, Junyang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning
di: Zhang, Jiajun, et al.
Pubblicazione: (2026)
di: Zhang, Jiajun, et al.
Pubblicazione: (2026)
Turning the Tide: Repository-based Code Reflection
di: Zhang, Wei, et al.
Pubblicazione: (2025)
di: Zhang, Wei, et al.
Pubblicazione: (2025)
Code Fingerprints: Disentangled Attribution of LLM-Generated Code
di: Guo, Jiaxun, et al.
Pubblicazione: (2026)
di: Guo, Jiaxun, et al.
Pubblicazione: (2026)
Towards Better Correctness and Efficiency in Code Generation
di: Feng, Yunlong, et al.
Pubblicazione: (2025)
di: Feng, Yunlong, et al.
Pubblicazione: (2025)
M2rc-Eval: Massively Multilingual Repository-level Code Completion Evaluation
di: Liu, Jiaheng, et al.
Pubblicazione: (2024)
di: Liu, Jiaheng, et al.
Pubblicazione: (2024)
ExecRepoBench: Multi-level Executable Code Completion Evaluation
di: Yang, Jian, et al.
Pubblicazione: (2024)
di: Yang, Jian, et al.
Pubblicazione: (2024)
LLMs Meet Library Evolution: Evaluating Deprecated API Usage in LLM-based Code Completion
di: Wang, Chong, et al.
Pubblicazione: (2024)
di: Wang, Chong, et al.
Pubblicazione: (2024)
PlotCraft: Pushing the Limits of LLMs for Complex and Interactive Data Visualization
di: Zhang, Jiajun, et al.
Pubblicazione: (2025)
di: Zhang, Jiajun, et al.
Pubblicazione: (2025)
CWEval: Outcome-driven Evaluation on Functionality and Security of LLM Code Generation
di: Peng, Jinjun, et al.
Pubblicazione: (2025)
di: Peng, Jinjun, et al.
Pubblicazione: (2025)
Automatically Benchmarking LLM Code Agents through Agent-Driven Annotation and Evaluation
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
CodeRAG: Finding Relevant and Necessary Knowledge for Retrieval-Augmented Repository-Level Code Completion
di: Zhang, Sheng, et al.
Pubblicazione: (2025)
di: Zhang, Sheng, et al.
Pubblicazione: (2025)
StepCodeReasoner: Aligning Code Reasoning with Stepwise Execution Traces via Reinforcement Learning
di: Wang, Hao, et al.
Pubblicazione: (2026)
di: Wang, Hao, et al.
Pubblicazione: (2026)
Evaluating and Aligning CodeLLMs on Human Preference
di: Yang, Jian, et al.
Pubblicazione: (2024)
di: Yang, Jian, et al.
Pubblicazione: (2024)
Repoformer: Selective Retrieval for Repository-Level Code Completion
di: Wu, Di, et al.
Pubblicazione: (2024)
di: Wu, Di, et al.
Pubblicazione: (2024)
Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks
di: Zhao, Songwen, et al.
Pubblicazione: (2025)
di: Zhao, Songwen, et al.
Pubblicazione: (2025)
Python Symbolic Execution with LLM-powered Code Generation
di: Wang, Wenhan, et al.
Pubblicazione: (2024)
di: Wang, Wenhan, et al.
Pubblicazione: (2024)
Comparing Developer and LLM Biases in Code Evaluation
di: Mittal, Aditya, et al.
Pubblicazione: (2026)
di: Mittal, Aditya, et al.
Pubblicazione: (2026)
Don't Judge Code by Its Cover: Exploring Biases in LLM Judges for Code Evaluation
di: Moon, Jiwon, et al.
Pubblicazione: (2025)
di: Moon, Jiwon, et al.
Pubblicazione: (2025)
ViC: Virtual Compiler Is All You Need For Assembly Code Search
di: Gao, Zeyu, et al.
Pubblicazione: (2024)
di: Gao, Zeyu, et al.
Pubblicazione: (2024)
From Code Foundation Models to Agents and Applications: A Comprehensive Survey and Practical Guide to Code Intelligence
di: Yang, Jian, et al.
Pubblicazione: (2025)
di: Yang, Jian, et al.
Pubblicazione: (2025)
TRACE: Evaluating Execution Efficiency of LLM-Based Code Translation
di: Gong, Zhihao, et al.
Pubblicazione: (2026)
di: Gong, Zhihao, et al.
Pubblicazione: (2026)
TRACE: Evaluating Execution Efficiency of LLM-Based Code Translation
di: Gong, Zhihao, et al.
Pubblicazione: (2025)
di: Gong, Zhihao, et al.
Pubblicazione: (2025)
ArtifactsBench: Bridging the Visual-Interactive Gap in LLM Code Generation Evaluation
di: Zhang, Chenchen, et al.
Pubblicazione: (2025)
di: Zhang, Chenchen, et al.
Pubblicazione: (2025)
CodeHalu: Investigating Code Hallucinations in LLMs via Execution-based Verification
di: Tian, Yuchen, et al.
Pubblicazione: (2024)
di: Tian, Yuchen, et al.
Pubblicazione: (2024)
Enhancing Project-Specific Code Completion by Inferring Internal API Information
di: Deng, Le, et al.
Pubblicazione: (2025)
di: Deng, Le, et al.
Pubblicazione: (2025)
The CodeInverter Suite: Control-Flow and Data-Mapping Augmented Binary Decompilation with LLMs
di: Liu, Peipei, et al.
Pubblicazione: (2025)
di: Liu, Peipei, et al.
Pubblicazione: (2025)
R2C2-Coder: Enhancing and Benchmarking Real-world Repository-level Code Completion Abilities of Code Large Language Models
di: Deng, Ken, et al.
Pubblicazione: (2024)
di: Deng, Ken, et al.
Pubblicazione: (2024)
Characterizing Unsafe Code Encapsulation In Real-world Rust Systems
di: Rao, Zihao, et al.
Pubblicazione: (2024)
di: Rao, Zihao, et al.
Pubblicazione: (2024)
CodeIF-Bench: Evaluating Instruction-Following Capabilities of Large Language Models in Interactive Code Generation
di: Wang, Peiding, et al.
Pubblicazione: (2025)
di: Wang, Peiding, et al.
Pubblicazione: (2025)
Language Models for Code Completion: A Practical Evaluation
di: Izadi, Maliheh, et al.
Pubblicazione: (2024)
di: Izadi, Maliheh, et al.
Pubblicazione: (2024)
Evaluation of Code LLMs on Geospatial Code Generation
di: Gramacki, Piotr, et al.
Pubblicazione: (2024)
di: Gramacki, Piotr, et al.
Pubblicazione: (2024)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
Contextualized Code Pretraining for Code Generation
di: Liu, Chen, et al.
Pubblicazione: (2026)
di: Liu, Chen, et al.
Pubblicazione: (2026)
IndustryCode: A Benchmark for Industry Code Generation
di: Zeng, Puyu, et al.
Pubblicazione: (2026)
di: Zeng, Puyu, et al.
Pubblicazione: (2026)
CodeMind: Evaluating Large Language Models for Code Reasoning
di: Liu, Changshu, et al.
Pubblicazione: (2024)
di: Liu, Changshu, et al.
Pubblicazione: (2024)
Large Language Models are Qualified Benchmark Builders: Rebuilding Pre-Training Datasets for Advancing Code Intelligence Tasks
di: Yang, Kang, et al.
Pubblicazione: (2025)
di: Yang, Kang, et al.
Pubblicazione: (2025)
VersiCode: Towards Version-controllable Code Generation
di: Wu, Tongtong, et al.
Pubblicazione: (2024)
di: Wu, Tongtong, et al.
Pubblicazione: (2024)
LAURA: Enhancing Code Review Generation with Context-Enriched Retrieval-Augmented LLM
di: Zhang, Yuxin, et al.
Pubblicazione: (2025)
di: Zhang, Yuxin, et al.
Pubblicazione: (2025)
Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
CodeJudge: Evaluating Code Generation with Large Language Models
di: Tong, Weixi, et al.
Pubblicazione: (2024)
di: Tong, Weixi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning
di: Zhang, Jiajun, et al.
Pubblicazione: (2026) -
Turning the Tide: Repository-based Code Reflection
di: Zhang, Wei, et al.
Pubblicazione: (2025) -
Code Fingerprints: Disentangled Attribution of LLM-Generated Code
di: Guo, Jiaxun, et al.
Pubblicazione: (2026) -
Towards Better Correctness and Efficiency in Code Generation
di: Feng, Yunlong, et al.
Pubblicazione: (2025) -
M2rc-Eval: Massively Multilingual Repository-level Code Completion Evaluation
di: Liu, Jiaheng, et al.
Pubblicazione: (2024)