A Systematic Evaluation of Large Code Models in API Suggestion: When, Which, and How
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Chaozheng, Gao, Shuzheng, Gao, Cuiyun, Wang, Wenxuan, Chong, Chun Yong, Gao, Shan, Lyu, Michael R. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SEER: Enhancing Chain-of-Thought Code Generation through Self-Exploring Deep Reasoning
par: Gao, Shuzheng, et autres
Publié: (2025)
par: Gao, Shuzheng, et autres
Publié: (2025)
ComplexCodeEval: A Benchmark for Evaluating Large Code Models on More Complex Code
par: Feng, Jia, et autres
Publié: (2024)
par: Feng, Jia, et autres
Publié: (2024)
The Prompt Alchemist: Automated LLM-Tailored Prompt Optimization for Test Case Generation
par: Gao, Shuzheng, et autres
Publié: (2025)
par: Gao, Shuzheng, et autres
Publié: (2025)
Cascaded Code Editing: Large-Small Model Collaboration for Effective and Efficient Code Editing
par: Wang, Chaozheng, et autres
Publié: (2026)
par: Wang, Chaozheng, et autres
Publié: (2026)
What Makes Good In-context Demonstrations for Code Intelligence Tasks with LLMs?
par: Gao, Shuzheng, et autres
Publié: (2023)
par: Gao, Shuzheng, et autres
Publié: (2023)
RAG or Fine-tuning? A Comparative Study on LCMs-based Code Completion in Industry
par: Wang, Chaozheng, et autres
Publié: (2025)
par: Wang, Chaozheng, et autres
Publié: (2025)
Exploring Multi-Lingual Bias of Large Code Models in Code Generation
par: Wang, Chaozheng, et autres
Publié: (2024)
par: Wang, Chaozheng, et autres
Publié: (2024)
SR-Eval: Evaluating LLMs on Code Generation under Stepwise Requirement Refinement
par: Zhan, Zexun, et autres
Publié: (2025)
par: Zhan, Zexun, et autres
Publié: (2025)
Search-Based LLMs for Code Optimization
par: Gao, Shuzheng, et autres
Publié: (2024)
par: Gao, Shuzheng, et autres
Publié: (2024)
Learning in the Wild: Towards Leveraging Unlabeled Data for Effectively Tuning Pre-trained Code Models
par: Gao, Shuzheng, et autres
Publié: (2024)
par: Gao, Shuzheng, et autres
Publié: (2024)
Empirical Study of Code Large Language Models for Binary Security Patch Detection
par: Li, Qingyuan, et autres
Publié: (2025)
par: Li, Qingyuan, et autres
Publié: (2025)
SCALE: Constructing Structured Natural Language Comment Trees for Software Vulnerability Detection
par: Wen, Xin-Cheng, et autres
Publié: (2024)
par: Wen, Xin-Cheng, et autres
Publié: (2024)
APIGen: Generative API Method Recommendation
par: Chen, Yujia, et autres
Publié: (2024)
par: Chen, Yujia, et autres
Publié: (2024)
A Deep Dive into Retrieval-Augmented Generation for Code Completion: Experience on WeChat
par: Yang, Zezhou, et autres
Publié: (2025)
par: Yang, Zezhou, et autres
Publié: (2025)
TREAT: A Code LLMs Trustworthiness / Reliability Evaluation and Testing Framework
par: Gao, Shuzheng, et autres
Publié: (2025)
par: Gao, Shuzheng, et autres
Publié: (2025)
Automated Prompt Generation for Code Intelligence: An Empirical study and Experience in WeChat
par: Ji, Kexing, et autres
Publié: (2025)
par: Ji, Kexing, et autres
Publié: (2025)
When Model Editing Meets Service Evolution: A Knowledge-Update Perspective for Service Recommendation
par: Fan, Guodong, et autres
Publié: (2026)
par: Fan, Guodong, et autres
Publié: (2026)
Integrating Rules and Semantics for LLM-Based C-to-Rust Translation
par: Luo, Feng, et autres
Publié: (2025)
par: Luo, Feng, et autres
Publié: (2025)
The Current Challenges of Software Engineering in the Era of Large Language Models
par: Gao, Cuiyun, et autres
Publié: (2024)
par: Gao, Cuiyun, et autres
Publié: (2024)
Towards Mitigating API Hallucination in Code Generated by LLMs with Hierarchical Dependency Aware
par: Chen, Yujia, et autres
Publié: (2025)
par: Chen, Yujia, et autres
Publié: (2025)
SPENCER: Self-Adaptive Model Distillation for Efficient Code Retrieval
par: Gu, Wenchao, et autres
Publié: (2025)
par: Gu, Wenchao, et autres
Publié: (2025)
SPVR: syntax-to-prompt vulnerability repair based on large language models
par: Wang, Ruoke, et autres
Publié: (2024)
par: Wang, Ruoke, et autres
Publié: (2024)
AXIOM: Benchmarking LLM-as-a-Judge for Code via Rule-Based Perturbation and Multisource Quality Calibration
par: Wang, Ruiqi, et autres
Publié: (2025)
par: Wang, Ruiqi, et autres
Publié: (2025)
CodeVisionary: An Agent-based Framework for Evaluating Large Language Models in Code Generation
par: Wang, Xinchen, et autres
Publié: (2025)
par: Wang, Xinchen, et autres
Publié: (2025)
A Systematic Literature Review of Code Hallucinations in LLMs: Characterization, Mitigation Methods, Challenges, and Future Directions for Reliable AI
par: Gao, Cuiyun, et autres
Publié: (2025)
par: Gao, Cuiyun, et autres
Publié: (2025)
When Shared Worlds Break: Demystifying Defects in Multi-User Extended Reality Software Systems
par: Li, Shuqing, et autres
Publié: (2025)
par: Li, Shuqing, et autres
Publié: (2025)
Can LLMs Replace Human Evaluators? An Empirical Study of LLM-as-a-Judge in Software Engineering
par: Wang, Ruiqi, et autres
Publié: (2025)
par: Wang, Ruiqi, et autres
Publié: (2025)
On the Effectiveness of Context Compression for Repository-Level Tasks: An Empirical Investigation
par: Feng, Jia, et autres
Publié: (2026)
par: Feng, Jia, et autres
Publié: (2026)
Deep Learning Based Code Generation Methods: Literature Review
par: Yang, Zezhou, et autres
Publié: (2023)
par: Yang, Zezhou, et autres
Publié: (2023)
JSidentify-V2: Leveraging Dynamic Memory Fingerprinting for Mini-Game Plagiarism Detection
par: Li, Zhihao, et autres
Publié: (2025)
par: Li, Zhihao, et autres
Publié: (2025)
A Closer Look into Transformer-Based Code Intelligence Through Code Transformation: Challenges and Opportunities
par: Li, Yaoxian, et autres
Publié: (2022)
par: Li, Yaoxian, et autres
Publié: (2022)
Automatically Generating UI Code from Screenshot: A Divide-and-Conquer-Based Approach
par: Wan, Yuxuan, et autres
Publié: (2024)
par: Wan, Yuxuan, et autres
Publié: (2024)
A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models
par: Hu, Ruida, et autres
Publié: (2024)
par: Hu, Ruida, et autres
Publié: (2024)
JSProtect: A Scalable Obfuscation Framework for Mini-Games in WeChat
par: Li, Zhihao, et autres
Publié: (2025)
par: Li, Zhihao, et autres
Publié: (2025)
Dependency-Guided Repository-Level C-to-Rust Translation with Reinforcement Alignment
par: Feng, Jia, et autres
Publié: (2026)
par: Feng, Jia, et autres
Publié: (2026)
Less is More? An Empirical Study on Configuration Issues in Python PyPI Ecosystem
par: Peng, Yun, et autres
Publié: (2023)
par: Peng, Yun, et autres
Publié: (2023)
Bridge and Hint: Extending Pre-trained Language Models for Long-Range Code
par: Chen, Yujia, et autres
Publié: (2024)
par: Chen, Yujia, et autres
Publié: (2024)
Evaluating Repository-level Software Documentation via Question Answering and Feature-Driven Development
par: Wang, Xinchen, et autres
Publié: (2026)
par: Wang, Xinchen, et autres
Publié: (2026)
CodeCrash: Exposing LLM Fragility to Misleading Natural Language in Code Reasoning
par: Lam, Man Ho, et autres
Publié: (2025)
par: Lam, Man Ho, et autres
Publié: (2025)
An Empirical Study of Knowledge Distillation for Code Understanding Tasks
par: Wang, Ruiqi, et autres
Publié: (2025)
par: Wang, Ruiqi, et autres
Publié: (2025)
Documents similaires
-
SEER: Enhancing Chain-of-Thought Code Generation through Self-Exploring Deep Reasoning
par: Gao, Shuzheng, et autres
Publié: (2025) -
ComplexCodeEval: A Benchmark for Evaluating Large Code Models on More Complex Code
par: Feng, Jia, et autres
Publié: (2024) -
The Prompt Alchemist: Automated LLM-Tailored Prompt Optimization for Test Case Generation
par: Gao, Shuzheng, et autres
Publié: (2025) -
Cascaded Code Editing: Large-Small Model Collaboration for Effective and Efficient Code Editing
par: Wang, Chaozheng, et autres
Publié: (2026) -
What Makes Good In-context Demonstrations for Code Intelligence Tasks with LLMs?
par: Gao, Shuzheng, et autres
Publié: (2023)