Salvato in:
| Autori principali: | Fan, Guodong, Gao, Cuiyun, Chong, Chun Yong, Zhang, Lu, Li, Jing, Zhang, Jinglin, Chen, Shizhan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2604.26686 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Systematic Literature Review of Code Hallucinations in LLMs: Characterization, Mitigation Methods, Challenges, and Future Directions for Reliable AI
di: Gao, Cuiyun, et al.
Pubblicazione: (2025)
di: Gao, Cuiyun, et al.
Pubblicazione: (2025)
Can LLMs Replace Human Evaluators? An Empirical Study of LLM-as-a-Judge in Software Engineering
di: Wang, Ruiqi, et al.
Pubblicazione: (2025)
di: Wang, Ruiqi, et al.
Pubblicazione: (2025)
A Systematic Evaluation of Large Code Models in API Suggestion: When, Which, and How
di: Wang, Chaozheng, et al.
Pubblicazione: (2024)
di: Wang, Chaozheng, et al.
Pubblicazione: (2024)
ComplexCodeEval: A Benchmark for Evaluating Large Code Models on More Complex Code
di: Feng, Jia, et al.
Pubblicazione: (2024)
di: Feng, Jia, et al.
Pubblicazione: (2024)
APIGen: Generative API Method Recommendation
di: Chen, Yujia, et al.
Pubblicazione: (2024)
di: Chen, Yujia, et al.
Pubblicazione: (2024)
AXIOM: Benchmarking LLM-as-a-Judge for Code via Rule-Based Perturbation and Multisource Quality Calibration
di: Wang, Ruiqi, et al.
Pubblicazione: (2025)
di: Wang, Ruiqi, et al.
Pubblicazione: (2025)
When Large Language Models Meet UAV Projects: An Empirical Study from Developers' Perspective
di: Chen, Yihua, et al.
Pubblicazione: (2025)
di: Chen, Yihua, et al.
Pubblicazione: (2025)
When Shared Worlds Break: Demystifying Defects in Multi-User Extended Reality Software Systems
di: Li, Shuqing, et al.
Pubblicazione: (2025)
di: Li, Shuqing, et al.
Pubblicazione: (2025)
Cascaded Code Editing: Large-Small Model Collaboration for Effective and Efficient Code Editing
di: Wang, Chaozheng, et al.
Pubblicazione: (2026)
di: Wang, Chaozheng, et al.
Pubblicazione: (2026)
Bridge and Hint: Extending Pre-trained Language Models for Long-Range Code
di: Chen, Yujia, et al.
Pubblicazione: (2024)
di: Chen, Yujia, et al.
Pubblicazione: (2024)
Smaller but Better: Self-Paced Knowledge Distillation for Lightweight yet Effective LCMs
di: Chen, Yujia, et al.
Pubblicazione: (2024)
di: Chen, Yujia, et al.
Pubblicazione: (2024)
The Prompt Alchemist: Automated LLM-Tailored Prompt Optimization for Test Case Generation
di: Gao, Shuzheng, et al.
Pubblicazione: (2025)
di: Gao, Shuzheng, et al.
Pubblicazione: (2025)
CodeUpdateArena: Benchmarking Knowledge Editing on API Updates
di: Liu, Zeyu Leo, et al.
Pubblicazione: (2024)
di: Liu, Zeyu Leo, et al.
Pubblicazione: (2024)
LLMs Meet Library Evolution: Evaluating Deprecated API Usage in LLM-based Code Completion
di: Wang, Chong, et al.
Pubblicazione: (2024)
di: Wang, Chong, et al.
Pubblicazione: (2024)
LLM-Based Test Case Generation in DBMS through Monte Carlo Tree Search
di: Chen, Yujia, et al.
Pubblicazione: (2026)
di: Chen, Yujia, et al.
Pubblicazione: (2026)
When Automated Program Repair Meets Regression Testing -- An Extensive Study on 2 Million Patches
di: Lou, Yiling, et al.
Pubblicazione: (2021)
di: Lou, Yiling, et al.
Pubblicazione: (2021)
The Current Challenges of Software Engineering in the Era of Large Language Models
di: Gao, Cuiyun, et al.
Pubblicazione: (2024)
di: Gao, Cuiyun, et al.
Pubblicazione: (2024)
When ChatGPT Meets Smart Contract Vulnerability Detection: How Far Are We?
di: Chen, Chong, et al.
Pubblicazione: (2023)
di: Chen, Chong, et al.
Pubblicazione: (2023)
When Elo Lies: Hidden Biases in Codeforces-Based Evaluation of Large Language Models
di: Zheng, Shenyu, et al.
Pubblicazione: (2026)
di: Zheng, Shenyu, et al.
Pubblicazione: (2026)
WITNESS: A lightweight and practical approach to fine-grained predictive mutation testing
di: Lu, Zeyu, et al.
Pubblicazione: (2025)
di: Lu, Zeyu, et al.
Pubblicazione: (2025)
An Empirical Study of Knowledge Distillation for Code Understanding Tasks
di: Wang, Ruiqi, et al.
Pubblicazione: (2025)
di: Wang, Ruiqi, et al.
Pubblicazione: (2025)
SR-Eval: Evaluating LLMs on Code Generation under Stepwise Requirement Refinement
di: Zhan, Zexun, et al.
Pubblicazione: (2025)
di: Zhan, Zexun, et al.
Pubblicazione: (2025)
MulVul: Retrieval-augmented Multi-Agent Code Vulnerability Detection via Cross-Model Prompt Evolution
di: Wu, Zihan, et al.
Pubblicazione: (2026)
di: Wu, Zihan, et al.
Pubblicazione: (2026)
SEER: Enhancing Chain-of-Thought Code Generation through Self-Exploring Deep Reasoning
di: Gao, Shuzheng, et al.
Pubblicazione: (2025)
di: Gao, Shuzheng, et al.
Pubblicazione: (2025)
LLM-Driven Kernel Evolution: Automating Driver Updates in Linux
di: Kharlamova, Arina, et al.
Pubblicazione: (2025)
di: Kharlamova, Arina, et al.
Pubblicazione: (2025)
What Makes Good In-context Demonstrations for Code Intelligence Tasks with LLMs?
di: Gao, Shuzheng, et al.
Pubblicazione: (2023)
di: Gao, Shuzheng, et al.
Pubblicazione: (2023)
Towards Mitigating API Hallucination in Code Generated by LLMs with Hierarchical Dependency Aware
di: Chen, Yujia, et al.
Pubblicazione: (2025)
di: Chen, Yujia, et al.
Pubblicazione: (2025)
Quantum Computing as a Service -- a Software Engineering Perspective
di: Ahmad, Aakash, et al.
Pubblicazione: (2025)
di: Ahmad, Aakash, et al.
Pubblicazione: (2025)
Lightweight Model Editing for LLMs to Correct Deprecated API Recommendations
di: Lin, Guancheng, et al.
Pubblicazione: (2025)
di: Lin, Guancheng, et al.
Pubblicazione: (2025)
LibRec: Benchmarking Retrieval-Augmented LLMs for Library Migration Recommendations
di: Han, Junxiao, et al.
Pubblicazione: (2025)
di: Han, Junxiao, et al.
Pubblicazione: (2025)
When Fuzzing Meets LLMs: Challenges and Opportunities
di: Jiang, Yu, et al.
Pubblicazione: (2024)
di: Jiang, Yu, et al.
Pubblicazione: (2024)
SPENCER: Self-Adaptive Model Distillation for Efficient Code Retrieval
di: Gu, Wenchao, et al.
Pubblicazione: (2025)
di: Gu, Wenchao, et al.
Pubblicazione: (2025)
Deep Learning Based Code Generation Methods: Literature Review
di: Yang, Zezhou, et al.
Pubblicazione: (2023)
di: Yang, Zezhou, et al.
Pubblicazione: (2023)
Learning in the Wild: Towards Leveraging Unlabeled Data for Effectively Tuning Pre-trained Code Models
di: Gao, Shuzheng, et al.
Pubblicazione: (2024)
di: Gao, Shuzheng, et al.
Pubblicazione: (2024)
Automatically Recommend Code Updates: Are We There Yet?
di: Liu, Yue, et al.
Pubblicazione: (2022)
di: Liu, Yue, et al.
Pubblicazione: (2022)
When AI Models Become Dependencies: Studying the Evolution of Pre-Trained Model Reuse in Downstream Software Systems
di: Banyongrakkul, Peerachai, et al.
Pubblicazione: (2026)
di: Banyongrakkul, Peerachai, et al.
Pubblicazione: (2026)
Mining Service Behavior for Stateful Service Emulation
di: Hossain, Md Arafat, et al.
Pubblicazione: (2025)
di: Hossain, Md Arafat, et al.
Pubblicazione: (2025)
Weakly Supervised Vulnerability Localization via Multiple Instance Learning
di: Gu, Wenchao, et al.
Pubblicazione: (2025)
di: Gu, Wenchao, et al.
Pubblicazione: (2025)
When Retriever Meets Generator: A Joint Model for Code Comment Generation
di: Le, Tien P. T., et al.
Pubblicazione: (2025)
di: Le, Tien P. T., et al.
Pubblicazione: (2025)
SHREC: a SRE Behaviour Knowledge Graph Model for Shell Command Recommendations
di: Tonon, Andrea, et al.
Pubblicazione: (2024)
di: Tonon, Andrea, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Systematic Literature Review of Code Hallucinations in LLMs: Characterization, Mitigation Methods, Challenges, and Future Directions for Reliable AI
di: Gao, Cuiyun, et al.
Pubblicazione: (2025) -
Can LLMs Replace Human Evaluators? An Empirical Study of LLM-as-a-Judge in Software Engineering
di: Wang, Ruiqi, et al.
Pubblicazione: (2025) -
A Systematic Evaluation of Large Code Models in API Suggestion: When, Which, and How
di: Wang, Chaozheng, et al.
Pubblicazione: (2024) -
ComplexCodeEval: A Benchmark for Evaluating Large Code Models on More Complex Code
di: Feng, Jia, et al.
Pubblicazione: (2024) -
APIGen: Generative API Method Recommendation
di: Chen, Yujia, et al.
Pubblicazione: (2024)