The Current Challenges of Software Engineering in the Era of Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gao, Cuiyun, Hu, Xing, Gao, Shan, Xia, Xin, Jin, Zhi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Assessing and Advancing Benchmarks for Evaluating Large Language Models in Software Engineering Tasks
von: Hu, Xing, et al.
Veröffentlicht: (2025)
von: Hu, Xing, et al.
Veröffentlicht: (2025)
An Empirical Study of Retrieval-Augmented Code Generation: Challenges and Opportunities
von: Yang, Zezhou, et al.
Veröffentlicht: (2025)
von: Yang, Zezhou, et al.
Veröffentlicht: (2025)
ComplexCodeEval: A Benchmark for Evaluating Large Code Models on More Complex Code
von: Feng, Jia, et al.
Veröffentlicht: (2024)
von: Feng, Jia, et al.
Veröffentlicht: (2024)
On the Replicability and Reproducibility of Deep Learning in Software Engineering
von: Liu, Chao, et al.
Veröffentlicht: (2020)
von: Liu, Chao, et al.
Veröffentlicht: (2020)
Learning in the Wild: Towards Leveraging Unlabeled Data for Effectively Tuning Pre-trained Code Models
von: Gao, Shuzheng, et al.
Veröffentlicht: (2024)
von: Gao, Shuzheng, et al.
Veröffentlicht: (2024)
Can LLMs Replace Human Evaluators? An Empirical Study of LLM-as-a-Judge in Software Engineering
von: Wang, Ruiqi, et al.
Veröffentlicht: (2025)
von: Wang, Ruiqi, et al.
Veröffentlicht: (2025)
Revisiting Sentiment Analysis for Software Engineering in the Era of Large Language Models
von: Zhang, Ting, et al.
Veröffentlicht: (2023)
von: Zhang, Ting, et al.
Veröffentlicht: (2023)
CodeRepoQA: A Large-scale Benchmark for Software Engineering Question Answering
von: Hu, Ruida, et al.
Veröffentlicht: (2024)
von: Hu, Ruida, et al.
Veröffentlicht: (2024)
An Empirical Study of Speculative Decoding on Software Engineering Tasks
von: Li, Yijia, et al.
Veröffentlicht: (2026)
von: Li, Yijia, et al.
Veröffentlicht: (2026)
SCALE: Constructing Structured Natural Language Comment Trees for Software Vulnerability Detection
von: Wen, Xin-Cheng, et al.
Veröffentlicht: (2024)
von: Wen, Xin-Cheng, et al.
Veröffentlicht: (2024)
A Systematic Evaluation of Large Code Models in API Suggestion: When, Which, and How
von: Wang, Chaozheng, et al.
Veröffentlicht: (2024)
von: Wang, Chaozheng, et al.
Veröffentlicht: (2024)
A Roadmap on Modern Code Review: Challenges and Opportunities
von: Yang, Zezhou, et al.
Veröffentlicht: (2024)
von: Yang, Zezhou, et al.
Veröffentlicht: (2024)
Evaluating Repository-level Software Documentation via Question Answering and Feature-Driven Development
von: Wang, Xinchen, et al.
Veröffentlicht: (2026)
von: Wang, Xinchen, et al.
Veröffentlicht: (2026)
Empirical and Sustainability Aspects of Software Engineering Research in the Era of Large Language Models: A Reflection
von: Williams, David, et al.
Veröffentlicht: (2025)
von: Williams, David, et al.
Veröffentlicht: (2025)
Where Is Self-admitted Code Generated by Large Language Models on GitHub?
von: Yu, Xiao, et al.
Veröffentlicht: (2024)
von: Yu, Xiao, et al.
Veröffentlicht: (2024)
Clean Code, Better Models: Enhancing LLM Performance with Smell-Cleaned Dataset
von: Xue, Zhipeng, et al.
Veröffentlicht: (2025)
von: Xue, Zhipeng, et al.
Veröffentlicht: (2025)
SR-Eval: Evaluating LLMs on Code Generation under Stepwise Requirement Refinement
von: Zhan, Zexun, et al.
Veröffentlicht: (2025)
von: Zhan, Zexun, et al.
Veröffentlicht: (2025)
Software Product Line Engineering: Adoption, Tooling and AI Era Challenges
von: Nazar, Najam
Veröffentlicht: (2026)
von: Nazar, Najam
Veröffentlicht: (2026)
A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models
von: Hu, Ruida, et al.
Veröffentlicht: (2024)
von: Hu, Ruida, et al.
Veröffentlicht: (2024)
VulEval: Towards Repository-Level Evaluation of Software Vulnerability Detection
von: Wen, Xin-Cheng, et al.
Veröffentlicht: (2024)
von: Wen, Xin-Cheng, et al.
Veröffentlicht: (2024)
Evaluating LLM-Based 0-to-1 Software Generation in End-to-End CLI Tool Scenarios
von: Hu, Ruida, et al.
Veröffentlicht: (2026)
von: Hu, Ruida, et al.
Veröffentlicht: (2026)
CodeVisionary: An Agent-based Framework for Evaluating Large Language Models in Code Generation
von: Wang, Xinchen, et al.
Veröffentlicht: (2025)
von: Wang, Xinchen, et al.
Veröffentlicht: (2025)
EvalSVA: Multi-Agent Evaluators for Next-Gen Software Vulnerability Assessment
von: Wen, Xin-Cheng, et al.
Veröffentlicht: (2024)
von: Wen, Xin-Cheng, et al.
Veröffentlicht: (2024)
Empirical Study of Code Large Language Models for Binary Security Patch Detection
von: Li, Qingyuan, et al.
Veröffentlicht: (2025)
von: Li, Qingyuan, et al.
Veröffentlicht: (2025)
Deep Learning-based Software Engineering: Progress, Challenges, and Opportunities
von: Chen, Xiangping, et al.
Veröffentlicht: (2024)
von: Chen, Xiangping, et al.
Veröffentlicht: (2024)
Bridge and Hint: Extending Pre-trained Language Models for Long-Range Code
von: Chen, Yujia, et al.
Veröffentlicht: (2024)
von: Chen, Yujia, et al.
Veröffentlicht: (2024)
On the Future of Software Reuse in the Era of AI Native Software Engineering
von: Taivalsaari, Antero, et al.
Veröffentlicht: (2025)
von: Taivalsaari, Antero, et al.
Veröffentlicht: (2025)
When Shared Worlds Break: Demystifying Defects in Multi-User Extended Reality Software Systems
von: Li, Shuqing, et al.
Veröffentlicht: (2025)
von: Li, Shuqing, et al.
Veröffentlicht: (2025)
Exploring the Power of Diffusion Large Language Models for Software Engineering: An Empirical Investigation
von: Zhang, Jingyao, et al.
Veröffentlicht: (2025)
von: Zhang, Jingyao, et al.
Veröffentlicht: (2025)
Towards Explainable Vulnerability Detection with Large Language Models
von: Mao, Qiheng, et al.
Veröffentlicht: (2024)
von: Mao, Qiheng, et al.
Veröffentlicht: (2024)
A Survey on Large Language Models for Software Engineering
von: Zhang, Quanjun, et al.
Veröffentlicht: (2023)
von: Zhang, Quanjun, et al.
Veröffentlicht: (2023)
Verify Implementation Equivalence of Large Models
von: Zhan, Qi, et al.
Veröffentlicht: (2026)
von: Zhan, Qi, et al.
Veröffentlicht: (2026)
Trae Agent: An LLM-based Agent for Software Engineering with Test-time Scaling
von: Trae Research Team, et al.
Veröffentlicht: (2025)
von: Trae Research Team, et al.
Veröffentlicht: (2025)
Automating TODO-missed Methods Detection and Patching
von: Gao, Zhipeng, et al.
Veröffentlicht: (2024)
von: Gao, Zhipeng, et al.
Veröffentlicht: (2024)
Automated Unit Test Refactoring
von: Gao, Yi, et al.
Veröffentlicht: (2024)
von: Gao, Yi, et al.
Veröffentlicht: (2024)
Every Maintenance Has Its Exemplar: The Future of Software Maintenance through Migration
von: Chen, Zirui, et al.
Veröffentlicht: (2026)
von: Chen, Zirui, et al.
Veröffentlicht: (2026)
Software Engineering for Large Language Models: Research Status, Challenges and the Road Ahead
von: Rao, Hongzhou, et al.
Veröffentlicht: (2025)
von: Rao, Hongzhou, et al.
Veröffentlicht: (2025)
Evaluating Large Language Models for Time Series Anomaly Detection in Aerospace Software
von: Liu, Yang, et al.
Veröffentlicht: (2026)
von: Liu, Yang, et al.
Veröffentlicht: (2026)
An Empirical Study of Knowledge Distillation for Code Understanding Tasks
von: Wang, Ruiqi, et al.
Veröffentlicht: (2025)
von: Wang, Ruiqi, et al.
Veröffentlicht: (2025)
Practical Program Repair in the Era of Large Pre-trained Language Models
von: Xia, Chunqiu Steven, et al.
Veröffentlicht: (2022)
von: Xia, Chunqiu Steven, et al.
Veröffentlicht: (2022)
Ähnliche Einträge
-
Assessing and Advancing Benchmarks for Evaluating Large Language Models in Software Engineering Tasks
von: Hu, Xing, et al.
Veröffentlicht: (2025) -
An Empirical Study of Retrieval-Augmented Code Generation: Challenges and Opportunities
von: Yang, Zezhou, et al.
Veröffentlicht: (2025) -
ComplexCodeEval: A Benchmark for Evaluating Large Code Models on More Complex Code
von: Feng, Jia, et al.
Veröffentlicht: (2024) -
On the Replicability and Reproducibility of Deep Learning in Software Engineering
von: Liu, Chao, et al.
Veröffentlicht: (2020) -
Learning in the Wild: Towards Leveraging Unlabeled Data for Effectively Tuning Pre-trained Code Models
von: Gao, Shuzheng, et al.
Veröffentlicht: (2024)