Towards Advancing Code Generation with Large Language Models: A Research Roadmap
Fuente:
arXiv
Guardado en:
| Autores principales: | Jin, Haolin, Chen, Huaming, Lu, Qinghua, Zhu, Liming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Uncovering Systematic Failures of LLMs in Verifying Code Against Natural Language Specifications
por: Jin, Haolin, et al.
Publicado: (2025)
por: Jin, Haolin, et al.
Publicado: (2025)
Are LLMs Reliable Code Reviewers? Systematic Overcorrection in Requirement Conformance Judgement
por: Jin, Haolin, et al.
Publicado: (2026)
por: Jin, Haolin, et al.
Publicado: (2026)
RGD: Multi-LLM Based Agent Debugger via Refinement and Generation Guidance
por: Jin, Haolin, et al.
Publicado: (2024)
por: Jin, Haolin, et al.
Publicado: (2024)
Towards Responsible Generative AI: A Reference Architecture for Designing Foundation Model based Agents
por: Lu, Qinghua, et al.
Publicado: (2023)
por: Lu, Qinghua, et al.
Publicado: (2023)
Large Language Models for Software Testing: A Research Roadmap
por: Augusto, Cristian, et al.
Publicado: (2025)
por: Augusto, Cristian, et al.
Publicado: (2025)
Swiss Cheese Model for AI Safety: A Taxonomy and Reference Architecture for Multi-Layered Guardrails of Foundation Model Based Agents
por: Shamsujjoha, Md, et al.
Publicado: (2024)
por: Shamsujjoha, Md, et al.
Publicado: (2024)
LLMs are All You Need? Improving Fuzz Testing for MOJO with Large Language Models
por: Huang, Linghan, et al.
Publicado: (2025)
por: Huang, Linghan, et al.
Publicado: (2025)
On the Challenges of Fuzzing Techniques via Large Language Models
por: Huang, Linghan, et al.
Publicado: (2024)
por: Huang, Linghan, et al.
Publicado: (2024)
Decentralised Governance-Driven Architecture for Designing Foundation Model based Systems: Exploring the Role of Blockchain in Responsible AI
por: Liu, Yue, et al.
Publicado: (2023)
por: Liu, Yue, et al.
Publicado: (2023)
A Taxonomy of Architecture Options for Foundation Model-based Agents: Analysis and Decision Model
por: Zhou, Jingwen, et al.
Publicado: (2024)
por: Zhou, Jingwen, et al.
Publicado: (2024)
Evaluation-Driven Development and Operations of LLM Agents: A Process Model and Reference Architecture
por: Xia, Boming, et al.
Publicado: (2024)
por: Xia, Boming, et al.
Publicado: (2024)
A Deep Dive Into Large Language Model Code Generation Mistakes: What and Why?
por: Chen, QiHong, et al.
Publicado: (2024)
por: Chen, QiHong, et al.
Publicado: (2024)
Still Manual? Automated Linter Configuration via DSL-Based LLM Compilation of Coding Standards
por: Zhang, Zejun, et al.
Publicado: (2026)
por: Zhang, Zejun, et al.
Publicado: (2026)
Task Abstention for Large Language Models in Code Generation
por: Zhou, Yanke, et al.
Publicado: (2026)
por: Zhou, Yanke, et al.
Publicado: (2026)
An AI System Evaluation Framework for Advancing AI Safety: Terminology, Taxonomy, Lifecycle Mapping
por: Xia, Boming, et al.
Publicado: (2024)
por: Xia, Boming, et al.
Publicado: (2024)
A Reference Architecture for Designing Foundation Model based Systems
por: Lu, Qinghua, et al.
Publicado: (2023)
por: Lu, Qinghua, et al.
Publicado: (2023)
What You See Is Not Always What You Get: Evaluating GPT's Comprehension of Source Code
por: Wen, Jiawen, et al.
Publicado: (2024)
por: Wen, Jiawen, et al.
Publicado: (2024)
Personality-Guided Code Generation Using Large Language Models
por: Guo, Yaoqi, et al.
Publicado: (2024)
por: Guo, Yaoqi, et al.
Publicado: (2024)
From LLMs to LLM-based Agents for Software Engineering: A Survey of Current, Challenges and Future
por: Jin, Haolin, et al.
Publicado: (2024)
por: Jin, Haolin, et al.
Publicado: (2024)
Enhancing Code Consistency in AI Research with Large Language Models and Retrieval-Augmented Generation
por: Keshri, Rajat, et al.
Publicado: (2025)
por: Keshri, Rajat, et al.
Publicado: (2025)
Uncertainty Propagation in LLM-Based Systems
por: Xia, Boming, et al.
Publicado: (2026)
por: Xia, Boming, et al.
Publicado: (2026)
GeoCode-GPT: A Large Language Model for Geospatial Code Generation Tasks
por: Hou, Shuyang, et al.
Publicado: (2024)
por: Hou, Shuyang, et al.
Publicado: (2024)
Towards Leveraging Large Language Model Summaries for Topic Modeling in Source Code
por: Carissimi, Michele, et al.
Publicado: (2025)
por: Carissimi, Michele, et al.
Publicado: (2025)
Less is More: Towards Green Code Large Language Models via Unified Structural Pruning
por: Yang, Guang, et al.
Publicado: (2024)
por: Yang, Guang, et al.
Publicado: (2024)
AdaptEval: A Benchmark for Evaluating Large Language Models on Code Snippet Adaptation
por: Zhang, Tanghaoran, et al.
Publicado: (2026)
por: Zhang, Tanghaoran, et al.
Publicado: (2026)
Enhancing High-Quality Code Generation in Large Language Models with Comparative Prefix-Tuning
por: Jiang, Yuan, et al.
Publicado: (2025)
por: Jiang, Yuan, et al.
Publicado: (2025)
SWE-Compass: Towards Unified Evaluation of Agentic Coding Abilities for Large Language Models
por: Xu, Jingxuan, et al.
Publicado: (2025)
por: Xu, Jingxuan, et al.
Publicado: (2025)
Agent Design Pattern Catalogue: A Collection of Architectural Patterns for Foundation Model based Agents
por: Liu, Yue, et al.
Publicado: (2024)
por: Liu, Yue, et al.
Publicado: (2024)
A Comparative Analysis of Large Language Models for Code Documentation Generation
por: Dvivedi, Shubhang Shekhar, et al.
Publicado: (2023)
por: Dvivedi, Shubhang Shekhar, et al.
Publicado: (2023)
Large Language Model Guided Self-Debugging Code Generation
por: Adnan, Muntasir, et al.
Publicado: (2025)
por: Adnan, Muntasir, et al.
Publicado: (2025)
Bugs in Large Language Models Generated Code: An Empirical Study
por: Tambon, Florian, et al.
Publicado: (2024)
por: Tambon, Florian, et al.
Publicado: (2024)
A Taxonomy of Foundation Model based Systems through the Lens of Software Architecture
por: Lu, Qinghua, et al.
Publicado: (2023)
por: Lu, Qinghua, et al.
Publicado: (2023)
The Fusion of Large Language Models and Formal Methods for Trustworthy AI Agents: A Roadmap
por: Zhang, Yedi, et al.
Publicado: (2024)
por: Zhang, Yedi, et al.
Publicado: (2024)
CodeGolf Bench: A Multi-Language Benchmark for Evaluating Concise Code Generation Capabilities of Large Language Models
por: Padwal, Vedant
Publicado: (2026)
por: Padwal, Vedant
Publicado: (2026)
SOEN-101: Code Generation by Emulating Software Process Models Using Large Language Model Agents
por: Lin, Feng, et al.
Publicado: (2024)
por: Lin, Feng, et al.
Publicado: (2024)
WebCompass: Towards Multimodal Web Coding Evaluation for Code Language Models
por: Lei, Xinping, et al.
Publicado: (2026)
por: Lei, Xinping, et al.
Publicado: (2026)
Flow2Code: Evaluating Large Language Models for Flowchart-based Code Generation Capability
por: He, Mengliang, et al.
Publicado: (2025)
por: He, Mengliang, et al.
Publicado: (2025)
Combining Large Language Models with Static Analyzers for Code Review Generation
por: Jaoua, Imen, et al.
Publicado: (2025)
por: Jaoua, Imen, et al.
Publicado: (2025)
CRPE: Expanding The Reasoning Capability of Large Language Model for Code Generation
por: Gui, Ningxin, et al.
Publicado: (2025)
por: Gui, Ningxin, et al.
Publicado: (2025)
Model-Driven Quantum Code Generation Using Large Language Models and Retrieval-Augmented Generation
por: Siavash, Nazanin, et al.
Publicado: (2025)
por: Siavash, Nazanin, et al.
Publicado: (2025)
Ejemplares similares
-
Uncovering Systematic Failures of LLMs in Verifying Code Against Natural Language Specifications
por: Jin, Haolin, et al.
Publicado: (2025) -
Are LLMs Reliable Code Reviewers? Systematic Overcorrection in Requirement Conformance Judgement
por: Jin, Haolin, et al.
Publicado: (2026) -
RGD: Multi-LLM Based Agent Debugger via Refinement and Generation Guidance
por: Jin, Haolin, et al.
Publicado: (2024) -
Towards Responsible Generative AI: A Reference Architecture for Designing Foundation Model based Agents
por: Lu, Qinghua, et al.
Publicado: (2023) -
Large Language Models for Software Testing: A Research Roadmap
por: Augusto, Cristian, et al.
Publicado: (2025)