Assessing Small Language Models for Code Generation: An Empirical Study with Benchmarks
Fuente:
arXiv
Saved in:
| Main Authors: | Hasan, Md Mahade, Waseem, Muhammad, Kemell, Kai-Kristian, Rasku, Jussi, Ala-Rantala, Juha, Abrahamsson, Pekka |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LLM-based Multi-Agent System for Intelligent Refactoring of Haskell Code
by: Siddeeq, Shahbaz, et al.
Published: (2025)
by: Siddeeq, Shahbaz, et al.
Published: (2025)
Large Language Models for Code Generation: The Practitioners Perspective
by: Rasheed, Zeeshan, et al.
Published: (2025)
by: Rasheed, Zeeshan, et al.
Published: (2025)
Distributed Approach to Haskell Based Applications Refactoring with LLMs Based Multi-Agent Systems
by: Siddeeq, Shahbaz, et al.
Published: (2025)
by: Siddeeq, Shahbaz, et al.
Published: (2025)
VAPU: System for Autonomous Legacy Code Modernization
by: Ala-Salmi, Valtteri, et al.
Published: (2025)
by: Ala-Salmi, Valtteri, et al.
Published: (2025)
Vibe Coding in Practice: Flow, Technical Debt, and Guidelines for Sustainable Use
by: Waseem, Muhammad, et al.
Published: (2025)
by: Waseem, Muhammad, et al.
Published: (2025)
Developing Retrieval Augmented Generation (RAG) based LLM Systems from PDFs: An Experience Report
by: Khan, Ayman Asad, et al.
Published: (2024)
by: Khan, Ayman Asad, et al.
Published: (2024)
CodePori: Large-Scale System for Autonomous Software Development Using Multi-Agent Technology
by: Rasheed, Zeeshan, et al.
Published: (2024)
by: Rasheed, Zeeshan, et al.
Published: (2024)
Generative AI Adoption in an Energy Company: Exploring Challenges and Use Cases
by: Sami, Malik Abdul, et al.
Published: (2026)
by: Sami, Malik Abdul, et al.
Published: (2026)
Engineering a Governance-Aware AI Sandbox: Design, Implementation, and Lessons Learned
by: Waseem, Muhammad, et al.
Published: (2026)
by: Waseem, Muhammad, et al.
Published: (2026)
Context Before Code: An Experience Report on Vibe Coding in Practice
by: Shuvo, Md Nasir Uddin, et al.
Published: (2026)
by: Shuvo, Md Nasir Uddin, et al.
Published: (2026)
LLM-Generated Microservice Implementations from RESTful API Definitions
by: Chauhan, Saurabh, et al.
Published: (2025)
by: Chauhan, Saurabh, et al.
Published: (2025)
Agentic Frameworks for Reasoning Tasks: An Empirical Study
by: Rasheed, Zeeshan, et al.
Published: (2026)
by: Rasheed, Zeeshan, et al.
Published: (2026)
From Specification to Service: Accelerating API-First Development Using Multi-Agent Systems
by: Chauhan, Saurabh, et al.
Published: (2025)
by: Chauhan, Saurabh, et al.
Published: (2025)
Autonomous Legacy Web Application Upgrades Using a Multi-Agent System
by: Ala-Salmi, Valtteri, et al.
Published: (2025)
by: Ala-Salmi, Valtteri, et al.
Published: (2025)
Can Large Language Models Serve as Data Analysts? A Multi-Agent Assisted Approach for Qualitative Data Analysis
by: Rasheed, Zeeshan, et al.
Published: (2024)
by: Rasheed, Zeeshan, et al.
Published: (2024)
AI-powered Code Review with LLMs: Early Results
by: Rasheed, Zeeshan, et al.
Published: (2024)
by: Rasheed, Zeeshan, et al.
Published: (2024)
The EU AI Act is a good start but falls short
by: Sillberg, Chalisa Veesommai, et al.
Published: (2024)
by: Sillberg, Chalisa Veesommai, et al.
Published: (2024)
Engineering RAG Systems for Real-World Applications: Design, Development, and Evaluation
by: Hasan, Md Toufique, et al.
Published: (2025)
by: Hasan, Md Toufique, et al.
Published: (2025)
TimeLess: A Vision for the Next Generation of Software Development
by: Rasheed, Zeeshan, et al.
Published: (2024)
by: Rasheed, Zeeshan, et al.
Published: (2024)
LLM-Based Multi-Agent Systems for Code Generation: A Multi-Vocal Literature Review
by: Rasheeda, Zeeshan, et al.
Published: (2026)
by: Rasheeda, Zeeshan, et al.
Published: (2026)
Large Language Model Evaluation Via Multi AI Agents: Preliminary results
by: Rasheed, Zeeshan, et al.
Published: (2024)
by: Rasheed, Zeeshan, et al.
Published: (2024)
System for systematic literature review using multiple AI agents: Concept and an empirical evaluation
by: Sami, Abdul Malik, et al.
Published: (2024)
by: Sami, Abdul Malik, et al.
Published: (2024)
GenAI-Enabled Backlog Grooming in Agile Software Projects: An Empirical Study
by: Oftebro, Kasper Lien, et al.
Published: (2025)
by: Oftebro, Kasper Lien, et al.
Published: (2025)
A Tool for Test Case Scenarios Generation Using Large Language Models
by: Sami, Abdul Malik, et al.
Published: (2024)
by: Sami, Abdul Malik, et al.
Published: (2024)
Understanding the Issues, Their Causes and Solutions in Microservices Systems: An Empirical Study
by: Waseem, Muhammad, et al.
Published: (2023)
by: Waseem, Muhammad, et al.
Published: (2023)
Prioritizing Software Requirements Using Large Language Models
by: Sami, Malik Abdul, et al.
Published: (2024)
by: Sami, Malik Abdul, et al.
Published: (2024)
Assessing and Improving the Representativeness of Code Generation Benchmarks Using Knowledge Units (KUs) of Programming Languages -- An Empirical Study
by: Ahasanuzzaman, Md, et al.
Published: (2026)
by: Ahasanuzzaman, Md, et al.
Published: (2026)
AI based Multiagent Approach for Requirements Elicitation and Analysis
by: Sami, Malik Abdul, et al.
Published: (2024)
by: Sami, Malik Abdul, et al.
Published: (2024)
Experimenting with Multi-Agent Software Development: Towards a Unified Platform
by: Sami, Malik Abdul, et al.
Published: (2024)
by: Sami, Malik Abdul, et al.
Published: (2024)
Software Companies Responses to Hybrid Working
by: Khanna, Dron, et al.
Published: (2024)
by: Khanna, Dron, et al.
Published: (2024)
Prediction Model of Motivators and Demotivators of Integrating Large Language Models in Software Engineering Education: An Empirical Study
by: Khan, Maryam, et al.
Published: (2026)
by: Khan, Maryam, et al.
Published: (2026)
TDD Governance for Multi-Agent Code Generation via Prompt Engineering
by: Hasanli, Tarlan, et al.
Published: (2026)
by: Hasanli, Tarlan, et al.
Published: (2026)
Issues and Their Causes in WebAssembly Applications: An Empirical Study
by: Waseem, Muhammad, et al.
Published: (2023)
by: Waseem, Muhammad, et al.
Published: (2023)
Carbon-Aware Governance Gates: An Architecture for Sustainable GenAI Development
by: Abbasi, Mateen A., et al.
Published: (2026)
by: Abbasi, Mateen A., et al.
Published: (2026)
Towards AI Evaluation in Domain-Specific RAG Systems: The AgriHubi Case Study
by: Hasan, Md. Toufique, et al.
Published: (2026)
by: Hasan, Md. Toufique, et al.
Published: (2026)
Model Compression vs. Adversarial Robustness: An Empirical Study on Language Models for Code
by: Awal, Md. Abdul, et al.
Published: (2025)
by: Awal, Md. Abdul, et al.
Published: (2025)
Toward Green Code: Prompting Small Language Models for Energy-Efficient Code Generation
by: Ashraf, Humza, et al.
Published: (2025)
by: Ashraf, Humza, et al.
Published: (2025)
Integrating Large Language Models in Software Engineering Education: A Pilot Study through GitHub Repositories Mining
by: Khan, Maryam, et al.
Published: (2025)
by: Khan, Maryam, et al.
Published: (2025)
Assessing Code Generation with Intermediate Languages
by: Deng, Xun, et al.
Published: (2024)
by: Deng, Xun, et al.
Published: (2024)
Syntax Is Not Enough: An Empirical Study of Small Transformer Models for Neural Code Repair
by: Samant, Shaunak
Published: (2025)
by: Samant, Shaunak
Published: (2025)
Similar Items
-
LLM-based Multi-Agent System for Intelligent Refactoring of Haskell Code
by: Siddeeq, Shahbaz, et al.
Published: (2025) -
Large Language Models for Code Generation: The Practitioners Perspective
by: Rasheed, Zeeshan, et al.
Published: (2025) -
Distributed Approach to Haskell Based Applications Refactoring with LLMs Based Multi-Agent Systems
by: Siddeeq, Shahbaz, et al.
Published: (2025) -
VAPU: System for Autonomous Legacy Code Modernization
by: Ala-Salmi, Valtteri, et al.
Published: (2025) -
Vibe Coding in Practice: Flow, Technical Debt, and Guidelines for Sustainable Use
by: Waseem, Muhammad, et al.
Published: (2025)