Evaluating Source Code Quality with Large Language Models: a comparative study
Fuente:
arXiv
Guardado en:
| Autores principales: | Simões, Igor Regis da Silva, Venson, Elaine |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Measuring how changes in code readability attributes affect code quality evaluation by Large Language Models
por: Simoes, Igor Regis da Silva, et al.
Publicado: (2025)
por: Simoes, Igor Regis da Silva, et al.
Publicado: (2025)
Bridging Theory to Practice in Software Testing Teaching through Team-based Learning (TBL) and Open Source Software (OSS) Contribution
por: Venson, Elaine, et al.
Publicado: (2024)
por: Venson, Elaine, et al.
Publicado: (2024)
Large Language Model Unlearning for Source Code
por: Jiang, Xue, et al.
Publicado: (2025)
por: Jiang, Xue, et al.
Publicado: (2025)
Secret Breach Detection in Source Code with Large Language Models
por: Rahman, Md Nafiu, et al.
Publicado: (2025)
por: Rahman, Md Nafiu, et al.
Publicado: (2025)
On the Quality of AI-Generated Source Code Comments: A Comprehensive Evaluation
por: Guelman, Ian, et al.
Publicado: (2024)
por: Guelman, Ian, et al.
Publicado: (2024)
Debugging with Open-Source Large Language Models: An Evaluation
por: Majdoub, Yacine, et al.
Publicado: (2024)
por: Majdoub, Yacine, et al.
Publicado: (2024)
Measuring Determinism in Large Language Models for Software Code Review
por: Klishevich, Eugene, et al.
Publicado: (2025)
por: Klishevich, Eugene, et al.
Publicado: (2025)
Can Large Language Models Serve as Evaluators for Code Summarization?
por: Wu, Yang, et al.
Publicado: (2024)
por: Wu, Yang, et al.
Publicado: (2024)
Asm2SrcEval: Evaluating Large Language Models for Assembly-to-Source Code Translation
por: Hamedi, Parisa, et al.
Publicado: (2025)
por: Hamedi, Parisa, et al.
Publicado: (2025)
Ethical Classification of Non-Coding Contributions in Open-Source Projects via Large Language Models
por: Cobos, Sergio, et al.
Publicado: (2025)
por: Cobos, Sergio, et al.
Publicado: (2025)
A Survey on Evaluating Large Language Models in Code Generation Tasks
por: Chen, Liguo, et al.
Publicado: (2024)
por: Chen, Liguo, et al.
Publicado: (2024)
CFCEval: Evaluating Security Aspects in Code Generated by Large Language Models
por: Cheng, Cheng, et al.
Publicado: (2025)
por: Cheng, Cheng, et al.
Publicado: (2025)
Hierarchical Evaluation of Software Design Capabilities of Large Language Models of Code
por: Saad, Mootez, et al.
Publicado: (2025)
por: Saad, Mootez, et al.
Publicado: (2025)
Ensembling Large Language Models for Code Vulnerability Detection: An Empirical Evaluation
por: Sun, Zhihong, et al.
Publicado: (2025)
por: Sun, Zhihong, et al.
Publicado: (2025)
Evaluating Large Language Models for Code Translation: Effects of Prompt Language and Prompt Design
por: Aljagthami, Aamer, et al.
Publicado: (2025)
por: Aljagthami, Aamer, et al.
Publicado: (2025)
Beyond Strict Rules: Assessing the Effectiveness of Large Language Models for Code Smell Detection
por: Souza, Saymon, et al.
Publicado: (2026)
por: Souza, Saymon, et al.
Publicado: (2026)
ClassEval-T: Evaluating Large Language Models in Class-Level Code Translation
por: Xue, Pengyu, et al.
Publicado: (2024)
por: Xue, Pengyu, et al.
Publicado: (2024)
Evaluating the Impact of Post-Training Quantization on Large Language Models for Code Generation
por: Giagnorio, Alessandro, et al.
Publicado: (2025)
por: Giagnorio, Alessandro, et al.
Publicado: (2025)
Evaluating Large Language Models for Code Review
por: Cihan, Umut, et al.
Publicado: (2025)
por: Cihan, Umut, et al.
Publicado: (2025)
Generating High-Quality Datasets for Code Editing via Open-Source Language Models
por: Zhang, Zekai, et al.
Publicado: (2025)
por: Zhang, Zekai, et al.
Publicado: (2025)
Quality Assessment of Python Tests Generated by Large Language Models
por: Alves, Victor, et al.
Publicado: (2025)
por: Alves, Victor, et al.
Publicado: (2025)
Towards Leveraging Large Language Model Summaries for Topic Modeling in Source Code
por: Carissimi, Michele, et al.
Publicado: (2025)
por: Carissimi, Michele, et al.
Publicado: (2025)
Hotfixing Large Language Models for Code
por: Yang, Zhou, et al.
Publicado: (2024)
por: Yang, Zhou, et al.
Publicado: (2024)
Ecosystem of Large Language Models for Code
por: Yang, Zhou, et al.
Publicado: (2024)
por: Yang, Zhou, et al.
Publicado: (2024)
Precision or Peril: A PoC of Python Code Quality from Quantized Large Language Models
por: Melin, Eric L., et al.
Publicado: (2024)
por: Melin, Eric L., et al.
Publicado: (2024)
Greening Large Language Models of Code
por: Shi, Jieke, et al.
Publicado: (2023)
por: Shi, Jieke, et al.
Publicado: (2023)
Augmenting Large Language Models with Static Code Analysis for Automated Code Quality Improvements
por: Abtahi, Seyed Moein, et al.
Publicado: (2025)
por: Abtahi, Seyed Moein, et al.
Publicado: (2025)
On Evaluating the Efficiency of Source Code Generated by LLMs
por: Niu, Changan, et al.
Publicado: (2024)
por: Niu, Changan, et al.
Publicado: (2024)
Quality Gatekeepers: Investigating the Effects ofCode Review Bots on Pull Request Activities
por: Wessel, Mairieli, et al.
Publicado: (2021)
por: Wessel, Mairieli, et al.
Publicado: (2021)
SpecEval: Evaluating Code Comprehension in Large Language Models via Program Specifications
por: Ma, Lezhi, et al.
Publicado: (2024)
por: Ma, Lezhi, et al.
Publicado: (2024)
From Evaluation to Enhancement: Large Language Models for Zero-Knowledge Proof Code Generation
por: Xue, Zhantong, et al.
Publicado: (2025)
por: Xue, Zhantong, et al.
Publicado: (2025)
Cross-Task Benchmarking and Evaluation of General-Purpose and Code-Specific Large Language Models
por: Das, Gunjan, et al.
Publicado: (2025)
por: Das, Gunjan, et al.
Publicado: (2025)
Evaluating Code Reasoning Abilities of Large Language Models Under Real-World Settings
por: Liu, Changshu, et al.
Publicado: (2025)
por: Liu, Changshu, et al.
Publicado: (2025)
LLMigrate: Transforming "Lazy" Large Language Models into Efficient Source Code Migrators
por: Liu, Yuchen, et al.
Publicado: (2025)
por: Liu, Yuchen, et al.
Publicado: (2025)
SV-TrustEval-C: Evaluating Structure and Semantic Reasoning in Large Language Models for Source Code Vulnerability Analysis
por: Li, Yansong, et al.
Publicado: (2025)
por: Li, Yansong, et al.
Publicado: (2025)
Unlearning Trojans in Large Language Models: A Comparison Between Natural Language and Source Code
por: Kazemi, Mahdi, et al.
Publicado: (2024)
por: Kazemi, Mahdi, et al.
Publicado: (2024)
ComplexCodeEval: A Benchmark for Evaluating Large Code Models on More Complex Code
por: Feng, Jia, et al.
Publicado: (2024)
por: Feng, Jia, et al.
Publicado: (2024)
An Effective Approach to Embedding Source Code by Combining Large Language and Sentence Embedding Models
por: Xian, Zixiang, et al.
Publicado: (2024)
por: Xian, Zixiang, et al.
Publicado: (2024)
The First Prompt Counts the Most! An Evaluation of Large Language Models on Iterative Example-Based Code Generation
por: Fu, Yingjie, et al.
Publicado: (2024)
por: Fu, Yingjie, et al.
Publicado: (2024)
FeedbackEval: A Benchmark for Evaluating Large Language Models in Feedback-Driven Code Repair Tasks
por: Dai, Dekun, et al.
Publicado: (2025)
por: Dai, Dekun, et al.
Publicado: (2025)
Ejemplares similares
-
Measuring how changes in code readability attributes affect code quality evaluation by Large Language Models
por: Simoes, Igor Regis da Silva, et al.
Publicado: (2025) -
Bridging Theory to Practice in Software Testing Teaching through Team-based Learning (TBL) and Open Source Software (OSS) Contribution
por: Venson, Elaine, et al.
Publicado: (2024) -
Large Language Model Unlearning for Source Code
por: Jiang, Xue, et al.
Publicado: (2025) -
Secret Breach Detection in Source Code with Large Language Models
por: Rahman, Md Nafiu, et al.
Publicado: (2025) -
On the Quality of AI-Generated Source Code Comments: A Comprehensive Evaluation
por: Guelman, Ian, et al.
Publicado: (2024)