Evaluating SAP Joule for Code Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Heisler, Joshua, Reisinger, Johannes, Fischer, Andreas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Evaluating the Energy-Efficiency of the Code Generated by LLMs
di: Islam, Md Arman, et al.
Pubblicazione: (2025)
di: Islam, Md Arman, et al.
Pubblicazione: (2025)
User Centric Evaluation of Code Generation Tools
di: Miah, Tanha, et al.
Pubblicazione: (2024)
di: Miah, Tanha, et al.
Pubblicazione: (2024)
Holistic Evaluation of State-of-the-Art LLMs for Code Generation
di: Zhang, Le, et al.
Pubblicazione: (2025)
di: Zhang, Le, et al.
Pubblicazione: (2025)
Flow2Code: Evaluating Large Language Models for Flowchart-based Code Generation Capability
di: He, Mengliang, et al.
Pubblicazione: (2025)
di: He, Mengliang, et al.
Pubblicazione: (2025)
Benchmarks and Metrics for Evaluations of Code Generation: A Critical Review
di: Paul, Debalina Ghosh, et al.
Pubblicazione: (2024)
di: Paul, Debalina Ghosh, et al.
Pubblicazione: (2024)
ReCUBE: Evaluating Repository-Level Context Utilization in Code Generation
di: Hong, Jiseung, et al.
Pubblicazione: (2026)
di: Hong, Jiseung, et al.
Pubblicazione: (2026)
ScenEval: A Benchmark for Scenario-Based Evaluation of Code Generation
di: Paul, Debalina Ghosh, et al.
Pubblicazione: (2024)
di: Paul, Debalina Ghosh, et al.
Pubblicazione: (2024)
Hallucinations in Code Change to Natural Language Generation: Prevalence and Evaluation of Detection Metrics
di: Liu, Chunhua, et al.
Pubblicazione: (2025)
di: Liu, Chunhua, et al.
Pubblicazione: (2025)
CodeGolf Bench: A Multi-Language Benchmark for Evaluating Concise Code Generation Capabilities of Large Language Models
di: Padwal, Vedant
Pubblicazione: (2026)
di: Padwal, Vedant
Pubblicazione: (2026)
Generating Software Architecture Description from Source Code using Reverse Engineering and Large Language Model
di: Hatahet, Ahmad, et al.
Pubblicazione: (2025)
di: Hatahet, Ahmad, et al.
Pubblicazione: (2025)
InteractScience: Programmatic and Visually-Grounded Evaluation of Interactive Scientific Demonstration Code Generation
di: Chen, Qiaosheng, et al.
Pubblicazione: (2025)
di: Chen, Qiaosheng, et al.
Pubblicazione: (2025)
COMPASS: A Multi-Dimensional Benchmark for Evaluating Code Generation in Large Language Models
di: Meaden, James, et al.
Pubblicazione: (2025)
di: Meaden, James, et al.
Pubblicazione: (2025)
CrossPL: Evaluating Large Language Models on Cross Programming Language Code Generation
di: Xiong, Zhanhang, et al.
Pubblicazione: (2025)
di: Xiong, Zhanhang, et al.
Pubblicazione: (2025)
A.S.E: A Repository-Level Benchmark for Evaluating Security in AI-Generated Code
di: Lian, Keke, et al.
Pubblicazione: (2025)
di: Lian, Keke, et al.
Pubblicazione: (2025)
Evaluating Large Language Models in Code Generation: INFINITE Methodology for Defining the Inference Index
di: Christakis, Nicholas, et al.
Pubblicazione: (2025)
di: Christakis, Nicholas, et al.
Pubblicazione: (2025)
A Qualitative Investigation into LLM-Generated Multilingual Code Comments and Automatic Evaluation Metrics
di: Katzy, Jonathan, et al.
Pubblicazione: (2025)
di: Katzy, Jonathan, et al.
Pubblicazione: (2025)
LLMs in Web Development: Evaluating LLM-Generated PHP Code Unveiling Vulnerabilities and Limitations
di: Tóth, Rebeka, et al.
Pubblicazione: (2024)
di: Tóth, Rebeka, et al.
Pubblicazione: (2024)
RedCode: Risky Code Execution and Generation Benchmark for Code Agents
di: Guo, Chengquan, et al.
Pubblicazione: (2024)
di: Guo, Chengquan, et al.
Pubblicazione: (2024)
CodeFort: Robust Training for Code Generation Models
di: Zhang, Yuhao, et al.
Pubblicazione: (2024)
di: Zhang, Yuhao, et al.
Pubblicazione: (2024)
CodeCoT: Tackling Code Syntax Errors in CoT Reasoning for Code Generation
di: Huang, Dong, et al.
Pubblicazione: (2023)
di: Huang, Dong, et al.
Pubblicazione: (2023)
WebCompass: Towards Multimodal Web Coding Evaluation for Code Language Models
di: Lei, Xinping, et al.
Pubblicazione: (2026)
di: Lei, Xinping, et al.
Pubblicazione: (2026)
RobuNFR: Evaluating the Robustness of Large Language Models on Non-Functional Requirements Aware Code Generation
di: Lin, Feng, et al.
Pubblicazione: (2025)
di: Lin, Feng, et al.
Pubblicazione: (2025)
Evaluation of the Code Generation Capabilities of ChatGPT 4: A Comparative Analysis in 19 Programming Languages
di: Gilbert, L. C.
Pubblicazione: (2025)
di: Gilbert, L. C.
Pubblicazione: (2025)
Evaluating Large Language Models for Code Review
di: Cihan, Umut, et al.
Pubblicazione: (2025)
di: Cihan, Umut, et al.
Pubblicazione: (2025)
Quality Evaluation of COBOL to Java Code Transformation
di: Froimovich, Shmulik, et al.
Pubblicazione: (2025)
di: Froimovich, Shmulik, et al.
Pubblicazione: (2025)
Code Copycat Conundrum: Demystifying Repetition in LLM-based Code Generation
di: Liu, Mingwei, et al.
Pubblicazione: (2025)
di: Liu, Mingwei, et al.
Pubblicazione: (2025)
CATCODER: Repository-Level Code Generation with Relevant Code and Type Context
di: Pan, Zhiyuan, et al.
Pubblicazione: (2024)
di: Pan, Zhiyuan, et al.
Pubblicazione: (2024)
Uncovering LLM-Generated Code: A Zero-Shot Synthetic Code Detector via Code Rewriting
di: Ye, Tong, et al.
Pubblicazione: (2024)
di: Ye, Tong, et al.
Pubblicazione: (2024)
Coding in a Bubble? Evaluating LLMs in Resolving Context Adaptation Bugs During Code Adaptation
di: Zhang, Tanghaoran, et al.
Pubblicazione: (2026)
di: Zhang, Tanghaoran, et al.
Pubblicazione: (2026)
Demo-Craft: Using In-Context Learning to Improve Code Generation in Large Language Models
di: Kapu, Nirmal Joshua, et al.
Pubblicazione: (2024)
di: Kapu, Nirmal Joshua, et al.
Pubblicazione: (2024)
Investigating The Smells of LLM Generated Code
di: Paul, Debalina Ghosh, et al.
Pubblicazione: (2025)
di: Paul, Debalina Ghosh, et al.
Pubblicazione: (2025)
Test-Driven Development for Code Generation
di: Mathews, Noble Saji, et al.
Pubblicazione: (2024)
di: Mathews, Noble Saji, et al.
Pubblicazione: (2024)
SALLM: Security Assessment of Generated Code
di: Siddiq, Mohammed Latif, et al.
Pubblicazione: (2023)
di: Siddiq, Mohammed Latif, et al.
Pubblicazione: (2023)
Klear-CodeTest: Scalable Test Case Generation for Code Reinforcement Learning
di: Fu, Jia, et al.
Pubblicazione: (2025)
di: Fu, Jia, et al.
Pubblicazione: (2025)
Top Pass: Improve Code Generation by Pass@k-Maximized Code Ranking
di: Lyu, Zhi-Cun, et al.
Pubblicazione: (2024)
di: Lyu, Zhi-Cun, et al.
Pubblicazione: (2024)
Learn to Code Sustainably: An Empirical Study on LLM-based Green Code Generation
di: Vartziotis, Tina, et al.
Pubblicazione: (2024)
di: Vartziotis, Tina, et al.
Pubblicazione: (2024)
A Controlled Experiment on the Energy Efficiency of the Source Code Generated by Code Llama
di: Cursaru, Vlad-Andrei, et al.
Pubblicazione: (2024)
di: Cursaru, Vlad-Andrei, et al.
Pubblicazione: (2024)
Selection of Prompt Engineering Techniques for Code Generation through Predicting Code Complexity
di: Wang, Chung-Yu, et al.
Pubblicazione: (2024)
di: Wang, Chung-Yu, et al.
Pubblicazione: (2024)
Revisit Self-Debugging with Self-Generated Tests for Code Generation
di: Chen, Xiancai, et al.
Pubblicazione: (2025)
di: Chen, Xiancai, et al.
Pubblicazione: (2025)
GeoCode-GPT: A Large Language Model for Geospatial Code Generation Tasks
di: Hou, Shuyang, et al.
Pubblicazione: (2024)
di: Hou, Shuyang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Evaluating the Energy-Efficiency of the Code Generated by LLMs
di: Islam, Md Arman, et al.
Pubblicazione: (2025) -
User Centric Evaluation of Code Generation Tools
di: Miah, Tanha, et al.
Pubblicazione: (2024) -
Holistic Evaluation of State-of-the-Art LLMs for Code Generation
di: Zhang, Le, et al.
Pubblicazione: (2025) -
Flow2Code: Evaluating Large Language Models for Flowchart-based Code Generation Capability
di: He, Mengliang, et al.
Pubblicazione: (2025) -
Benchmarks and Metrics for Evaluations of Code Generation: A Critical Review
di: Paul, Debalina Ghosh, et al.
Pubblicazione: (2024)