Salvato in:
| Autori principali: | Ahmed, Khaled, Song, Jialing, Chen, Boqi, Wei, Ou, Zheng, Bingzhou |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2508.00630 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Accurate and Consistent Graph Model Generation from Text with Large Language Models
di: Chen, Boqi, et al.
Pubblicazione: (2025)
di: Chen, Boqi, et al.
Pubblicazione: (2025)
Hierarchical Evaluation of Software Design Capabilities of Large Language Models of Code
di: Saad, Mootez, et al.
Pubblicazione: (2025)
di: Saad, Mootez, et al.
Pubblicazione: (2025)
Structure- and Event-Driven Frameworks for State Machine Modeling with Large Language Models
di: Abdulkarim, Samer, et al.
Pubblicazione: (2026)
di: Abdulkarim, Samer, et al.
Pubblicazione: (2026)
On Inter-dataset Code Duplication and Data Leakage in Large Language Models
di: López, José Antonio Hernández, et al.
Pubblicazione: (2024)
di: López, José Antonio Hernández, et al.
Pubblicazione: (2024)
SHERPA: A Model-Driven Framework for Large Language Model Execution
di: Chen, Boqi, et al.
Pubblicazione: (2025)
di: Chen, Boqi, et al.
Pubblicazione: (2025)
When Elo Lies: Hidden Biases in Codeforces-Based Evaluation of Large Language Models
di: Zheng, Shenyu, et al.
Pubblicazione: (2026)
di: Zheng, Shenyu, et al.
Pubblicazione: (2026)
Beyond Output Correctness: Benchmarking and Evaluating Large Language Model Reasoning in Coding Tasks
di: Li, Yuangang, et al.
Pubblicazione: (2026)
di: Li, Yuangang, et al.
Pubblicazione: (2026)
Are Decoder-Only Large Language Models the Silver Bullet for Code Search?
di: Chen, Yuxuan, et al.
Pubblicazione: (2024)
di: Chen, Yuxuan, et al.
Pubblicazione: (2024)
Narrowing the Complexity Gap in the Evaluation of Large Language Models
di: Chen, Yang, et al.
Pubblicazione: (2026)
di: Chen, Yang, et al.
Pubblicazione: (2026)
Evaluating and Improving Large Language Models for Competitive Program Generation
di: Wei, Minnan, et al.
Pubblicazione: (2025)
di: Wei, Minnan, et al.
Pubblicazione: (2025)
On the Evaluation of Large Language Models in Unit Test Generation
di: Yang, Lin, et al.
Pubblicazione: (2024)
di: Yang, Lin, et al.
Pubblicazione: (2024)
On the Evaluation of Large Language Models in Multilingual Vulnerability Repair
di: wang, Dong, et al.
Pubblicazione: (2025)
di: wang, Dong, et al.
Pubblicazione: (2025)
DesignCoder: Hierarchy-Aware and Self-Correcting UI Code Generation with Large Language Models
di: Chen, Yunnong, et al.
Pubblicazione: (2025)
di: Chen, Yunnong, et al.
Pubblicazione: (2025)
A Survey on Evaluating Large Language Models in Code Generation Tasks
di: Chen, Liguo, et al.
Pubblicazione: (2024)
di: Chen, Liguo, et al.
Pubblicazione: (2024)
Beyond Functional Correctness: Investigating Coding Style Inconsistencies in Large Language Models
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
Assertion Messages with Large Language Models (LLMs) for Code
di: Aljohani, Ahmed, et al.
Pubblicazione: (2025)
di: Aljohani, Ahmed, et al.
Pubblicazione: (2025)
FeedbackEval: A Benchmark for Evaluating Large Language Models in Feedback-Driven Code Repair Tasks
di: Dai, Dekun, et al.
Pubblicazione: (2025)
di: Dai, Dekun, et al.
Pubblicazione: (2025)
Can Small GenAI Language Models Rival Large Language Models in Understanding Application Behavior?
di: Meymani, Mohammad, et al.
Pubblicazione: (2025)
di: Meymani, Mohammad, et al.
Pubblicazione: (2025)
Commit Messages in the Age of Large Language Models
di: Lopes, Cristina V., et al.
Pubblicazione: (2024)
di: Lopes, Cristina V., et al.
Pubblicazione: (2024)
Large Language Models in Game Development: Implications for Gameplay, Playability, and Player Experience
di: Johnson, Keeryn, et al.
Pubblicazione: (2026)
di: Johnson, Keeryn, et al.
Pubblicazione: (2026)
On the use of Large Language Models in Model-Driven Engineering
di: Di Rocco, Juri, et al.
Pubblicazione: (2024)
di: Di Rocco, Juri, et al.
Pubblicazione: (2024)
An Empirical Study on Low-Code Programming using Traditional vs Large Language Model Support
di: Liu, Yongkun, et al.
Pubblicazione: (2024)
di: Liu, Yongkun, et al.
Pubblicazione: (2024)
Analyzing the Instability of Large Language Models in Automated Bug Injection and Correction
di: Er, Mehmet Bilal, et al.
Pubblicazione: (2025)
di: Er, Mehmet Bilal, et al.
Pubblicazione: (2025)
Defining and Detecting the Defects of the Large Language Model-based Autonomous Agents
di: Ning, Kaiwen, et al.
Pubblicazione: (2024)
di: Ning, Kaiwen, et al.
Pubblicazione: (2024)
VulStamp: Vulnerability Assessment using Large Language Model
di: Shen, Hao, et al.
Pubblicazione: (2025)
di: Shen, Hao, et al.
Pubblicazione: (2025)
Bidirectional Empowerment of Metamorphic Testing and Large Language Models: A Systematic Survey
di: Zheng, Zheng, et al.
Pubblicazione: (2026)
di: Zheng, Zheng, et al.
Pubblicazione: (2026)
Evaluating Large Language Models for Multilingual Vulnerability Detection at Dual Granularities
di: Shu, Honglin, et al.
Pubblicazione: (2025)
di: Shu, Honglin, et al.
Pubblicazione: (2025)
LLM-based Satisfiability Checking of String Requirements by Consistent Data and Checker Generation
di: Chen, Boqi, et al.
Pubblicazione: (2025)
di: Chen, Boqi, et al.
Pubblicazione: (2025)
Evaluating Generated Commit Messages with Large Language Models
di: Zeng, Qunhong, et al.
Pubblicazione: (2025)
di: Zeng, Qunhong, et al.
Pubblicazione: (2025)
Debugging with Open-Source Large Language Models: An Evaluation
di: Majdoub, Yacine, et al.
Pubblicazione: (2024)
di: Majdoub, Yacine, et al.
Pubblicazione: (2024)
Evaluating Large Language Models in Detecting Test Smells
di: Lucas, Keila, et al.
Pubblicazione: (2024)
di: Lucas, Keila, et al.
Pubblicazione: (2024)
Software Testing with Large Language Models: Survey, Landscape, and Vision
di: Wang, Junjie, et al.
Pubblicazione: (2023)
di: Wang, Junjie, et al.
Pubblicazione: (2023)
Ensembling Large Language Models for Code Vulnerability Detection: An Empirical Evaluation
di: Sun, Zhihong, et al.
Pubblicazione: (2025)
di: Sun, Zhihong, et al.
Pubblicazione: (2025)
Calibration and Correctness of Language Models for Code
di: Spiess, Claudio, et al.
Pubblicazione: (2024)
di: Spiess, Claudio, et al.
Pubblicazione: (2024)
Towards an Understanding of Large Language Models in Software Engineering Tasks
di: Zheng, Zibin, et al.
Pubblicazione: (2023)
di: Zheng, Zibin, et al.
Pubblicazione: (2023)
A Survey of Large Language Models for Code: Evolution, Benchmarking, and Future Trends
di: Zheng, Zibin, et al.
Pubblicazione: (2023)
di: Zheng, Zibin, et al.
Pubblicazione: (2023)
PATCH: Empowering Large Language Model with Programmer-Intent Guidance and Collaborative-Behavior Simulation for Automatic Bug Fixing
di: Zhang, Yuwei, et al.
Pubblicazione: (2025)
di: Zhang, Yuwei, et al.
Pubblicazione: (2025)
Testing and Evaluation of Large Language Models: Correctness, Non-Toxicity, and Fairness
di: Wang, Wenxuan
Pubblicazione: (2024)
di: Wang, Wenxuan
Pubblicazione: (2024)
Secret Breach Detection in Source Code with Large Language Models
di: Rahman, Md Nafiu, et al.
Pubblicazione: (2025)
di: Rahman, Md Nafiu, et al.
Pubblicazione: (2025)
Class Model Generation from Requirements using Large Language Models
di: Nguyen, Jackson, et al.
Pubblicazione: (2026)
di: Nguyen, Jackson, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Accurate and Consistent Graph Model Generation from Text with Large Language Models
di: Chen, Boqi, et al.
Pubblicazione: (2025) -
Hierarchical Evaluation of Software Design Capabilities of Large Language Models of Code
di: Saad, Mootez, et al.
Pubblicazione: (2025) -
Structure- and Event-Driven Frameworks for State Machine Modeling with Large Language Models
di: Abdulkarim, Samer, et al.
Pubblicazione: (2026) -
On Inter-dataset Code Duplication and Data Leakage in Large Language Models
di: López, José Antonio Hernández, et al.
Pubblicazione: (2024) -
SHERPA: A Model-Driven Framework for Large Language Model Execution
di: Chen, Boqi, et al.
Pubblicazione: (2025)