Enregistré dans:
| Auteurs principaux: | Ahmed, Khaled, Song, Jialing, Chen, Boqi, Wei, Ou, Zheng, Bingzhou |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2508.00630 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Accurate and Consistent Graph Model Generation from Text with Large Language Models
par: Chen, Boqi, et autres
Publié: (2025)
par: Chen, Boqi, et autres
Publié: (2025)
Hierarchical Evaluation of Software Design Capabilities of Large Language Models of Code
par: Saad, Mootez, et autres
Publié: (2025)
par: Saad, Mootez, et autres
Publié: (2025)
Structure- and Event-Driven Frameworks for State Machine Modeling with Large Language Models
par: Abdulkarim, Samer, et autres
Publié: (2026)
par: Abdulkarim, Samer, et autres
Publié: (2026)
On Inter-dataset Code Duplication and Data Leakage in Large Language Models
par: López, José Antonio Hernández, et autres
Publié: (2024)
par: López, José Antonio Hernández, et autres
Publié: (2024)
SHERPA: A Model-Driven Framework for Large Language Model Execution
par: Chen, Boqi, et autres
Publié: (2025)
par: Chen, Boqi, et autres
Publié: (2025)
When Elo Lies: Hidden Biases in Codeforces-Based Evaluation of Large Language Models
par: Zheng, Shenyu, et autres
Publié: (2026)
par: Zheng, Shenyu, et autres
Publié: (2026)
Beyond Output Correctness: Benchmarking and Evaluating Large Language Model Reasoning in Coding Tasks
par: Li, Yuangang, et autres
Publié: (2026)
par: Li, Yuangang, et autres
Publié: (2026)
Are Decoder-Only Large Language Models the Silver Bullet for Code Search?
par: Chen, Yuxuan, et autres
Publié: (2024)
par: Chen, Yuxuan, et autres
Publié: (2024)
Narrowing the Complexity Gap in the Evaluation of Large Language Models
par: Chen, Yang, et autres
Publié: (2026)
par: Chen, Yang, et autres
Publié: (2026)
Evaluating and Improving Large Language Models for Competitive Program Generation
par: Wei, Minnan, et autres
Publié: (2025)
par: Wei, Minnan, et autres
Publié: (2025)
On the Evaluation of Large Language Models in Unit Test Generation
par: Yang, Lin, et autres
Publié: (2024)
par: Yang, Lin, et autres
Publié: (2024)
On the Evaluation of Large Language Models in Multilingual Vulnerability Repair
par: wang, Dong, et autres
Publié: (2025)
par: wang, Dong, et autres
Publié: (2025)
DesignCoder: Hierarchy-Aware and Self-Correcting UI Code Generation with Large Language Models
par: Chen, Yunnong, et autres
Publié: (2025)
par: Chen, Yunnong, et autres
Publié: (2025)
A Survey on Evaluating Large Language Models in Code Generation Tasks
par: Chen, Liguo, et autres
Publié: (2024)
par: Chen, Liguo, et autres
Publié: (2024)
Beyond Functional Correctness: Investigating Coding Style Inconsistencies in Large Language Models
par: Wang, Yanlin, et autres
Publié: (2024)
par: Wang, Yanlin, et autres
Publié: (2024)
Assertion Messages with Large Language Models (LLMs) for Code
par: Aljohani, Ahmed, et autres
Publié: (2025)
par: Aljohani, Ahmed, et autres
Publié: (2025)
FeedbackEval: A Benchmark for Evaluating Large Language Models in Feedback-Driven Code Repair Tasks
par: Dai, Dekun, et autres
Publié: (2025)
par: Dai, Dekun, et autres
Publié: (2025)
Can Small GenAI Language Models Rival Large Language Models in Understanding Application Behavior?
par: Meymani, Mohammad, et autres
Publié: (2025)
par: Meymani, Mohammad, et autres
Publié: (2025)
Commit Messages in the Age of Large Language Models
par: Lopes, Cristina V., et autres
Publié: (2024)
par: Lopes, Cristina V., et autres
Publié: (2024)
Large Language Models in Game Development: Implications for Gameplay, Playability, and Player Experience
par: Johnson, Keeryn, et autres
Publié: (2026)
par: Johnson, Keeryn, et autres
Publié: (2026)
On the use of Large Language Models in Model-Driven Engineering
par: Di Rocco, Juri, et autres
Publié: (2024)
par: Di Rocco, Juri, et autres
Publié: (2024)
An Empirical Study on Low-Code Programming using Traditional vs Large Language Model Support
par: Liu, Yongkun, et autres
Publié: (2024)
par: Liu, Yongkun, et autres
Publié: (2024)
Analyzing the Instability of Large Language Models in Automated Bug Injection and Correction
par: Er, Mehmet Bilal, et autres
Publié: (2025)
par: Er, Mehmet Bilal, et autres
Publié: (2025)
Defining and Detecting the Defects of the Large Language Model-based Autonomous Agents
par: Ning, Kaiwen, et autres
Publié: (2024)
par: Ning, Kaiwen, et autres
Publié: (2024)
VulStamp: Vulnerability Assessment using Large Language Model
par: Shen, Hao, et autres
Publié: (2025)
par: Shen, Hao, et autres
Publié: (2025)
Bidirectional Empowerment of Metamorphic Testing and Large Language Models: A Systematic Survey
par: Zheng, Zheng, et autres
Publié: (2026)
par: Zheng, Zheng, et autres
Publié: (2026)
Evaluating Large Language Models for Multilingual Vulnerability Detection at Dual Granularities
par: Shu, Honglin, et autres
Publié: (2025)
par: Shu, Honglin, et autres
Publié: (2025)
LLM-based Satisfiability Checking of String Requirements by Consistent Data and Checker Generation
par: Chen, Boqi, et autres
Publié: (2025)
par: Chen, Boqi, et autres
Publié: (2025)
Evaluating Generated Commit Messages with Large Language Models
par: Zeng, Qunhong, et autres
Publié: (2025)
par: Zeng, Qunhong, et autres
Publié: (2025)
Debugging with Open-Source Large Language Models: An Evaluation
par: Majdoub, Yacine, et autres
Publié: (2024)
par: Majdoub, Yacine, et autres
Publié: (2024)
Evaluating Large Language Models in Detecting Test Smells
par: Lucas, Keila, et autres
Publié: (2024)
par: Lucas, Keila, et autres
Publié: (2024)
Software Testing with Large Language Models: Survey, Landscape, and Vision
par: Wang, Junjie, et autres
Publié: (2023)
par: Wang, Junjie, et autres
Publié: (2023)
Ensembling Large Language Models for Code Vulnerability Detection: An Empirical Evaluation
par: Sun, Zhihong, et autres
Publié: (2025)
par: Sun, Zhihong, et autres
Publié: (2025)
Calibration and Correctness of Language Models for Code
par: Spiess, Claudio, et autres
Publié: (2024)
par: Spiess, Claudio, et autres
Publié: (2024)
Towards an Understanding of Large Language Models in Software Engineering Tasks
par: Zheng, Zibin, et autres
Publié: (2023)
par: Zheng, Zibin, et autres
Publié: (2023)
A Survey of Large Language Models for Code: Evolution, Benchmarking, and Future Trends
par: Zheng, Zibin, et autres
Publié: (2023)
par: Zheng, Zibin, et autres
Publié: (2023)
PATCH: Empowering Large Language Model with Programmer-Intent Guidance and Collaborative-Behavior Simulation for Automatic Bug Fixing
par: Zhang, Yuwei, et autres
Publié: (2025)
par: Zhang, Yuwei, et autres
Publié: (2025)
Testing and Evaluation of Large Language Models: Correctness, Non-Toxicity, and Fairness
par: Wang, Wenxuan
Publié: (2024)
par: Wang, Wenxuan
Publié: (2024)
Secret Breach Detection in Source Code with Large Language Models
par: Rahman, Md Nafiu, et autres
Publié: (2025)
par: Rahman, Md Nafiu, et autres
Publié: (2025)
Class Model Generation from Requirements using Large Language Models
par: Nguyen, Jackson, et autres
Publié: (2026)
par: Nguyen, Jackson, et autres
Publié: (2026)
Documents similaires
-
Accurate and Consistent Graph Model Generation from Text with Large Language Models
par: Chen, Boqi, et autres
Publié: (2025) -
Hierarchical Evaluation of Software Design Capabilities of Large Language Models of Code
par: Saad, Mootez, et autres
Publié: (2025) -
Structure- and Event-Driven Frameworks for State Machine Modeling with Large Language Models
par: Abdulkarim, Samer, et autres
Publié: (2026) -
On Inter-dataset Code Duplication and Data Leakage in Large Language Models
par: López, José Antonio Hernández, et autres
Publié: (2024) -
SHERPA: A Model-Driven Framework for Large Language Model Execution
par: Chen, Boqi, et autres
Publié: (2025)