A Multi-Language Object-Oriented Programming Benchmark for Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Shuai, Ding, Liang, Shen, Li, Luo, Yong, Hu, Han, Zhang, Lefei, Lin, Fu |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Strategic Optimization and Challenges of Large Language Models in Object-Oriented Programming
by: Wang, Zinan
Published: (2024)
by: Wang, Zinan
Published: (2024)
Benchmarking Large Language Models for Multi-Language Software Vulnerability Detection
by: Zhang, Ting, et al.
Published: (2025)
by: Zhang, Ting, et al.
Published: (2025)
LLM4Perf: Large Language Models Are Effective Samplers for Multi-Objective Performance Modeling
by: Wang, Xin, et al.
Published: (2025)
by: Wang, Xin, et al.
Published: (2025)
BinMetric: A Comprehensive Binary Analysis Benchmark for Large Language Models
by: Shang, Xiuwei, et al.
Published: (2025)
by: Shang, Xiuwei, et al.
Published: (2025)
CoCo-Bench: A Comprehensive Code Benchmark For Multi-task Large Language Model Evaluation
by: Yin, Wenjing, et al.
Published: (2025)
by: Yin, Wenjing, et al.
Published: (2025)
Chat-like Asserts Prediction with the Support of Large Language Model
by: Wang, Han, et al.
Published: (2024)
by: Wang, Han, et al.
Published: (2024)
SolEval: Benchmarking Large Language Models for Repository-level Solidity Code Generation
by: Peng, Zhiyuan, et al.
Published: (2025)
by: Peng, Zhiyuan, et al.
Published: (2025)
Hybrid Automated Program Repair by Combining Large Language Models and Program Analysis
by: Li, Fengjie, et al.
Published: (2024)
by: Li, Fengjie, et al.
Published: (2024)
Your Fix Is My Exploit: Enabling Comprehensive DL Library API Fuzzing with Large Language Models
by: Zhang, Kunpeng, et al.
Published: (2025)
by: Zhang, Kunpeng, et al.
Published: (2025)
Advancing Code Coverage: Incorporating Program Analysis with Large Language Models
by: Yang, Chen, et al.
Published: (2024)
by: Yang, Chen, et al.
Published: (2024)
On the Effectiveness of Large Language Models in Domain-Specific Code Generation
by: Gu, Xiaodong, et al.
Published: (2023)
by: Gu, Xiaodong, et al.
Published: (2023)
Empirical Evaluation of Large Language Models in Automated Program Repair
by: Sun, Jiajun, et al.
Published: (2025)
by: Sun, Jiajun, et al.
Published: (2025)
Program Slicing in the Era of Large Language Models
by: Shahandashti, Kimya Khakzad, et al.
Published: (2024)
by: Shahandashti, Kimya Khakzad, et al.
Published: (2024)
TESTEVAL: Benchmarking Large Language Models for Test Case Generation
by: Wang, Wenhan, et al.
Published: (2024)
by: Wang, Wenhan, et al.
Published: (2024)
Large Language Models-Aided Program Debloating
by: Lin, Bo, et al.
Published: (2025)
by: Lin, Bo, et al.
Published: (2025)
Exploring Parameter-Efficient Fine-Tuning of Large Language Model on Automated Program Repair
by: Li, Guochang, et al.
Published: (2024)
by: Li, Guochang, et al.
Published: (2024)
Beyond Language Boundaries: Uncovering Programming Language Families for Code Language Models
by: Yun, Shangbo, et al.
Published: (2025)
by: Yun, Shangbo, et al.
Published: (2025)
VulStamp: Vulnerability Assessment using Large Language Model
by: Shen, Hao, et al.
Published: (2025)
by: Shen, Hao, et al.
Published: (2025)
Defects4C: Benchmarking Large Language Model Repair Capability with C/C++ Bugs
by: Wang, Jian, et al.
Published: (2025)
by: Wang, Jian, et al.
Published: (2025)
Exploring the Potential and Limitations of Large Language Models for Novice Program Fault Localization
by: Xu, Hexiang, et al.
Published: (2025)
by: Xu, Hexiang, et al.
Published: (2025)
JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models
by: Cao, Jialun, et al.
Published: (2024)
by: Cao, Jialun, et al.
Published: (2024)
A Survey of Large Language Models for Code: Evolution, Benchmarking, and Future Trends
by: Zheng, Zibin, et al.
Published: (2023)
by: Zheng, Zibin, et al.
Published: (2023)
Assessing and Advancing Benchmarks for Evaluating Large Language Models in Software Engineering Tasks
by: Hu, Xing, et al.
Published: (2025)
by: Hu, Xing, et al.
Published: (2025)
Can Large Language Models Generate Geospatial Code?
by: Hou, Shuyang, et al.
Published: (2024)
by: Hou, Shuyang, et al.
Published: (2024)
Can Large Language Models Model Programs Formally?
by: Chen, Zhiyong, et al.
Published: (2026)
by: Chen, Zhiyong, et al.
Published: (2026)
A Survey of AIOps for Failure Management in the Era of Large Language Models
by: Zhang, Lingzhe, et al.
Published: (2024)
by: Zhang, Lingzhe, et al.
Published: (2024)
Enhancing IR-based Fault Localization using Large Language Models
by: Shao, Shuai, et al.
Published: (2024)
by: Shao, Shuai, et al.
Published: (2024)
An Exploratory Study on Just-in-Time Multi-Programming-Language Bug Prediction
by: Li, Zengyang, et al.
Published: (2024)
by: Li, Zengyang, et al.
Published: (2024)
A Software Engineering Perspective on Testing Large Language Models: Research, Practice, Tools and Benchmarks
by: Hudson, Sinclair, et al.
Published: (2024)
by: Hudson, Sinclair, et al.
Published: (2024)
Studying and Benchmarking Large Language Models For Log Level Suggestion
by: Heng, Yi Wen, et al.
Published: (2024)
by: Heng, Yi Wen, et al.
Published: (2024)
Using Large Language Models for Commit Message Generation: A Preliminary Study
by: Zhang, Linghao, et al.
Published: (2024)
by: Zhang, Linghao, et al.
Published: (2024)
Practical Program Repair in the Era of Large Pre-trained Language Models
by: Xia, Chunqiu Steven, et al.
Published: (2022)
by: Xia, Chunqiu Steven, et al.
Published: (2022)
SimpleDevQA: Benchmarking Large Language Models on Development Knowledge QA
by: Zhang, Jing, et al.
Published: (2025)
by: Zhang, Jing, et al.
Published: (2025)
A Scalable Benchmark for Repository-Oriented Long-Horizon Conversational Context Management
by: Liu, Yang, et al.
Published: (2026)
by: Liu, Yang, et al.
Published: (2026)
QuanBench: Benchmarking Quantum Code Generation with Large Language Models
by: Guo, Xiaoyu, et al.
Published: (2025)
by: Guo, Xiaoyu, et al.
Published: (2025)
Strengthening Programming Comprehension in Large Language Models through Code Generation
by: Ren, Xiaoning, et al.
Published: (2025)
by: Ren, Xiaoning, et al.
Published: (2025)
Semantic-Enhanced Indirect Call Analysis with Large Language Models
by: Cheng, Baijun, et al.
Published: (2024)
by: Cheng, Baijun, et al.
Published: (2024)
When Large Language Models Confront Repository-Level Automatic Program Repair: How Well They Done?
by: Chen, Yuxiao, et al.
Published: (2024)
by: Chen, Yuxiao, et al.
Published: (2024)
A Systematic Literature Review on Large Language Models for Automated Program Repair
by: Zhang, Quanjun, et al.
Published: (2024)
by: Zhang, Quanjun, et al.
Published: (2024)
A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models
by: Hu, Ruida, et al.
Published: (2024)
by: Hu, Ruida, et al.
Published: (2024)
Similar Items
-
Strategic Optimization and Challenges of Large Language Models in Object-Oriented Programming
by: Wang, Zinan
Published: (2024) -
Benchmarking Large Language Models for Multi-Language Software Vulnerability Detection
by: Zhang, Ting, et al.
Published: (2025) -
LLM4Perf: Large Language Models Are Effective Samplers for Multi-Objective Performance Modeling
by: Wang, Xin, et al.
Published: (2025) -
BinMetric: A Comprehensive Binary Analysis Benchmark for Large Language Models
by: Shang, Xiuwei, et al.
Published: (2025) -
CoCo-Bench: A Comprehensive Code Benchmark For Multi-task Large Language Model Evaluation
by: Yin, Wenjing, et al.
Published: (2025)