RepoMasterEval: Evaluating Code Completion via Real-World Repositories
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Qinyun, Peng, Chao, Gao, Pengfei, Hu, Ruida, Gan, Haoyu, Jiang, Bo, Tang, Jinhe, Deng, Zhiwen, Guan, Zhanming, Gao, Cuiyun, Liu, Xia, Yang, Ping |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Repo2Run: Automated Building Executable Environment for Code Repository at Scale
por: Hu, Ruida, et al.
Publicado: (2025)
por: Hu, Ruida, et al.
Publicado: (2025)
CodeRepoQA: A Large-scale Benchmark for Software Engineering Question Answering
por: Hu, Ruida, et al.
Publicado: (2024)
por: Hu, Ruida, et al.
Publicado: (2024)
A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models
por: Hu, Ruida, et al.
Publicado: (2024)
por: Hu, Ruida, et al.
Publicado: (2024)
ReposVul: A Repository-Level High-Quality Vulnerability Dataset
por: Wang, Xinchen, et al.
Publicado: (2024)
por: Wang, Xinchen, et al.
Publicado: (2024)
Evaluating Repository-level Software Documentation via Question Answering and Feature-Driven Development
por: Wang, Xinchen, et al.
Publicado: (2026)
por: Wang, Xinchen, et al.
Publicado: (2026)
SR-Eval: Evaluating LLMs on Code Generation under Stepwise Requirement Refinement
por: Zhan, Zexun, et al.
Publicado: (2025)
por: Zhan, Zexun, et al.
Publicado: (2025)
CodeVisionary: An Agent-based Framework for Evaluating Large Language Models in Code Generation
por: Wang, Xinchen, et al.
Publicado: (2025)
por: Wang, Xinchen, et al.
Publicado: (2025)
VulEval: Towards Repository-Level Evaluation of Software Vulnerability Detection
por: Wen, Xin-Cheng, et al.
Publicado: (2024)
por: Wen, Xin-Cheng, et al.
Publicado: (2024)
SecRepoBench: Benchmarking Code Agents for Secure Code Completion in Real-World Repositories
por: Shen, Chihao, et al.
Publicado: (2025)
por: Shen, Chihao, et al.
Publicado: (2025)
ContextModule: Improving Code Completion via Repository-level Contextual Information
por: Guan, Zhanming, et al.
Publicado: (2024)
por: Guan, Zhanming, et al.
Publicado: (2024)
Benchmarking LLMs for Fine-Grained Code Review with Enriched Context in Practice
por: Hu, Ruida, et al.
Publicado: (2025)
por: Hu, Ruida, et al.
Publicado: (2025)
RepoTransAgent: Multi-Agent LLM Framework for Repository-Aware Code Translation
por: Guan, Ziqi, et al.
Publicado: (2025)
por: Guan, Ziqi, et al.
Publicado: (2025)
RepoTransBench: A Real-World Multilingual Benchmark for Repository-Level Code Translation
por: Wang, Yanli, et al.
Publicado: (2024)
por: Wang, Yanli, et al.
Publicado: (2024)
RepoShapley: Shapley-Enhanced Context Filtering for Repository-Level Code Completion
por: Huo, Yu, et al.
Publicado: (2026)
por: Huo, Yu, et al.
Publicado: (2026)
RepoHyper: Search-Expand-Refine on Semantic Graphs for Repository-Level Code Completion
por: Phan, Huy N., et al.
Publicado: (2024)
por: Phan, Huy N., et al.
Publicado: (2024)
RepoST: Scalable Repository-Level Coding Environment Construction with Sandbox Testing
por: Xie, Yiqing, et al.
Publicado: (2025)
por: Xie, Yiqing, et al.
Publicado: (2025)
ComplexCodeEval: A Benchmark for Evaluating Large Code Models on More Complex Code
por: Feng, Jia, et al.
Publicado: (2024)
por: Feng, Jia, et al.
Publicado: (2024)
AEGIS: An Agent-based Framework for General Bug Reproduction from Issue Descriptions
por: Wang, Xinchen, et al.
Publicado: (2024)
por: Wang, Xinchen, et al.
Publicado: (2024)
M2rc-Eval: Massively Multilingual Repository-level Code Completion Evaluation
por: Liu, Jiaheng, et al.
Publicado: (2024)
por: Liu, Jiaheng, et al.
Publicado: (2024)
RepoGenReflex: Enhancing Repository-Level Code Completion with Verbal Reinforcement and Retrieval-Augmented Generation
por: Wang, Jicheng, et al.
Publicado: (2024)
por: Wang, Jicheng, et al.
Publicado: (2024)
Evaluating LLM-Based 0-to-1 Software Generation in End-to-End CLI Tool Scenarios
por: Hu, Ruida, et al.
Publicado: (2026)
por: Hu, Ruida, et al.
Publicado: (2026)
NL2Repo-Bench: Towards Long-Horizon Repository Generation Evaluation of Coding Agents
por: Ding, Jingzhe, et al.
Publicado: (2025)
por: Ding, Jingzhe, et al.
Publicado: (2025)
Hierarchical Context Pruning: Optimizing Real-World Code Completion with Repository-Level Pretrained Code LLMs
por: Zhang, Lei, et al.
Publicado: (2024)
por: Zhang, Lei, et al.
Publicado: (2024)
DevEval: A Manually-Annotated Code Generation Benchmark Aligned with Real-World Code Repositories
por: Li, Jia, et al.
Publicado: (2024)
por: Li, Jia, et al.
Publicado: (2024)
RepoAudit: An Autonomous LLM-Agent for Repository-Level Code Auditing
por: Guo, Jinyao, et al.
Publicado: (2025)
por: Guo, Jinyao, et al.
Publicado: (2025)
RepoMirage: Probing Repository Context Reasoning in Code Agents with Perturbations
por: Li, Hanyu, et al.
Publicado: (2026)
por: Li, Hanyu, et al.
Publicado: (2026)
RepoSummary: Feature-Oriented Summarization and Documentation Generation for Code Repositories
por: Zhu, Yifeng, et al.
Publicado: (2025)
por: Zhu, Yifeng, et al.
Publicado: (2025)
ParEval-Repo: A Benchmark Suite for Evaluating LLMs with Repository-level HPC Translation Tasks
por: Davis, Joshua H., et al.
Publicado: (2025)
por: Davis, Joshua H., et al.
Publicado: (2025)
CoReQA: Uncovering Potentials of Language Models in Code Repository Question Answering
por: Chen, Jialiang, et al.
Publicado: (2025)
por: Chen, Jialiang, et al.
Publicado: (2025)
Tool-integrated Reinforcement Learning for Repo Deep Search
por: Ma, Zexiong, et al.
Publicado: (2025)
por: Ma, Zexiong, et al.
Publicado: (2025)
Dependency-Guided Repository-Level C-to-Rust Translation with Reinforcement Alignment
por: Feng, Jia, et al.
Publicado: (2026)
por: Feng, Jia, et al.
Publicado: (2026)
RepoMaster: Autonomous Exploration and Understanding of GitHub Repositories for Complex Task Solving
por: Wang, Huacan, et al.
Publicado: (2025)
por: Wang, Huacan, et al.
Publicado: (2025)
RepoZero: Can LLMs Generate a Code Repository from Scratch?
por: Zhang, Zhaoxi, et al.
Publicado: (2026)
por: Zhang, Zhaoxi, et al.
Publicado: (2026)
RepoRepair: Leveraging Code Documentation for Repository-Level Automated Program Repair
por: Pan, Zhongqiang, et al.
Publicado: (2026)
por: Pan, Zhongqiang, et al.
Publicado: (2026)
RepoGraph: Enhancing AI Software Engineering with Repository-level Code Graph
por: Ouyang, Siru, et al.
Publicado: (2024)
por: Ouyang, Siru, et al.
Publicado: (2024)
RustRepoTrans: Repository-level Code Translation Benchmark Targeting Rust
por: Ou, Guangsheng, et al.
Publicado: (2024)
por: Ou, Guangsheng, et al.
Publicado: (2024)
ExecRepoBench: Multi-level Executable Code Completion Evaluation
por: Yang, Jian, et al.
Publicado: (2024)
por: Yang, Jian, et al.
Publicado: (2024)
A Deep Dive into Retrieval-Augmented Generation for Code Completion: Experience on WeChat
por: Yang, Zezhou, et al.
Publicado: (2025)
por: Yang, Zezhou, et al.
Publicado: (2025)
RealBench: A Repo-Level Code Generation Benchmark Aligned with Real-World Software Development Practices
por: Li, Jia, et al.
Publicado: (2026)
por: Li, Jia, et al.
Publicado: (2026)
RAG or Fine-tuning? A Comparative Study on LCMs-based Code Completion in Industry
por: Wang, Chaozheng, et al.
Publicado: (2025)
por: Wang, Chaozheng, et al.
Publicado: (2025)
Ejemplares similares
-
Repo2Run: Automated Building Executable Environment for Code Repository at Scale
por: Hu, Ruida, et al.
Publicado: (2025) -
CodeRepoQA: A Large-scale Benchmark for Software Engineering Question Answering
por: Hu, Ruida, et al.
Publicado: (2024) -
A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models
por: Hu, Ruida, et al.
Publicado: (2024) -
ReposVul: A Repository-Level High-Quality Vulnerability Dataset
por: Wang, Xinchen, et al.
Publicado: (2024) -
Evaluating Repository-level Software Documentation via Question Answering and Feature-Driven Development
por: Wang, Xinchen, et al.
Publicado: (2026)