CoreCodeBench: Decoupling Code Intelligence via Fine-Grained Repository-Level Tasks
Fuente:
arXiv
Salvato in:
| Autori principali: | Fu, Lingyue, Guan, Hao, Zhang, Bolun, Yuan, Haowei, Zhu, Yaoming, Xu, Jun, Wang, Zongyu, Qiu, Lin, Cai, Xunliang, Cao, Xuezhi, Liu, Weiwen, Zhang, Weinan, Yu, Yong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Automatically Benchmarking LLM Code Agents through Agent-Driven Annotation and Evaluation
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
SWE-Cycle: Benchmarking Code Agents across the Complete Issue Resolution Cycle
di: Guan, Hao, et al.
Pubblicazione: (2026)
di: Guan, Hao, et al.
Pubblicazione: (2026)
CATArena: Evaluating Evolutionary Capabilities of Code Agents via Iterative Tournaments
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
ML-Bench: Evaluating Large Language Models and Agents for Machine Learning Tasks on Repository-Level Code
di: Tang, Xiangru, et al.
Pubblicazione: (2023)
di: Tang, Xiangru, et al.
Pubblicazione: (2023)
DebugTA: An LLM-Based Agent for Simplifying Debugging and Teaching in Programming Education
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
AdverMCTS: Combating Pseudo-Correctness in Code Generation via Adversarial Monte Carlo Tree Search
di: Li, Qingyao, et al.
Pubblicazione: (2026)
di: Li, Qingyao, et al.
Pubblicazione: (2026)
AACR-Bench: Evaluating Automatic Code Review with Holistic Repository-Level Context
di: Zhang, Lei, et al.
Pubblicazione: (2026)
di: Zhang, Lei, et al.
Pubblicazione: (2026)
Automated Benchmark Generation for Repository-Level Coding Tasks
di: Vergopoulos, Konstantinos, et al.
Pubblicazione: (2025)
di: Vergopoulos, Konstantinos, et al.
Pubblicazione: (2025)
GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging
di: Ni, Ziyi, et al.
Pubblicazione: (2025)
di: Ni, Ziyi, et al.
Pubblicazione: (2025)
EvoCodeBench: An Evolving Code Generation Benchmark Aligned with Real-World Code Repositories
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
FEA-Bench: A Benchmark for Evaluating Repository-Level Code Generation for Feature Implementation
di: Li, Wei, et al.
Pubblicazione: (2025)
di: Li, Wei, et al.
Pubblicazione: (2025)
MHRC-Bench: A Multilingual Hardware Repository-Level Code Completion benchmark
di: Zou, Qingyun, et al.
Pubblicazione: (2026)
di: Zou, Qingyun, et al.
Pubblicazione: (2026)
MigrationBench: Repository-Level Code Migration Benchmark from Java 8
di: Liu, Linbo, et al.
Pubblicazione: (2025)
di: Liu, Linbo, et al.
Pubblicazione: (2025)
MRG-Bench: Evaluating and Exploring the Requirements of Context for Repository-Level Code Generation
di: Li, Haiyang
Pubblicazione: (2025)
di: Li, Haiyang
Pubblicazione: (2025)
RepoTransBench: A Real-World Multilingual Benchmark for Repository-Level Code Translation
di: Wang, Yanli, et al.
Pubblicazione: (2024)
di: Wang, Yanli, et al.
Pubblicazione: (2024)
AInsteinBench: Benchmarking Coding Agents on Scientific Repositories
di: Duston, Titouan, et al.
Pubblicazione: (2025)
di: Duston, Titouan, et al.
Pubblicazione: (2025)
Skeleton-Guided-Translation: A Benchmarking Framework for Code Repository Translation with Fine-Grained Quality Evaluation
di: Zhang, Xing, et al.
Pubblicazione: (2025)
di: Zhang, Xing, et al.
Pubblicazione: (2025)
Teaching Code LLMs to Use Autocompletion Tools in Repository-Level Code Generation
di: Wang, Chong, et al.
Pubblicazione: (2024)
di: Wang, Chong, et al.
Pubblicazione: (2024)
Repoformer: Selective Retrieval for Repository-Level Code Completion
di: Wu, Di, et al.
Pubblicazione: (2024)
di: Wu, Di, et al.
Pubblicazione: (2024)
RLCoder: Reinforcement Learning for Repository-Level Code Completion
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
di: Wang, Yanlin, et al.
Pubblicazione: (2024)
CodeMEM: AST-Guided Adaptive Memory for Repository-Level Iterative Code Generation
di: Wang, Peiding, et al.
Pubblicazione: (2026)
di: Wang, Peiding, et al.
Pubblicazione: (2026)
Persistent Cross-Attempt State Optimization for Repository-Level Code Generation
di: Pan, Ruwei, et al.
Pubblicazione: (2026)
di: Pan, Ruwei, et al.
Pubblicazione: (2026)
Toward Executable Repository-Level Code Generation via Environment Alignment
di: Pan, Ruwei, et al.
Pubblicazione: (2026)
di: Pan, Ruwei, et al.
Pubblicazione: (2026)
Fints: Efficient Inference-Time Personalization for LLMs with Fine-Grained Instance-Tailored Steering
di: Du, Kounianhua, et al.
Pubblicazione: (2025)
di: Du, Kounianhua, et al.
Pubblicazione: (2025)
CodeRAG: Finding Relevant and Necessary Knowledge for Retrieval-Augmented Repository-Level Code Completion
di: Zhang, Sheng, et al.
Pubblicazione: (2025)
di: Zhang, Sheng, et al.
Pubblicazione: (2025)
On the Impacts of Contexts on Repository-Level Code Generation
di: Hai, Nam Le, et al.
Pubblicazione: (2024)
di: Hai, Nam Le, et al.
Pubblicazione: (2024)
CATCODER: Repository-Level Code Generation with Relevant Code and Type Context
di: Pan, Zhiyuan, et al.
Pubblicazione: (2024)
di: Pan, Zhiyuan, et al.
Pubblicazione: (2024)
Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement
di: Ding, Peng, et al.
Pubblicazione: (2025)
di: Ding, Peng, et al.
Pubblicazione: (2025)
Relative Positioning Based Code Chunking Method For Rich Context Retrieval In Repository Level Code Completion Task With Code Language Model
di: Rahman, Imranur, et al.
Pubblicazione: (2025)
di: Rahman, Imranur, et al.
Pubblicazione: (2025)
REPOFUSE: Repository-Level Code Completion with Fused Dual Context
di: Liang, Ming, et al.
Pubblicazione: (2024)
di: Liang, Ming, et al.
Pubblicazione: (2024)
RepoAudit: An Autonomous LLM-Agent for Repository-Level Code Auditing
di: Guo, Jinyao, et al.
Pubblicazione: (2025)
di: Guo, Jinyao, et al.
Pubblicazione: (2025)
SecRepoBench: Benchmarking Code Agents for Secure Code Completion in Real-World Repositories
di: Shen, Chihao, et al.
Pubblicazione: (2025)
di: Shen, Chihao, et al.
Pubblicazione: (2025)
Code Graph Model (CGM): A Graph-Integrated Large Language Model for Repository-Level Software Engineering Tasks
di: Tao, Hongyuan, et al.
Pubblicazione: (2025)
di: Tao, Hongyuan, et al.
Pubblicazione: (2025)
Knowledge Graph Based Repository-Level Code Generation
di: Athale, Mihir, et al.
Pubblicazione: (2025)
di: Athale, Mihir, et al.
Pubblicazione: (2025)
NL-Debugging: Exploiting Natural Language as an Intermediate Representation for Code Debugging
di: Zhang, Weiming, et al.
Pubblicazione: (2025)
di: Zhang, Weiming, et al.
Pubblicazione: (2025)
A Benchmark for Evaluating Repository-Level Code Agents with Intermediate Reasoning on Feature Addition Task
di: Liu, Shuhan, et al.
Pubblicazione: (2026)
di: Liu, Shuhan, et al.
Pubblicazione: (2026)
Co-Evolution of Types and Dependencies: Towards Repository-Level Type Inference for Python Code
di: Sun, Shuo, et al.
Pubblicazione: (2025)
di: Sun, Shuo, et al.
Pubblicazione: (2025)
NL2Repo-Bench: Towards Long-Horizon Repository Generation Evaluation of Coding Agents
di: Ding, Jingzhe, et al.
Pubblicazione: (2025)
di: Ding, Jingzhe, et al.
Pubblicazione: (2025)
Hierarchical Context Pruning: Optimizing Real-World Code Completion with Repository-Level Pretrained Code LLMs
di: Zhang, Lei, et al.
Pubblicazione: (2024)
di: Zhang, Lei, et al.
Pubblicazione: (2024)
RepoReviewer: A Local-First Multi-Agent Architecture for Repository-Level Code Review
di: Zhang, Peng
Pubblicazione: (2026)
di: Zhang, Peng
Pubblicazione: (2026)
Documenti analoghi
-
Automatically Benchmarking LLM Code Agents through Agent-Driven Annotation and Evaluation
di: Fu, Lingyue, et al.
Pubblicazione: (2025) -
SWE-Cycle: Benchmarking Code Agents across the Complete Issue Resolution Cycle
di: Guan, Hao, et al.
Pubblicazione: (2026) -
CATArena: Evaluating Evolutionary Capabilities of Code Agents via Iterative Tournaments
di: Fu, Lingyue, et al.
Pubblicazione: (2025) -
ML-Bench: Evaluating Large Language Models and Agents for Machine Learning Tasks on Repository-Level Code
di: Tang, Xiangru, et al.
Pubblicazione: (2023) -
DebugTA: An LLM-Based Agent for Simplifying Debugging and Teaching in Programming Education
di: Fu, Lingyue, et al.
Pubblicazione: (2025)