COFFE: A Code Efficiency Benchmark for Code Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Peng, Yun, Wan, Jun, Li, Yichen, Ren, Xiaoxue |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PEACE: Towards Efficient Project-Level Efficiency Optimization via Hybrid Code Editing
di: Ren, Xiaoxue, et al.
Pubblicazione: (2025)
di: Ren, Xiaoxue, et al.
Pubblicazione: (2025)
CoRE: A Fine-Grained Code Reasoning Benchmark Beyond Output Prediction
di: Gao, Jun, et al.
Pubblicazione: (2026)
di: Gao, Jun, et al.
Pubblicazione: (2026)
CodeReasoner: Enhancing the Code Reasoning Ability with Reinforcement Learning
di: Tang, Lingxiao, et al.
Pubblicazione: (2025)
di: Tang, Lingxiao, et al.
Pubblicazione: (2025)
An Iterative Test-and-Repair Framework for Competitive Code Generation
di: Tang, Lingxiao, et al.
Pubblicazione: (2026)
di: Tang, Lingxiao, et al.
Pubblicazione: (2026)
A^3-CodGen: A Repository-Level Code Generation Framework for Code Reuse with Local-Aware, Global-Aware, and Third-Party-Library-Aware
di: Liao, Dianshu, et al.
Pubblicazione: (2023)
di: Liao, Dianshu, et al.
Pubblicazione: (2023)
Fixing Function-Level Code Generation Errors for Foundation Large Language Models
di: Wen, Hao, et al.
Pubblicazione: (2024)
di: Wen, Hao, et al.
Pubblicazione: (2024)
EffiBench: Benchmarking the Efficiency of Automatically Generated Code
di: Huang, Dong, et al.
Pubblicazione: (2024)
di: Huang, Dong, et al.
Pubblicazione: (2024)
R2Code: A Self-Reflective LLM Framework for Requirements-to-Code Traceability
di: Wang, Yifei, et al.
Pubblicazione: (2026)
di: Wang, Yifei, et al.
Pubblicazione: (2026)
On Evaluating the Efficiency of Source Code Generated by LLMs
di: Niu, Changan, et al.
Pubblicazione: (2024)
di: Niu, Changan, et al.
Pubblicazione: (2024)
Mercury: A Code Efficiency Benchmark for Code Large Language Models
di: Du, Mingzhe, et al.
Pubblicazione: (2024)
di: Du, Mingzhe, et al.
Pubblicazione: (2024)
AdaCoder: An Adaptive Planning and Multi-Agent Framework for Function-Level Code Generation
di: Zhu, Yueheng, et al.
Pubblicazione: (2025)
di: Zhu, Yueheng, et al.
Pubblicazione: (2025)
Enhancing LLM-Based Coding Tools through Native Integration of IDE-Derived Static Context
di: Li, Yichen, et al.
Pubblicazione: (2024)
di: Li, Yichen, et al.
Pubblicazione: (2024)
Beyond Code Similarity: Benchmarking the Plausibility, Efficiency, and Complexity of LLM-Generated Smart Contracts
di: Salzano, Francesco, et al.
Pubblicazione: (2025)
di: Salzano, Francesco, et al.
Pubblicazione: (2025)
TypeScript Repository Indexing for Code Agent Retrieval
di: Pu, Junsong, et al.
Pubblicazione: (2026)
di: Pu, Junsong, et al.
Pubblicazione: (2026)
iCodeReviewer: Improving Secure Code Review with Mixture of Prompts
di: Peng, Yun, et al.
Pubblicazione: (2025)
di: Peng, Yun, et al.
Pubblicazione: (2025)
Code Less, Align More: Efficient LLM Fine-tuning for Code Generation with Data Pruning
di: Tsai, Yun-Da, et al.
Pubblicazione: (2024)
di: Tsai, Yun-Da, et al.
Pubblicazione: (2024)
RedCode: Risky Code Execution and Generation Benchmark for Code Agents
di: Guo, Chengquan, et al.
Pubblicazione: (2024)
di: Guo, Chengquan, et al.
Pubblicazione: (2024)
CodeDPO: Aligning Code Models with Self Generated and Verified Source Code
di: Zhang, Kechi, et al.
Pubblicazione: (2024)
di: Zhang, Kechi, et al.
Pubblicazione: (2024)
Cascaded Code Editing: Large-Small Model Collaboration for Effective and Efficient Code Editing
di: Wang, Chaozheng, et al.
Pubblicazione: (2026)
di: Wang, Chaozheng, et al.
Pubblicazione: (2026)
CodeScore: Evaluating Code Generation by Learning Code Execution
di: Dong, Yihong, et al.
Pubblicazione: (2023)
di: Dong, Yihong, et al.
Pubblicazione: (2023)
A Closer Look into Transformer-Based Code Intelligence Through Code Transformation: Challenges and Opportunities
di: Li, Yaoxian, et al.
Pubblicazione: (2022)
di: Li, Yaoxian, et al.
Pubblicazione: (2022)
Benchmarking and Revisiting Code Generation Assessment: A Mutation-Based Approach
di: Wang, Longtian, et al.
Pubblicazione: (2025)
di: Wang, Longtian, et al.
Pubblicazione: (2025)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
ComplexCodeEval: A Benchmark for Evaluating Large Code Models on More Complex Code
di: Feng, Jia, et al.
Pubblicazione: (2024)
di: Feng, Jia, et al.
Pubblicazione: (2024)
ExecVerify: White-Box RL with Verifiable Stepwise Rewards for Code Execution Reasoning
di: Tang, Lingxiao, et al.
Pubblicazione: (2026)
di: Tang, Lingxiao, et al.
Pubblicazione: (2026)
COCA: Generative Root Cause Analysis for Distributed Systems with Code Knowledge
di: Li, Yichen, et al.
Pubblicazione: (2025)
di: Li, Yichen, et al.
Pubblicazione: (2025)
Evaluating Efficiency and Novelty of LLM-Generated Code for Graph Analysis
di: Nia, Atieh Barati, et al.
Pubblicazione: (2025)
di: Nia, Atieh Barati, et al.
Pubblicazione: (2025)
Evaluating LLM-Generated Code: A Benchmark and Developer Study
di: Szych, Joanna, et al.
Pubblicazione: (2026)
di: Szych, Joanna, et al.
Pubblicazione: (2026)
A Controlled Experiment on the Energy Efficiency of the Source Code Generated by Code Llama
di: Cursaru, Vlad-Andrei, et al.
Pubblicazione: (2024)
di: Cursaru, Vlad-Andrei, et al.
Pubblicazione: (2024)
Teaching Code LLMs to Use Autocompletion Tools in Repository-Level Code Generation
di: Wang, Chong, et al.
Pubblicazione: (2024)
di: Wang, Chong, et al.
Pubblicazione: (2024)
Exploring Multi-Lingual Bias of Large Code Models in Code Generation
di: Wang, Chaozheng, et al.
Pubblicazione: (2024)
di: Wang, Chaozheng, et al.
Pubblicazione: (2024)
CoderEval: A Benchmark of Pragmatic Code Generation with Generative Pre-trained Models
di: Yu, Hao, et al.
Pubblicazione: (2023)
di: Yu, Hao, et al.
Pubblicazione: (2023)
CodeMMLU: A Multi-Task Benchmark for Assessing Code Understanding & Reasoning Capabilities of CodeLLMs
di: Manh, Dung Nguyen, et al.
Pubblicazione: (2024)
di: Manh, Dung Nguyen, et al.
Pubblicazione: (2024)
Context-aware Code Summary Generation
di: Su, Chia-Yi, et al.
Pubblicazione: (2024)
di: Su, Chia-Yi, et al.
Pubblicazione: (2024)
CodeFlowBench: A Multi-turn, Iterative Benchmark for Complex Code Generation
di: Wang, Sizhe, et al.
Pubblicazione: (2025)
di: Wang, Sizhe, et al.
Pubblicazione: (2025)
CodeIF: Benchmarking the Instruction-Following Capabilities of Large Language Models for Code Generation
di: Yan, Kaiwen, et al.
Pubblicazione: (2025)
di: Yan, Kaiwen, et al.
Pubblicazione: (2025)
AI-Powered, But Power-Hungry? Energy Efficiency of LLM-Generated Code
di: Solovyeva, Lola, et al.
Pubblicazione: (2025)
di: Solovyeva, Lola, et al.
Pubblicazione: (2025)
Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks
di: Zhao, Songwen, et al.
Pubblicazione: (2025)
di: Zhao, Songwen, et al.
Pubblicazione: (2025)
SolEval: Benchmarking Large Language Models for Repository-level Solidity Code Generation
di: Peng, Zhiyuan, et al.
Pubblicazione: (2025)
di: Peng, Zhiyuan, et al.
Pubblicazione: (2025)
DSCodeBench: A Realistic Benchmark for Data Science Code Generation
di: Ouyang, Shuyin, et al.
Pubblicazione: (2025)
di: Ouyang, Shuyin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PEACE: Towards Efficient Project-Level Efficiency Optimization via Hybrid Code Editing
di: Ren, Xiaoxue, et al.
Pubblicazione: (2025) -
CoRE: A Fine-Grained Code Reasoning Benchmark Beyond Output Prediction
di: Gao, Jun, et al.
Pubblicazione: (2026) -
CodeReasoner: Enhancing the Code Reasoning Ability with Reinforcement Learning
di: Tang, Lingxiao, et al.
Pubblicazione: (2025) -
An Iterative Test-and-Repair Framework for Competitive Code Generation
di: Tang, Lingxiao, et al.
Pubblicazione: (2026) -
A^3-CodGen: A Repository-Level Code Generation Framework for Code Reuse with Local-Aware, Global-Aware, and Third-Party-Library-Aware
di: Liao, Dianshu, et al.
Pubblicazione: (2023)