Top Pass: Improve Code Generation by Pass@k-Maximized Code Ranking
Fuente:
arXiv
Guardado en:
| Autores principales: | Lyu, Zhi-Cun, Li, Xin-Ye, Xie, Zheng, Li, Ming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Exploring Pass-Rate Reward in Reinforcement Learning for Code Generation
por: Li, Xin-Ye, et al.
Publicado: (2026)
por: Li, Xin-Ye, et al.
Publicado: (2026)
Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark
por: Zheng, Dewu, et al.
Publicado: (2024)
por: Zheng, Dewu, et al.
Publicado: (2024)
RedCode: Risky Code Execution and Generation Benchmark for Code Agents
por: Guo, Chengquan, et al.
Publicado: (2024)
por: Guo, Chengquan, et al.
Publicado: (2024)
ReCode: Improving LLM-based Code Repair with Fine-Grained Retrieval-Augmented Generation
por: Zhao, Yicong, et al.
Publicado: (2025)
por: Zhao, Yicong, et al.
Publicado: (2025)
CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
por: Jiang, Xue, et al.
Publicado: (2025)
por: Jiang, Xue, et al.
Publicado: (2025)
EvoCodeBench: An Evolving Code Generation Benchmark Aligned with Real-World Code Repositories
por: Li, Jia, et al.
Publicado: (2024)
por: Li, Jia, et al.
Publicado: (2024)
$\mathbb{USCD}$: Improving Code Generation of LLMs by Uncertainty-Aware Selective Contrastive Decoding
por: Wang, Shuai, et al.
Publicado: (2024)
por: Wang, Shuai, et al.
Publicado: (2024)
Post-Incorporating Code Structural Knowledge into Pretrained Models via ICL for Code Translation
por: Du, Yali, et al.
Publicado: (2025)
por: Du, Yali, et al.
Publicado: (2025)
SweRank+: Multilingual, Multi-Turn Code Ranking for Software Issue Localization
por: Reddy, Revanth Gangi, et al.
Publicado: (2025)
por: Reddy, Revanth Gangi, et al.
Publicado: (2025)
The Cream Rises to the Top: Efficient Reranking Method for Verilog Code Generation
por: Yang, Guang, et al.
Publicado: (2025)
por: Yang, Guang, et al.
Publicado: (2025)
AgentLens: Revealing The Lucky Pass Problem in SWE-Agent Evaluation
por: Sahoo, Priyam, et al.
Publicado: (2026)
por: Sahoo, Priyam, et al.
Publicado: (2026)
90% Faster, 100% Code-Free: MLLM-Driven Zero-Code 3D Game Development
por: Yang, Runxin, et al.
Publicado: (2025)
por: Yang, Runxin, et al.
Publicado: (2025)
Code Copycat Conundrum: Demystifying Repetition in LLM-based Code Generation
por: Liu, Mingwei, et al.
Publicado: (2025)
por: Liu, Mingwei, et al.
Publicado: (2025)
CATCODER: Repository-Level Code Generation with Relevant Code and Type Context
por: Pan, Zhiyuan, et al.
Publicado: (2024)
por: Pan, Zhiyuan, et al.
Publicado: (2024)
Uncovering LLM-Generated Code: A Zero-Shot Synthetic Code Detector via Code Rewriting
por: Ye, Tong, et al.
Publicado: (2024)
por: Ye, Tong, et al.
Publicado: (2024)
DSTC: Direct Preference Learning with Only Self-Generated Tests and Code to Improve Code LMs
por: Liu, Zhihan, et al.
Publicado: (2024)
por: Liu, Zhihan, et al.
Publicado: (2024)
DeepCode: Open Agentic Coding
por: Li, Zongwei, et al.
Publicado: (2025)
por: Li, Zongwei, et al.
Publicado: (2025)
VIBEPASS: Can Vibe Coders Really Pass the Vibe Check?
por: Bansal, Srijan, et al.
Publicado: (2026)
por: Bansal, Srijan, et al.
Publicado: (2026)
CodeShell Technical Report
por: Xie, Rui, et al.
Publicado: (2024)
por: Xie, Rui, et al.
Publicado: (2024)
Coding with Eyes: Visual Feedback Unlocks Reliable GUI Code Generating and Debugging
por: Liu, Zhilin, et al.
Publicado: (2026)
por: Liu, Zhilin, et al.
Publicado: (2026)
DesignBench: A Comprehensive Benchmark for MLLM-based Front-end Code Generation
por: Xiao, Jingyu, et al.
Publicado: (2025)
por: Xiao, Jingyu, et al.
Publicado: (2025)
What Makes Code Generation Ethically Sourced?
por: Xu, Zhuolin, et al.
Publicado: (2025)
por: Xu, Zhuolin, et al.
Publicado: (2025)
AI Code in the Wild: Measuring Security Risks and Ecosystem Shifts of AI-Generated Code in Modern Software
por: Wang, Bin, et al.
Publicado: (2025)
por: Wang, Bin, et al.
Publicado: (2025)
SweRank: Software Issue Localization with Code Ranking
por: Reddy, Revanth Gangi, et al.
Publicado: (2025)
por: Reddy, Revanth Gangi, et al.
Publicado: (2025)
Process-Supervised Reinforcement Learning for Code Generation
por: Ye, Yufan, et al.
Publicado: (2025)
por: Ye, Yufan, et al.
Publicado: (2025)
From Laboratory to Real-World Applications: Benchmarking Agentic Code Reasoning at the Repository Level
por: Li, Jia, et al.
Publicado: (2026)
por: Li, Jia, et al.
Publicado: (2026)
Automatically Generating UI Code from Screenshot: A Divide-and-Conquer-Based Approach
por: Wan, Yuxuan, et al.
Publicado: (2024)
por: Wan, Yuxuan, et al.
Publicado: (2024)
Copilot-in-the-Loop: Fixing Code Smells in Copilot-Generated Python Code using Copilot
por: Zhang, Beiqi, et al.
Publicado: (2024)
por: Zhang, Beiqi, et al.
Publicado: (2024)
WebCompass: Towards Multimodal Web Coding Evaluation for Code Language Models
por: Lei, Xinping, et al.
Publicado: (2026)
por: Lei, Xinping, et al.
Publicado: (2026)
CodeCrash: Exposing LLM Fragility to Misleading Natural Language in Code Reasoning
por: Lam, Man Ho, et al.
Publicado: (2025)
por: Lam, Man Ho, et al.
Publicado: (2025)
Unseen Horizons: Unveiling the Real Capability of LLM Code Generation Beyond the Familiar
por: Zhang, Yuanliang, et al.
Publicado: (2024)
por: Zhang, Yuanliang, et al.
Publicado: (2024)
CodeCircuit: Toward Inferring LLM-Generated Code Correctness via Attribution Graphs
por: He, Yicheng, et al.
Publicado: (2026)
por: He, Yicheng, et al.
Publicado: (2026)
LLMs as Continuous Learners: Improving the Reproduction of Defective Code in Software Issues
por: Lin, Yalan, et al.
Publicado: (2024)
por: Lin, Yalan, et al.
Publicado: (2024)
FastCode: Fast and Cost-Efficient Code Understanding and Reasoning
por: Li, Zhonghang, et al.
Publicado: (2026)
por: Li, Zhonghang, et al.
Publicado: (2026)
CodeCoT: Tackling Code Syntax Errors in CoT Reasoning for Code Generation
por: Huang, Dong, et al.
Publicado: (2023)
por: Huang, Dong, et al.
Publicado: (2023)
Generating High-Quality Datasets for Code Editing via Open-Source Language Models
por: Zhang, Zekai, et al.
Publicado: (2025)
por: Zhang, Zekai, et al.
Publicado: (2025)
An Empirical Study of Proactive Coding Assistants in Real-World Software Development
por: Li, Lehui, et al.
Publicado: (2026)
por: Li, Lehui, et al.
Publicado: (2026)
Do Code Semantics Help? A Comprehensive Study on Execution Trace-Based Information for Code Large Language Models
por: Wang, Jian, et al.
Publicado: (2025)
por: Wang, Jian, et al.
Publicado: (2025)
GeoCode-GPT: A Large Language Model for Geospatial Code Generation Tasks
por: Hou, Shuyang, et al.
Publicado: (2024)
por: Hou, Shuyang, et al.
Publicado: (2024)
Chain of Targeted Verification Questions to Improve the Reliability of Code Generated by LLMs
por: Ngassom, Sylvain Kouemo, et al.
Publicado: (2024)
por: Ngassom, Sylvain Kouemo, et al.
Publicado: (2024)
Ejemplares similares
-
Exploring Pass-Rate Reward in Reinforcement Learning for Code Generation
por: Li, Xin-Ye, et al.
Publicado: (2026) -
Top General Performance = Top Domain Performance? DomainCodeBench: A Multi-domain Code Generation Benchmark
por: Zheng, Dewu, et al.
Publicado: (2024) -
RedCode: Risky Code Execution and Generation Benchmark for Code Agents
por: Guo, Chengquan, et al.
Publicado: (2024) -
ReCode: Improving LLM-based Code Repair with Fine-Grained Retrieval-Augmented Generation
por: Zhao, Yicong, et al.
Publicado: (2025) -
CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
por: Jiang, Xue, et al.
Publicado: (2025)