Aller au contenu
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Connexion
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Recherche avancée
  • NL2Repo-Bench: Towards Long-Horizon Repository Generation Evaluation of Coding Agents
Image de couverture de livre

NL2Repo-Bench: Towards Long-Horizon Repository Generation Evaluation of Coding Agents

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Ding, Jingzhe, Long, Shengda, Pu, Changxin, Zhou, Huan, Gao, Hongwan, Gao, Xiang, He, Chao, Hou, Yue, Hu, Fei, Li, Zhaojian, Shi, Weiran, Wang, Zaiyuan, Zan, Daoguang, Zhang, Chenchen, Zhang, Xiaoxu, Chen, Qizhi, Cheng, Xianfu, Deng, Bo, Gu, Qingshui, Hua, Kai, Lin, Juntao, Liu, Pai, Li, Mingchen, Pan, Xuanguang, Peng, Zifan, Qin, Yujia, Shan, Yong, Tan, Zhewen, Xie, Weihao, Wang, Zihan, Yuan, Yishuo, Zhang, Jiayu, Zhao, Enduo, Zhao, Yunfei, Zhu, He, Zhu, Liya, Zou, Chenyang, Ding, Ming, Jiao, Jianpeng, Liu, Jiaheng, Liu, Minghao, Liu, Qian, Tao, Chongyang, Yang, Jian, Yang, Tong, Zhang, Zhaoxiang, Chen, Xinjie, Huang, Wenhao, Zhang, Ge
Format: Preprint
Publié: 2025
Sujets:
Computation and Language
Accès en ligne:
Acceder al recurso
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
  • Citer
  • Envoyer par SMS
  • Envoyer par courriel
  • Imprimer
  • Exporter les notices
    • Exporter vers RefWorks
    • Exporter vers EndNoteWeb
    • Exporter vers EndNote
  • Ajouter aux favoris
  • Permalien
  • Exemplaires
  • Description
  • Commentaires
  • Documents similaires
  • Affichage MARC

Internet

https://arxiv.org/abs/2512.12730

Documents similaires

  • FrontendBench: A Benchmark for Evaluating LLMs on Front-End Development via Automatic Evaluation
    par: Zhu, Hongda, et autres
    Publié: (2025)
  • Function Fitting Based on Kolmogorov-Arnold Theorem and Kernel Functions
    par: Liu, Jianpeng, et autres
    Publié: (2025)
  • SafeGenBench: A Benchmark Framework for Security Vulnerability Detection in LLM-Generated Code
    par: Li, Xinghang, et autres
    Publié: (2025)
  • DiscoX: Benchmarking Discourse-Level Translation task in Expert Domains
    par: Zhao, Xiying, et autres
    Publié: (2025)
  • LPFQA: A Long-Tail Professional Forum-based Benchmark for LLM Evaluation
    par: Zhu, Liya, et autres
    Publié: (2025)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 33,245© 2026 Universidad del Mar