SWE-MERA: A Dynamic Benchmark for Agenticly Evaluating Large Language Models on Software Engineering Tasks

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Adamenko, Pavel, Ivanov, Mikhail, Valeev, Aidar, Levichev, Rodion, Zadorozhny, Pavel, Lopatin, Ivan, Babayev, Dmitry, Fenogenova, Alena, Malykh, Valentin
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!