FEM-Bench: A Structured Scientific Reasoning Benchmark for Evaluating Code-Generating LLMs

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Mohammadzadeh, Saeed, Hamdi, Erfan, Shor, Joel, Lejeune, Emma
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!