Skip to content
Descubridor Institucional UMAR
Inicio
Búsqueda avanzada
Explorar
Inicio
Búsqueda avanzada
Explorar
Login
Language
English
Deutsch
Español
Français
Italiano
All Fields
Title
Author
Subject
Call Number
ISBN/ISSN
Tag
Find
Advanced
EvaluateBM: a multi-agent framework for evaluating reasoning-capable language models in biomedical tasks
EvaluateBM: a multi-agent framework for evaluating reasoning-capable language models in biomedical tasks
Fuente:
Zenodo
Saved in:
Bibliographic Details
Main Author:
LIN, XINYI
Format:
Recurso digital
Published:
Zenodo
2026
Online Access:
Acceder al recurso
Tags:
Add Tag
No Tags, Be the first to tag this record!
Cite this
Text this
Email this
Print
Export Record
Export to RefWorks
Export to EndNoteWeb
Export to EndNote
Save to List
Permanent link
Holdings
Description
Comments
Similar Items
Staff View
Internet
https://doi.org/10.5281/zenodo.18857202
Similar Items
A systematic evaluation of vision-language models for observational astronomical reasoning tasks
by: Ren, Wenke, et al.
Published: (2026)
Performance of AI agents based on reasoning language models on ALD process optimization tasks
by: Yanguas-Gil, Angel
Published: (2026)
Deliberative multi-agent large language models improve clinical reasoning in ophthalmology
by: Misaghi, Ehsan, et al.
Published: (2026)
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
by: Syromiatnikov, Mykyta, et al.
Published: (2025)
Auxiliary task demands mask the capabilities of smaller language models
by: Hu, Jennifer, et al.
Published: (2024)