ExpertLongBench: Benchmarking Language Models on Expert-Level Long-Form Generation Tasks with Structured Checklists

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Ruan, Jie, Nair, Inderjeet, Cao, Shuyang, Liu, Amy, Munir, Sheza, Pollens-Dempsey, Micah, Chiang, Tiffany, Kates, Lucy, David, Nicholas, Chen, Sihan, Yang, Ruxin, Yang, Yuqian, Gump, Jasmine, Bialek, Tessa, Sankaran, Vivek, Schlanger, Margo, Wang, Lu
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!