ExpertLongBench: Benchmarking Language Models on Expert-Level Long-Form Generation Tasks with Structured Checklists

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Ruan, Jie, Nair, Inderjeet, Cao, Shuyang, Liu, Amy, Munir, Sheza, Pollens-Dempsey, Micah, Chiang, Tiffany, Kates, Lucy, David, Nicholas, Chen, Sihan, Yang, Ruxin, Yang, Yuqian, Gump, Jasmine, Bialek, Tessa, Sankaran, Vivek, Schlanger, Margo, Wang, Lu
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!