ExpertLongBench: Benchmarking Language Models on Expert-Level Long-Form Generation Tasks with Structured Checklists

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Ruan, Jie, Nair, Inderjeet, Cao, Shuyang, Liu, Amy, Munir, Sheza, Pollens-Dempsey, Micah, Chiang, Tiffany, Kates, Lucy, David, Nicholas, Chen, Sihan, Yang, Ruxin, Yang, Yuqian, Gump, Jasmine, Bialek, Tessa, Sankaran, Vivek, Schlanger, Margo, Wang, Lu
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!

Ähnliche Einträge