When Elo Lies: Hidden Biases in Codeforces-Based Evaluation of Large Language Models

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Zheng, Shenyu, Dong, Ximing, Liu, Xiaoshuang, Oliva, Gustavo, Yong, Chong Chun, Lin, Dayi, Chen, Boyuan, Wang, Shaowei, Hassan, Ahmed E.
Format: Preprint
Published: 2026
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!