When Elo Lies: Hidden Biases in Codeforces-Based Evaluation of Large Language Models

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Zheng, Shenyu, Dong, Ximing, Liu, Xiaoshuang, Oliva, Gustavo, Yong, Chong Chun, Lin, Dayi, Chen, Boyuan, Wang, Shaowei, Hassan, Ahmed E.
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi