Rao, B., Harrison, J., Kong, S., Lee, J., & Lipizzi, C. (2026). s2n-bignum-bench: A practical benchmark for evaluating low-level code reasoning of LLMs.
Chicago Style (17th ed.) CitationRao, Balaji, John Harrison, Soonho Kong, Juneyoung Lee, and Carlo Lipizzi. S2n-bignum-bench: A Practical Benchmark for Evaluating Low-level Code Reasoning of LLMs. 2026.
MLA (9th ed.) CitationRao, Balaji, et al. S2n-bignum-bench: A Practical Benchmark for Evaluating Low-level Code Reasoning of LLMs. 2026.
Warning: These citations may not always be 100% accurate.