Bansal, H., Hosseini, A., Agarwal, R., Tran, V. Q., & Kazemi, M. (2024). Smaller, Weaker, Yet Better: Training LLM Reasoners via Compute-Optimal Sampling.
Chicago Style (17th ed.) CitationBansal, Hritik, Arian Hosseini, Rishabh Agarwal, Vinh Q. Tran, and Mehran Kazemi. Smaller, Weaker, Yet Better: Training LLM Reasoners via Compute-Optimal Sampling. 2024.
MLA (9th ed.) CitationBansal, Hritik, et al. Smaller, Weaker, Yet Better: Training LLM Reasoners via Compute-Optimal Sampling. 2024.
Warning: These citations may not always be 100% accurate.