Smaller, Weaker, Yet Better: Training LLM Reasoners via Compute-Optimal Sampling

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Bansal, Hritik, Hosseini, Arian, Agarwal, Rishabh, Tran, Vinh Q., Kazemi, Mehran
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!