Tastet, J., & Timiryasov, I. (2024). BabyLlama-2: Ensemble-Distilled Models Consistently Outperform Teachers With Limited Data.
Chicago Style (17th ed.) CitationTastet, Jean-Loup, and Inar Timiryasov. BabyLlama-2: Ensemble-Distilled Models Consistently Outperform Teachers With Limited Data. 2024.
MLA (9th ed.) CitationTastet, Jean-Loup, and Inar Timiryasov. BabyLlama-2: Ensemble-Distilled Models Consistently Outperform Teachers With Limited Data. 2024.
Warning: These citations may not always be 100% accurate.