@misc{indiciaee18ba796c760, title = {BabyLlama-2: Ensemble-Distilled Models Consistently Outperform Teachers With Limited Data}, author = {Jean-Loup Tastet and Inar Timiryasov}, year = {2024}, url = {https://arxiv.org/abs/2409.17312}, note = {Source identifier: 2409.17312} }