@misc{indiciae63e94e933e75, title = {Overtrained Language Models Are Harder to Fine-Tune}, author = {Jacob Mitchell Springer and Sachin Goyal and Kaiyue Wen and Tanishq Kumar and Xiang Yue and Sadhika Malladi and Graham Neubig and Aditi Raghunathan}, year = {2025}, url = {https://arxiv.org/abs/2503.19206}, note = {Source identifier: 2503.19206} }