@misc{indiciaebf681fafca2c, title = {Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data}, author = {Xinyi Wang and Antonis Antoniades and Yanai Elazar and Alfonso Amayuelas and Alon Albalak and Kexun Zhang and William Yang Wang}, year = {2025}, url = {https://arxiv.org/abs/2407.14985}, note = {Source identifier: 2407.14985} }