@misc{indiciae1ca27e6a5df4, title = {How Do Transformers Learn to Associate Tokens: Gradient Leading Terms Bring Mechanistic Interpretability}, author = {Shawn Im and Changdae Oh and Zhen Fang and Sharon Li}, year = {2026}, url = {https://arxiv.org/abs/2601.19208}, note = {Source identifier: 2601.19208} }