@misc{indiciae1d5bfbb20050, title = {Training Diagonal Linear Networks with Stochastic Sharpness-Aware Minimization}, author = {Gabriel Clara and Sophie Langer and Johannes Schmidt-Hieber}, year = {2026}, url = {https://arxiv.org/abs/2503.11891}, note = {Source identifier: 2503.11891} }