TY - RPRT TI - Train Flat, Then Compress: Sharpness-Aware Minimization Learns More Compressible Models AU - Clara Na AU - Sanket Vaibhav Mehta AU - Emma Strubell PY - 2022 DO - 10.18653/v1/2022.findings-emnlp.361 UR - https://arxiv.org/abs/2205.12694 ID - 2205.12694 ER -