TY - RPRT TI - Training neural networks faster with minimal tuning using pre-computed lists of hyperparameters for NAdamW AU - Sourabh Medapati AU - Priya Kasimbeg AU - Shankar Krishnan AU - Naman Agarwal AU - George Dahl PY - 2025 UR - https://arxiv.org/abs/2503.03986 ID - 2503.03986 ER -