TY - RPRT TI - Backward-Friendly Optimization: Training Large Language Models with Approximate Gradients under Memory Constraints AU - Jing Yang AU - Kaitong Cai AU - Yijia Fan AU - Yufeng Yang AU - Keze Wang PY - 2025 UR - https://arxiv.org/abs/2510.22467 ID - 2510.22467 ER -