TY - RPRT TI - TD-Grokking: Learning from Zero-Reward Problems by Training-Time Decomposition AU - Ningyuan Xi AU - Hao Xu AU - Hongsheng Xin AU - Ning Miao PY - 2026 UR - https://arxiv.org/abs/2606.09883 ID - 2606.09883 ER -