TY - RPRT TI - Next-Token Prediction Task Assumes Optimal Data Ordering for LLM Training in Proof Generation AU - Chenyang An AU - Shima Imani AU - Feng Yao AU - Chengyu Dong AU - Ali Abbasi AU - Harsh Shrivastava AU - Samuel Buss AU - Jingbo Shang AU - Gayathri Mahalingam AU - Pramod Sharma AU - Maurice Diesendruck PY - 2025 UR - https://arxiv.org/abs/2411.00863 ID - 2411.00863 ER -