@misc{indiciae5a01c2e58af8, title = {Next-Token Prediction Task Assumes Optimal Data Ordering for LLM Training in Proof Generation}, author = {Chenyang An and Shima Imani and Feng Yao and Chengyu Dong and Ali Abbasi and Harsh Shrivastava and Samuel Buss and Jingbo Shang and Gayathri Mahalingam and Pramod Sharma and Maurice Diesendruck}, year = {2025}, url = {https://arxiv.org/abs/2411.00863}, note = {Source identifier: 2411.00863} }