TY - RPRT TI - On Training Large Language Models for Long-Horizon Tasks: An Empirical Study of Horizon Length AU - Sunghwan Kim AU - Junhee Cho AU - Beong-woo Kwak AU - Taeyoon Kwon AU - Liang Wang AU - Nan Yang AU - Xingxing Zhang AU - Furu Wei AU - Jinyoung Yeo PY - 2026 UR - https://arxiv.org/abs/2605.02572 ID - 2605.02572 ER -