TY - RPRT TI - Large Language Models Can Self-Improve in Long-context Reasoning AU - Siheng Li AU - Cheng Yang AU - Zesen Cheng AU - Lemao Liu AU - Mo Yu AU - Yujiu Yang AU - Wai Lam PY - 2024 UR - https://arxiv.org/abs/2411.08147 ID - 2411.08147 ER -