TY - RPRT TI - Scaling Instruction-Tuned LLMs to Million-Token Contexts via Hierarchical Synthetic Data Generation AU - Linda He AU - Jue Wang AU - Maurice Weber AU - Shang Zhu AU - Ben Athiwaratkun AU - Ce Zhang PY - 2025 UR - https://arxiv.org/abs/2504.12637 ID - 2504.12637 ER -