@misc{indiciae638cd47fbf75, title = {Staggered Batch Scheduling: Co-optimizing Time-to-First-Token and Throughput for High-Efficiency LLM Inference}, author = {Jian Tian and Shuailong Li and Yang Cao and Wenbo Cui and Minghan Zhu and Wenkang Wu and Jianming Zhang and Yanpeng Wang and Zhiwen Xiao and Zhenyu Hou and Dou Shen}, year = {2025}, url = {https://arxiv.org/abs/2512.16134}, note = {Source identifier: 2512.16134} }