@misc{indiciae80fcfe46ad4e, title = {Beyond Few-Step Inference: Accelerating Video Diffusion Transformer Model Serving with Inter-Request Caching Reuse}, author = {Hao Liu and Ye Huang and Chenghuan Huang and Zhenyi Zheng and Jiangsu Du and Ziyang Ma and Jing Lyu and Yutong Lu}, year = {2026}, url = {https://arxiv.org/abs/2604.04451}, note = {Source identifier: 2604.04451} }