@misc{indiciae390574610f40, title = {Inference Compute-Optimal Video Vision Language Models}, author = {Peiqi Wang and ShengYun Peng and Xuewen Zhang and Hanchao Yu and Yibo Yang and Lifu Huang and Fujun Liu and Qifan Wang}, year = {2025}, url = {https://arxiv.org/abs/2505.18855}, note = {Source identifier: 2505.18855} }