TY - RPRT TI - VLM4D: Towards Spatiotemporal Awareness in Vision Language Models AU - Shijie Zhou AU - Alexander Vilesov AU - Xuehai He AU - Ziyu Wan AU - Shuwang Zhang AU - Aditya Nagachandra AU - Di Chang AU - Dongdong Chen AU - Xin Eric Wang AU - Achuta Kadambi PY - 2025 UR - https://arxiv.org/abs/2508.02095 ID - 2508.02095 ER -