TY - RPRT TI - ST-VLM: Kinematic Instruction Tuning for Spatio-Temporal Reasoning in Vision-Language Models AU - Dohwan Ko AU - Sihyeon Kim AU - Yumin Suh AU - Vijay Kumar B. G AU - Minseo Yoon AU - Manmohan Chandraker AU - Hyunwoo J. Kim PY - 2025 UR - https://arxiv.org/abs/2503.19355 ID - 2503.19355 ER -