TY - RPRT TI - ViSRA: A Video-based Spatial Reasoning Agent for Multi-modal Large Language Models AU - Tingshu Mou AU - Jiabo He AU - Renying Wang AU - Ce Liu AU - Hao Yang AU - Tiehua Zhang AU - Jingjing Chen AU - Xingjun Ma PY - 2026 UR - https://arxiv.org/abs/2605.10106 ID - 2605.10106 ER -