TY - RPRT TI - Track the Answer: Extending TextVQA from Image to Video with Spatio-Temporal Clues AU - Yan Zhang AU - Gangyan Zeng AU - Huawen Shen AU - Daiqing Wu AU - Yu Zhou AU - Can Ma PY - 2024 UR - https://arxiv.org/abs/2412.12502 ID - 2412.12502 ER -