TY - RPRT TI - KidVis: Do Multimodal Large Language Models Possess the Visual Perceptual Capabilities of a 6-Year-Old? AU - Xianfeng Wang AU - Kaiwei Zhang AU - Qi Jia AU - Zijian Chen AU - Guangtao Zhai AU - Xiongkuo Min PY - 2026 UR - https://arxiv.org/abs/2601.08292 ID - 2601.08292 ER -