TY - RPRT TI - VTPerception-R1: Enhancing Multimodal Reasoning via Explicit Visual and Textual Perceptual Grounding AU - Yizhuo Ding AU - Mingkang Chen AU - Zhibang Feng AU - Tong Xiao AU - Wanying Qu AU - Wenqi Shao AU - Yanwei Fu PY - 2025 UR - https://arxiv.org/abs/2509.24776 ID - 2509.24776 ER -