TY - RPRT TI - MOSS-ChatV: Reinforcement Learning with Process Reasoning Reward for Video Temporal Reasoning AU - Sicheng Tao AU - Jungang Li AU - Yibo Yan AU - Junyan Zhang AU - Yubo Gao AU - Hanqian Li AU - ShuHang Xun AU - Yuxuan Fan AU - Hong Chen AU - Jianxiang He AU - Xuming Hu PY - 2025 UR - https://arxiv.org/abs/2509.21113 ID - 2509.21113 ER -