TY - RPRT TI - Reliable Reasoning in SVG-LLMs via Multi-Task Multi-Reward Reinforcement Learning AU - Haomin Wang AU - Qi Wei AU - Qianli Ma AU - Shengyuan Ding AU - Jinhui Yin AU - Kai Chen AU - Hongjie Zhang PY - 2026 UR - https://arxiv.org/abs/2603.16189 ID - 2603.16189 ER -