TY - RPRT TI - R2Vul: Learning to Reason about Software Vulnerabilities with Reinforcement Learning and Structured Reasoning Distillation AU - Martin Weyssow AU - Chengran Yang AU - Junkai Chen AU - Ratnadira Widyasari AU - Ting Zhang AU - Huihui Huang AU - Huu Hung Nguyen AU - Yan Naing Tun AU - Tan Bui AU - Yikun Li AU - Ang Han Wei AU - Frank Liauw AU - Eng Lieh Ouh AU - Lwin Khin Shar AU - David Lo PY - 2025 UR - https://arxiv.org/abs/2504.04699 ID - 2504.04699 ER -