TY - RPRT TI - d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning AU - Siyan Zhao AU - Devaansh Gupta AU - Qinqing Zheng AU - Aditya Grover PY - 2025 UR - https://arxiv.org/abs/2504.12216 ID - 2504.12216 ER -