TY - RPRT TI - A Continuous-Time Reinforcement Learning Framework for Fine-Tuning Discrete Diffusion Models AU - Zikun Zhang AU - Jiayuan Sheng AU - David D. Yao AU - Wenpin Tang PY - 2026 UR - https://arxiv.org/abs/2607.14522 ID - 2607.14522 ER -