TY - RPRT TI - ReflectDrive-2: Reinforcement-Learning-Aligned Self-Editing for Discrete Diffusion Driving AU - Huimin Wang AU - Yue Wang AU - Bihao Cui AU - Pengxiang Li AU - Ben Lu AU - Mingqian Wang AU - Tong Wang AU - Chuan Tang AU - Teng Zhang AU - Kun Zhan PY - 2026 UR - https://arxiv.org/abs/2605.04647 ID - 2605.04647 ER -