TY - RPRT TI - Alignment and Safety of Diffusion Models via Reinforcement Learning and Reward Modeling: A Survey AU - Preeti Lamba AU - Kiran Ravish AU - Ankita Kushwaha AU - Pawan Kumar PY - 2026 UR - https://arxiv.org/abs/2505.17352 ID - 2505.17352 ER -