TY - RPRT TI - How Does the Lagrangian Guide Safe Reinforcement Learning through Diffusion Models? AU - Xiaoyuan Cheng AU - Wenxuan Yuan AU - Boyang Li AU - Yuanchao Xu AU - Yiming Yang AU - Hao Liang AU - Bei Peng AU - Robert Loftin AU - Zhuo Sun AU - Yukun Hu PY - 2026 UR - https://arxiv.org/abs/2602.02924 ID - 2602.02924 ER -