TY - RPRT TI - Jet-RL: Enabling On-Policy FP8 Reinforcement Learning with Unified Training and Rollout Precision Flow AU - Haocheng Xi AU - Charlie Ruan AU - Peiyuan Liao AU - Yujun Lin AU - Han Cai AU - Yilong Zhao AU - Shuo Yang AU - Kurt Keutzer AU - Song Han AU - Ligeng Zhu PY - 2026 UR - https://arxiv.org/abs/2601.14243 ID - 2601.14243 ER -