TY - RPRT TI - Flow-Map GRPO: Reinforcement Learning for Few-Step Flow-Map Generators via Anchored Stochastic Composition AU - Zhiqi Li AU - Wen Zhang AU - Bo Zhu PY - 2026 UR - https://arxiv.org/abs/2607.00535 ID - 2607.00535 ER -