TY - RPRT TI - Prism-GRPO: Faster VLA Policy Optimization via Splitting Same-outcome Groups AU - Zeyun Deng AU - Yuzhe Lu AU - Yawei Wang AU - Linbo Liu AU - Qing Ping AU - Han Ding AU - Guande Wu AU - Panpan Xu AU - Jun Huan PY - 2026 UR - https://arxiv.org/abs/2608.17423 ID - 2608.17423 ER -