TY - RPRT TI - GRPO-QPS: Target-Preserving Reinforcement Learning for Quantum Posterior Sampling AU - Yufeng Wang AU - Parivesh Priye AU - Lu Wei AU - Haibin Ling PY - 2026 UR - https://arxiv.org/abs/2609.14711 ID - 2609.14711 ER -