@misc{indiciae89bdeaf36539, title = {GRPO-QPS: Target-Preserving Reinforcement Learning for Quantum Posterior Sampling}, author = {Yufeng Wang and Parivesh Priye and Lu Wei and Haibin Ling}, year = {2026}, url = {https://arxiv.org/abs/2609.14711}, note = {Source identifier: 2609.14711} }