TY - RPRT TI - Quantum Policy Iteration via Amplitude Estimation and Grover Search -- Towards Quantum Advantage for Reinforcement Learning AU - Simon Wiedemann AU - Daniel Hein AU - Steffen Udluft AU - Christian Mendl PY - 2023 UR - https://arxiv.org/abs/2206.04741 ID - 2206.04741 ER -