@misc{indiciae5dd7516c9d78, title = {Quantum Policy Iteration via Amplitude Estimation and Grover Search -- Towards Quantum Advantage for Reinforcement Learning}, author = {Simon Wiedemann and Daniel Hein and Steffen Udluft and Christian Mendl}, year = {2023}, url = {https://arxiv.org/abs/2206.04741}, note = {Source identifier: 2206.04741} }