TY - RPRT TI - Counterexample-Guided Strategy Improvement for POMDPs Using Recurrent Neural Networks AU - Steven Carr AU - Nils Jansen AU - Ralf Wimmer AU - Alexandru C. Serban AU - Bernd Becker AU - Ufuk Topcu PY - 2019 UR - https://arxiv.org/abs/1903.08428 ID - 1903.08428 ER -