TY - RPRT TI - Convex Q-Learning, Part 1: Deterministic Optimal Control AU - Prashant G. Mehta AU - Sean P. Meyn PY - 2020 UR - https://arxiv.org/abs/2008.03559 ID - 2008.03559 ER -