TY - RPRT TI - Policy Evaluation and Temporal-Difference Learning in Continuous Time and Space: A Martingale Approach AU - Yanwei Jia AU - Xun Yu Zhou PY - 2022 UR - https://arxiv.org/abs/2108.06655 ID - 2108.06655 ER -