TY - RPRT TI - A Cross Entropy based Stochastic Approximation Algorithm for Reinforcement Learning with Linear Function Approximation AU - Ajin George Joseph AU - Shalabh Bhatnagar PY - 2016 UR - https://arxiv.org/abs/1609.09449 ID - 1609.09449 ER -