TY - RPRT TI - Reinforcement Learning in Feature Space: Matrix Bandit, Kernels, and Regret Bound AU - Lin F. Yang AU - Mengdi Wang PY - 2019 UR - https://arxiv.org/abs/1905.10389 ID - 1905.10389 ER -