TY - RPRT TI - Representation of Reinforcement Learning Policies in Reproducing Kernel Hilbert Spaces AU - Bogdan Mazoure AU - Thang Doan AU - Tianyu Li AU - Vladimir Makarenkov AU - Joelle Pineau AU - Doina Precup AU - Guillaume Rabusseau PY - 2020 UR - https://arxiv.org/abs/2002.02863 ID - 2002.02863 ER -