TY - RPRT TI - Policy Error Bounds for Model-Based Reinforcement Learning with Factored Linear Models AU - Bernardo Ávila Pires AU - Csaba Szepesvári PY - 2016 UR - https://arxiv.org/abs/1602.06346 ID - 1602.06346 ER -