TY - RPRT TI - Off-policy reinforcement learning for $ H_\infty $ control design AU - Biao Luo AU - Huai-Ning Wu AU - Tingwen Huang PY - 2014 DO - 10.1109/tcyb.2014.2319577 UR - https://arxiv.org/abs/1311.6107 ID - 1311.6107 ER -