TY - RPRT TI - Variance-aware robust reinforcement learning with linear function approximation under heavy-tailed rewards AU - Xiang Li AU - Qiang Sun PY - 2023 UR - https://arxiv.org/abs/2303.05606 ID - 2303.05606 ER -