TY - RPRT TI - Near-optimal Representation Learning for Linear Bandits and Linear RL AU - Jiachen Hu AU - Xiaoyu Chen AU - Chi Jin AU - Lihong Li AU - Liwei Wang PY - 2021 UR - https://arxiv.org/abs/2102.04132 ID - 2102.04132 ER -