TY - RPRT TI - Offline Reinforcement Learning with Fisher Divergence Critic Regularization AU - Ilya Kostrikov AU - Jonathan Tompson AU - Rob Fergus AU - Ofir Nachum PY - 2021 UR - https://arxiv.org/abs/2103.08050 ID - 2103.08050 ER -