TY - RPRT TI - Low-Precision Reinforcement Learning: Running Soft Actor-Critic in Half Precision AU - Johan Bjorck AU - Xiangyu Chen AU - Christopher De Sa AU - Carla P. Gomes AU - Kilian Q. Weinberger PY - 2021 UR - https://arxiv.org/abs/2102.13565 ID - 2102.13565 ER -