TY - RPRT TI - Revisiting Gaussian mixture critics in off-policy reinforcement learning: a sample-based approach AU - Bobak Shahriari AU - Abbas Abdolmaleki AU - Arunkumar Byravan AU - Abe Friesen AU - Siqi Liu AU - Jost Tobias Springenberg AU - Nicolas Heess AU - Matt Hoffman AU - Martin Riedmiller PY - 2022 UR - https://arxiv.org/abs/2204.10256 ID - 2204.10256 ER -