TY - RPRT TI - Gaussian-Mixture-Model Q-Functions for Reinforcement Learning by Riemannian Optimization AU - Minh Vu AU - Konstantinos Slavakis PY - 2024 UR - https://arxiv.org/abs/2409.04374 ID - 2409.04374 ER -