TY - RPRT TI - Observer-Feedback-Feedforward Controller Structures in Reinforcement Learning AU - Ruoqi Zhang AU - Per Mattson AU - Torbjörn Wigren PY - 2023 UR - https://arxiv.org/abs/2304.10276 ID - 2304.10276 ER -