TY - RPRT TI - Inverse reinforcement learning by expert imitation for the stochastic linear-quadratic optimal control problem AU - Zhongshi Sun AU - Guangyan Jia PY - 2024 UR - https://arxiv.org/abs/2405.17085 ID - 2405.17085 ER -