TY - RPRT TI - A proof of convergence of inverse reinforcement learning for multi-objective optimization AU - Akira Kitaoka AU - Riki Eto PY - 2023 UR - https://arxiv.org/abs/2305.06137 ID - 2305.06137 ER -