TY - RPRT TI - Online Observer-Based Inverse Reinforcement Learning AU - Ryan Self AU - Kevin Coleman AU - He Bai AU - Rushikesh Kamalapurkar PY - 2023 DO - 10.1109/lcsys.2020.3046527 UR - https://arxiv.org/abs/2011.02057 ID - 2011.02057 ER -