TY - RPRT TI - Synthetically Generating Human-like Data for Sequential Decision Making Tasks via Reward-Shaped Imitation Learning AU - Bryan Brandt AU - Prithviraj Dasgupta PY - 2023 UR - https://arxiv.org/abs/2304.07280 ID - 2304.07280 ER -