TY - RPRT TI - Reinforcement Learning with Sparse Rewards using Guidance from Offline Demonstration AU - Desik Rengarajan AU - Gargi Vaidya AU - Akshay Sarvesh AU - Dileep Kalathil AU - Srinivas Shakkottai PY - 2022 UR - https://arxiv.org/abs/2202.04628 ID - 2202.04628 ER -