TY - RPRT TI - Learning Multi-step Robotic Manipulation Policies from Visual Observation of Scene and Q-value Predictions of Previous Action AU - Sulabh Kumra AU - Shirin Joshi AU - Ferat Sahin PY - 2022 UR - https://arxiv.org/abs/2202.11280 ID - 2202.11280 ER -