TY - RPRT TI - Leveraging Prior Knowledge in Reinforcement Learning via Double-Sided Bounds on the Value Function AU - Jacob Adamczyk AU - Stas Tiomkin AU - Rahul Kulkarni PY - 2023 UR - https://arxiv.org/abs/2302.09676 ID - 2302.09676 ER -