TY - RPRT TI - Constrained episodic reinforcement learning in concave-convex and knapsack settings AU - Kianté Brantley AU - Miroslav Dudik AU - Thodoris Lykouris AU - Sobhan Miryoosefi AU - Max Simchowitz AU - Aleksandrs Slivkins AU - Wen Sun PY - 2021 UR - https://arxiv.org/abs/2006.05051 ID - 2006.05051 ER -