TY - RPRT TI - Discounted Reinforcement Learning Is Not an Optimization Problem AU - Abhishek Naik AU - Roshan Shariff AU - Niko Yasui AU - Hengshuai Yao AU - Richard S. Sutton PY - 2019 UR - https://arxiv.org/abs/1910.02140 ID - 1910.02140 ER -