TY - RPRT TI - Simple and optimal methods for stochastic variational inequalities, II: Markovian noise and policy evaluation in reinforcement learning AU - Georgios Kotsalis AU - Guanghui Lan AU - Tianjiao Li PY - 2021 UR - https://arxiv.org/abs/2011.08434 ID - 2011.08434 ER -