@misc{indiciae6d8292bdc854, title = {Finite-Sample Analysis of Off-Policy TD-Learning via Generalized Bellman Operators}, author = {Zaiwei Chen and Siva Theja Maguluri and Sanjay Shakkottai and Karthikeyan Shanmugam}, year = {2021}, url = {https://arxiv.org/abs/2106.12729}, note = {Source identifier: 2106.12729} }