@misc{indiciaeaa4b9da3c1cc, title = {Multi-Agent Off-Policy TD Learning: Finite-Time Analysis with Near-Optimal Sample Complexity and Communication Complexity}, author = {Ziyi Chen and Yi Zhou and Rongrong Chen}, year = {2021}, url = {https://arxiv.org/abs/2103.13147}, note = {Source identifier: 2103.13147} }