TY - RPRT TI - Reinforcement Learning in Nonzero-sum Linear Quadratic Deep Structured Games: Global Convergence of Policy Optimization AU - Masoud Roudneshin AU - Jalal Arabneydi AU - Amir G. Aghdam PY - 2020 UR - https://arxiv.org/abs/2011.14391 ID - 2011.14391 ER -