TY - RPRT TI - Multi-Agent Deep Reinforcement Learning based Spectrum Allocation for D2D Underlay Communications AU - Zheng Li AU - Caili Guo PY - 2019 UR - https://arxiv.org/abs/1912.09302 ID - 1912.09302 ER -