TY - RPRT TI - A non-zero-sum game with reinforcement learning under mean-variance framework AU - Junyi Guo AU - Xia Han AU - Hao Wang AU - Kam Chuen Yuen PY - 2025 UR - https://arxiv.org/abs/2502.04788 ID - 2502.04788 ER -