TY - RPRT TI - Convergent Q-Learning for Infinite-Horizon General-Sum Markov Games through Behavioral Economics AU - Yizhou Zhang AU - Eric Mazumdar PY - 2025 UR - https://arxiv.org/abs/2508.08669 ID - 2508.08669 ER -