TY - RPRT TI - Internal State-Based Policy Gradient Methods for Partially Observable Markov Potential Games AU - Wonseok Yang AU - Thinh T. Doan PY - 2026 UR - https://arxiv.org/abs/2604.00433 ID - 2604.00433 ER -