TY - RPRT TI - Finite Memory Belief Approximation for Optimal Control in Partially Observable Markov Decision Processes AU - Mintae Kim PY - 2026 UR - https://arxiv.org/abs/2601.03132 ID - 2601.03132 ER -