TY - RPRT TI - Howard's Policy Iteration is Subexponential for Deterministic Markov Decision Problems with Rewards of Fixed Bit-size and Arbitrary Discount Factor AU - Dibyangshu Mukherjee AU - Shivaram Kalyanakrishnan PY - 2025 UR - https://arxiv.org/abs/2505.00795 ID - 2505.00795 ER -