TY - RPRT TI - Reinforcement Learning for POMDP: Partitioned Rollout and Policy Iteration with Application to Autonomous Sequential Repair Problems AU - Sushmita Bhattacharya AU - Sahil Badyal AU - Thomas Wheeler AU - Stephanie Gil AU - Dimitri Bertsekas PY - 2020 UR - https://arxiv.org/abs/2002.04175 ID - 2002.04175 ER -