TY - RPRT TI - When a Reinforcement Learning Agent Encounters Unknown Unknowns AU - Juntian Zhu AU - Miguel de Carvalho AU - Zhouwang Yang AU - Fengxiang He PY - 2025 UR - https://arxiv.org/abs/2505.13188 ID - 2505.13188 ER -