TY - RPRT TI - Reinforcement Learning of Flexible Policies for Symbolic Instructions with Adjustable Mapping Specifications AU - Wataru Hatanaka AU - Ryota Yamashina AU - Takamitsu Matsubara PY - 2025 UR - https://arxiv.org/abs/2501.18848 ID - 2501.18848 ER -