TY - RPRT TI - An FPGA-Based On-Device Reinforcement Learning Approach using Online Sequential Learning AU - Hirohisa Watanabe AU - Mineto Tsukada AU - Hiroki Matsutani PY - 2023 UR - https://arxiv.org/abs/2005.04646 ID - 2005.04646 ER -