TY - RPRT TI - Reinforcement Learning Ship Autopilot: Sample efficient and Model Predictive Control-based Approach AU - Yunduan Cui AU - Shigeki Osaki AU - Takamitsu Matsubara PY - 2019 UR - https://arxiv.org/abs/1901.07905 ID - 1901.07905 ER -