TY - RPRT TI - Sample Efficient Reinforcement Learning with REINFORCE AU - Junzi Zhang AU - Jongho Kim AU - Brendan O'Donoghue AU - Stephen Boyd PY - 2020 UR - https://arxiv.org/abs/2010.11364 ID - 2010.11364 ER -