TY - RPRT TI - Improved Off-policy Reinforcement Learning in Biological Sequence Design AU - Hyeonah Kim AU - Minsu Kim AU - Taeyoung Yun AU - Sanghyeok Choi AU - Emmanuel Bengio AU - Alex Hernández-García AU - Jinkyoo Park PY - 2025 UR - https://arxiv.org/abs/2410.04461 ID - 2410.04461 ER -