TY - RPRT TI - Adopting Reinforcement Learning with Verifiable Rewards for Molecular Generation AU - Mingxuan Ouyang AU - Hao Lan AU - Wanyu Lin PY - 2026 UR - https://arxiv.org/abs/2607.19044 ID - 2607.19044 ER -