TY - RPRT TI - A Generalised and Adaptable Reinforcement Learning Stopping Method AU - Reem Bin-Hezam AU - Mark Stevenson PY - 2025 DO - 10.1145/3726302.3729879 UR - https://arxiv.org/abs/2505.01907 ID - 2505.01907 ER -