TY - RPRT TI - Learning optimal policies from event logs through reinforcement learning: a comparison of deep and MDP-based approaches AU - Stefano Branchi AU - Andrei Buliga AU - Chiara Di Francescomarino AU - Chiara Ghidini AU - Riccardo Graziosi AU - Francesca Meneghello AU - Massimiliano Ronzani PY - 2026 DO - 10.1016/j.is.2026.102763 UR - https://arxiv.org/abs/2303.09209 ID - 2303.09209 ER -