TY - RPRT TI - Model-Based Reinforcement Learning in Discrete-Action Non-Markovian Reward Decision Processes AU - Alessandro Trapasso AU - Luca Iocchi AU - Fabio Patrizi PY - 2026 UR - https://arxiv.org/abs/2512.14617 ID - 2512.14617 ER -