TY - RPRT TI - Learning Constrained Markov Decision Processes With Non-stationary Rewards and Constraints AU - Francesco Emanuele Stradi AU - Anna Lunghi AU - Matteo Castiglioni AU - Alberto Marchesi AU - Nicola Gatti PY - 2024 UR - https://arxiv.org/abs/2405.14372 ID - 2405.14372 ER -