TY - RPRT TI - Full Gradient Deep Reinforcement Learning for Average-Reward Criterion AU - Tejas Pagare AU - Vivek Borkar AU - Konstantin Avrachenkov PY - 2023 UR - https://arxiv.org/abs/2304.03729 ID - 2304.03729 ER -