TY - RPRT TI - Decentralised Q-Learning for Multi-Agent Markov Decision Processes with a Satisfiability Criterion AU - Keshav P. Keval AU - Vivek S. Borkar PY - 2023 UR - https://arxiv.org/abs/2311.12613 ID - 2311.12613 ER -