TY - RPRT TI - Off-Policy Correction for Deep Deterministic Policy Gradient Algorithms via Batch Prioritized Experience Replay AU - Dogan C. Cicek AU - Enes Duran AU - Baturay Saglam AU - Furkan B. Mutlu AU - Suleyman S. Kozat PY - 2021 UR - https://arxiv.org/abs/2111.01865 ID - 2111.01865 ER -