TY - RPRT TI - Deep Reinforcement Learning: A Convex Optimization Approach AU - Ather Gattami PY - 2024 UR - https://arxiv.org/abs/2402.19212 ID - 2402.19212 ER -