TY - RPRT TI - Optimization Solution Functions as Deterministic Policies for Offline Reinforcement Learning AU - Vanshaj Khattar AU - Ming Jin PY - 2024 UR - https://arxiv.org/abs/2408.15368 ID - 2408.15368 ER -