TY - RPRT TI - Provably Efficient Offline Goal-Conditioned Reinforcement Learning with General Function Approximation and Single-Policy Concentrability AU - Hanlin Zhu AU - Amy Zhang PY - 2023 UR - https://arxiv.org/abs/2302.03770 ID - 2302.03770 ER -