TY - RPRT TI - Horizon-Free and Instance-Dependent Regret Bounds for Reinforcement Learning with General Function Approximation AU - Jiayi Huang AU - Han Zhong AU - Liwei Wang AU - Lin F. Yang PY - 2023 UR - https://arxiv.org/abs/2312.04464 ID - 2312.04464 ER -