TY - RPRT TI - Steady-State Error Compensation for Reinforcement Learning with Quadratic Rewards AU - Liyao Wang AU - Zishun Zheng AU - Yuan Lin PY - 2024 UR - https://arxiv.org/abs/2402.09075 ID - 2402.09075 ER -