TY - RPRT TI - Highly Efficient Self-Adaptive Reward Shaping for Reinforcement Learning AU - Haozhe Ma AU - Zhengding Luo AU - Thanh Vinh Vo AU - Kuankuan Sima AU - Tze-Yun Leong PY - 2025 UR - https://arxiv.org/abs/2408.03029 ID - 2408.03029 ER -