TY - RPRT TI - Online Reinforcement Learning-Based Dynamic Adaptive Evaluation Function for Real-Time Strategy Tasks AU - Weilong Yang AU - Jie Zhang AU - Xunyun Liu AU - Yanqing Ye PY - 2025 UR - https://arxiv.org/abs/2501.03824 ID - 2501.03824 ER -