TY - RPRT TI - A New Error Temporal Difference Algorithm for Deep Reinforcement Learning in Microgrid Optimization AU - Fulong Yao AU - Wanqing Zhao AU - Matthew Forshaw PY - 2025 UR - https://arxiv.org/abs/2511.18093 ID - 2511.18093 ER -