TY - RPRT TI - Advantage-level Aggregation Reinforcement Learning for X-point Target Magnetic Configuration Control in an EXL-50U Experiment-Calibrated Simulation Environment AU - Siqi Ding AU - Xuanhe Wang AU - Pei Guo AU - Guoyang Shi AU - Changquan Yu AU - Yiting Wang AU - Xianming Song AU - Xiang Gu AU - Zhengyuan Chen AU - Lei Xing AU - Yapeng Zhang AU - Jianguo Chen AU - Tianyuan Liu PY - 2026 UR - https://arxiv.org/abs/2608.20834 ID - 2608.20834 ER -