TY - RPRT TI - Task-Oriented Formation Decision via Reinforcement Learning: Herding an Attacking Swarm AU - Zhaozong Wang AU - Guibin Sun AU - Jinyong Chen AU - Rui Zhou PY - 2026 UR - https://arxiv.org/abs/2608.09258 ID - 2608.09258 ER -