TY - RPRT TI - Multi-Agent Pointer Transformer: Seq-to-Seq Reinforcement Learning for Multi-Vehicle Dynamic Pickup-Delivery Problems AU - Zengyu Zou AU - Jingyuan Wang AU - Yixuan Huang AU - Junjie Wu PY - 2025 UR - https://arxiv.org/abs/2511.17435 ID - 2511.17435 ER -