TY - RPRT TI - Hierarchical Policy-Gradient Reinforcement Learning for Multi-Agent Shepherding Control of Non-Cohesive Targets AU - Stefano Covone AU - Italo Napolitano AU - Francesco De Lellis AU - Mario di Bernardo PY - 2025 UR - https://arxiv.org/abs/2504.02479 ID - 2504.02479 ER -