TY - RPRT TI - Preference-Guided Learning for Sparse-Reward Multi-Agent Reinforcement Learning AU - The Viet Bui AU - Tien Mai AU - Hong Thanh Nguyen PY - 2025 UR - https://arxiv.org/abs/2509.21828 ID - 2509.21828 ER -