TY - RPRT TI - Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning AU - Aaditya Mehta AU - Arya Shah PY - 2026 UR - https://arxiv.org/abs/2608.04663 ID - 2608.04663 ER -