TY - RPRT TI - Vision-Based Generic Potential Function for Policy Alignment in Multi-Agent Reinforcement Learning AU - Hao Ma AU - Shijie Wang AU - Zhiqiang Pu AU - Siyao Zhao AU - Xiaolin Ai PY - 2025 UR - https://arxiv.org/abs/2502.13430 ID - 2502.13430 ER -