TY - RPRT TI - LERO: LLM-driven Evolutionary framework with Hybrid Rewards and Enhanced Observation for Multi-Agent Reinforcement Learning AU - Yuan Wei AU - Xiaohan Shan AU - Jianmin Li PY - 2025 UR - https://arxiv.org/abs/2503.21807 ID - 2503.21807 ER -