TY - RPRT TI - Adaptive Collaboration with Humans: Metacognitive Policy Optimization for Multi-Agent LLMs with Continual Learning AU - Wei Yang AU - Defu Cao AU - Jiacheng Pang AU - Muyan Weng AU - Yan Liu PY - 2026 UR - https://arxiv.org/abs/2603.07972 ID - 2603.07972 ER -