TY - RPRT TI - Meta-Thinking in LLMs via Multi-Agent Reinforcement Learning: A Survey AU - Ahsan Bilal AU - Muhammad Ahmed Mohsin AU - Muhammad Umer AU - Muhammad Awais Khan Bangash AU - Muhammad Ali Jamshed PY - 2025 UR - https://arxiv.org/abs/2504.14520 ID - 2504.14520 ER -