TY - RPRT TI - Agent Q-Mix: Selecting the Right Action for LLM Multi-Agent Systems through Reinforcement Learning AU - Eric Hanchen Jiang AU - Levina Li AU - Rui Sun AU - Xiao Liang AU - Yubei Li AU - Yuchen Wu AU - Haozheng Luo AU - Hengli Li AU - Zhi Zhang AU - Zhaolu Kang AU - Kai-Wei Chang AU - Ying Nian Wu PY - 2026 UR - https://arxiv.org/abs/2604.00344 ID - 2604.00344 ER -