TY - RPRT TI - OPTAGENT: Optimizing Multi-Agent LLM Interactions Through Verbal Reinforcement Learning for Enhanced Reasoning AU - Zhenyu Bi AU - Meng Lu AU - Yang Li AU - Swastik Roy AU - Weijie Guan AU - Morteza Ziyadi AU - Xuan Wang PY - 2025 UR - https://arxiv.org/abs/2510.18032 ID - 2510.18032 ER -