@misc{indiciaef41d9731104c, title = {ACPO: Agent-Chained Policy Optimization for Multi-Agent Reinforcement Learning}, author = {Daiki E. Matsunaga and Junho Na and Tri Wahyu Guntara and Scott Sanner and Pascal Poupart and Jongmin Lee and Kee-Eung Kim}, year = {2026}, url = {https://arxiv.org/abs/2606.30072}, note = {Source identifier: 2606.30072} }