@misc{indiciaef575cf29d4e3, title = {Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning}, author = {Yiqun Chen and Jinyuan Feng and Wei Yang and Meizhi Zhong and Zhengliang Shi and Rui Li and Xiaochi Wei and Yan Gao and Yi Wu and Yao Hu and Zhiqiang Pu and Jiaxin Mao}, year = {2026}, url = {https://arxiv.org/abs/2601.21919}, note = {Source identifier: 2601.21919} }