TY - RPRT TI - EvoCoT: Overcoming the Exploration Bottleneck in Reinforcement Learning AU - Huanyu Liu AU - Jia Li AU - Yihong Dong AU - Chang Yu AU - Taozhi Chen AU - Lecheng Wang AU - Yongding Tao AU - Bin Gu AU - Ge Li PY - 2026 UR - https://arxiv.org/abs/2508.07809 ID - 2508.07809 ER -