TY - RPRT TI - Code-A1: Adversarial Evolving of Code LLM and Test LLM via Reinforcement Learning AU - Aozhe Wang AU - Yuchen Yan AU - Nan Zhou AU - Zhengxi Lu AU - Weiming Lu AU - Jun Xiao AU - Yueting Zhuang AU - Yongliang Shen PY - 2026 UR - https://arxiv.org/abs/2603.15611 ID - 2603.15611 ER -