TY - RPRT TI - Jailbreaking Large Language Models through Iterative Tool-Disguised Attacks via Reinforcement Learning AU - Zhaoqi Wang AU - Zijian Zhang AU - Daqing He AU - Pengtao Kou AU - Xin Li AU - Jiamou Liu AU - Jincheng An AU - Yong Liu PY - 2026 UR - https://arxiv.org/abs/2601.05466 ID - 2601.05466 ER -