@misc{indiciae4e27856e161a, title = {Token Buncher: Shielding LLMs from Harmful Reinforcement Learning Fine-Tuning}, author = {Weitao Feng and Lixu Wang and Peizhuo Lv and Tianyi Wei and Jie Zhang and Chongyang Gao and Sinong Zhan and Wei Dong}, year = {2026}, url = {https://arxiv.org/abs/2508.20697}, note = {Source identifier: 2508.20697} }