@misc{indiciae840eed1187b4, title = {HarmRLVR: Weaponizing Verifiable Rewards for Harmful LLM Alignment}, author = {Yuexiao Liu and Lijun Li and Xingjun Wang and Jing Shao}, year = {2026}, url = {https://arxiv.org/abs/2510.15499}, note = {Source identifier: 2510.15499} }