@misc{indiciae26375158231d, title = {AlphaAlign: Incentivizing Safety Alignment with Extremely Simplified Reinforcement Learning}, author = {Yi Zhang and An Zhang and XiuYu Zhang and Leheng Sheng and Yuxin Chen and Zhenkai Liang and Xiang Wang}, year = {2025}, url = {https://arxiv.org/abs/2507.14987}, note = {Source identifier: 2507.14987} }