TY - RPRT TI - AlphaAlign: Incentivizing Safety Alignment with Extremely Simplified Reinforcement Learning AU - Yi Zhang AU - An Zhang AU - XiuYu Zhang AU - Leheng Sheng AU - Yuxin Chen AU - Zhenkai Liang AU - Xiang Wang PY - 2025 UR - https://arxiv.org/abs/2507.14987 ID - 2507.14987 ER -