TY - RPRT TI - STAR-1: Safer Alignment of Reasoning LLMs with 1K Data AU - Zijun Wang AU - Haoqin Tu AU - Yuhan Wang AU - Juncheng Wu AU - Yanqing Liu AU - Jieru Mei AU - Brian R. Bartoldson AU - Bhavya Kailkhura AU - Cihang Xie PY - 2025 UR - https://arxiv.org/abs/2504.01903 ID - 2504.01903 ER -