TY - RPRT TI - Can Reinforcement Learning Unlock the Hidden Dangers in Aligned Large Language Models? AU - Mohammad Bahrami Karkevandi AU - Nishant Vishwamitra AU - Peyman Najafirad PY - 2024 UR - https://arxiv.org/abs/2408.02651 ID - 2408.02651 ER -