TY - RPRT TI - Are Language Models Sensitive to Morally Irrelevant Distractors? AU - Andrew Shaw AU - Christina Hahn AU - Catherine Rasgaitis AU - Yash Mishra AU - Alisa Liu AU - Natasha Jaques AU - Yulia Tsvetkov AU - Amy X. Zhang PY - 2026 UR - https://arxiv.org/abs/2602.09416 ID - 2602.09416 ER -