TY - RPRT TI - Evaluating Language Models for Harmful Manipulation AU - Canfer Akbulut AU - Rasmi Elasmar AU - Abhishek Roy AU - Anthony Payne AU - Priyanka Suresh AU - Lujain Ibrahim AU - Seliem El-Sayed AU - Charvi Rastogi AU - Ashyana Kachra AU - Will Hawkins AU - Kristian Lum AU - Laura Weidinger PY - 2026 UR - https://arxiv.org/abs/2603.25326 ID - 2603.25326 ER -