TY - RPRT TI - Cognitive models can reveal interpretable value trade-offs in language models AU - Sonia K. Murthy AU - Rosie Zhao AU - Jennifer Hu AU - Sham Kakade AU - Markus Wulfmeier AU - Peng Qian AU - Tomer Ullman PY - 2026 UR - https://arxiv.org/abs/2506.20666 ID - 2506.20666 ER -