TY - RPRT TI - Towards Faithful Natural Language Explanations: A Study Using Activation Patching in Large Language Models AU - Wei Jie Yeo AU - Ranjan Satapathy AU - Erik Cambria PY - 2024 UR - https://arxiv.org/abs/2410.14155 ID - 2410.14155 ER -