@misc{indiciae8728a17e6dea, title = {Interpretability without actionability: mechanistic methods cannot correct language model errors despite near-perfect internal representations}, author = {Sanjay Basu and Sadiq Y. Patel and Parth Sheth and Bhairavi Muralidharan and Namrata Elamaran and Aakriti Kinra and John Morgan and Rajaie Batniji}, year = {2026}, url = {https://arxiv.org/abs/2603.18353}, note = {Source identifier: 2603.18353} }