@misc{indiciae95ac999f7a85, title = {Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration}, author = {Zhongzhi Yu and Zheng Wang and Yonggan Fu and Huihong Shi and Khalid Shaikh and Yingyan Celine Lin}, year = {2024}, url = {https://arxiv.org/abs/2406.15765}, note = {Source identifier: 2406.15765} }