@misc{indiciae81262f961c0b, title = {Inference-Time Decontamination: Reusing Leaked Benchmarks for Large Language Model Evaluation}, author = {Qin Zhu and Qingyuan Cheng and Runyu Peng and Xiaonan Li and Tengxiao Liu and Ru Peng and Xipeng Qiu and Xuanjing Huang}, year = {2024}, url = {https://arxiv.org/abs/2406.13990}, note = {Source identifier: 2406.13990} }