TY - RPRT TI - ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data AU - Tong Chen AU - Faeze Brahman AU - Jiacheng Liu AU - Niloofar Mireshghallah AU - Weijia Shi AU - Pang Wei Koh AU - Luke Zettlemoyer AU - Hannaneh Hajishirzi PY - 2025 UR - https://arxiv.org/abs/2504.14452 ID - 2504.14452 ER -