TY - RPRT TI - AI-Slop to AI-Polish? Aligning Language Models through Edit-Based Writing Rewards and Test-time Computation AU - Tuhin Chakrabarty AU - Philippe Laban AU - Chien-Sheng Wu PY - 2025 UR - https://arxiv.org/abs/2504.07532 ID - 2504.07532 ER -