TY - RPRT TI - Towards Faithful and Controllable Personalization via Critique-Post-Edit Reinforcement Learning AU - Chenghao Zhu AU - Meiling Tao AU - Tiannan Wang AU - Dongyi Ding AU - Yuchen Eleanor Jiang AU - Wangchunshu Zhou PY - 2025 UR - https://arxiv.org/abs/2510.18849 ID - 2510.18849 ER -