TY - RPRT TI - PrLM: Learning Explicit Reasoning for Personalized RAG via Contrastive Reward Optimization AU - Kepu Zhang AU - Teng Shi AU - Weijie Yu AU - Jun Xu PY - 2025 UR - https://arxiv.org/abs/2508.07342 ID - 2508.07342 ER -