TY - RPRT TI - RLPF: Reinforcement Learning from Prediction Feedback for User Summarization with LLMs AU - Jiaxing Wu AU - Lin Ning AU - Luyang Liu AU - Harrison Lee AU - Neo Wu AU - Chao Wang AU - Sushant Prakash AU - Shawn O'Banion AU - Bradley Green AU - Jun Xie PY - 2025 UR - https://arxiv.org/abs/2409.04421 ID - 2409.04421 ER -