TY - RPRT TI - RLHF Fine-Tuning of LLMs for Alignment with Implicit User Feedback in Conversational Recommenders AU - Zhongheng Yang AU - Aijia Sun AU - Yushang Zhao AU - Yinuo Yang AU - Dannier Li AU - Chengrui Zhou PY - 2025 UR - https://arxiv.org/abs/2508.05289 ID - 2508.05289 ER -