TY - RPRT TI - Towards Open-Ended Emotional Support Conversations in LLMs via Reinforcement Learning with Future-Oriented Rewards AU - Ting Yang AU - Li Chen AU - Huimin Wang PY - 2025 UR - https://arxiv.org/abs/2508.12935 ID - 2508.12935 ER -