TY - RPRT TI - ARF-RLHF: Adaptive Reward-Following for RLHF through Emotion-Driven Self-Supervision and Trace-Biased Dynamic Optimization AU - YuXuan Zhang PY - 2025 UR - https://arxiv.org/abs/2507.03069 ID - 2507.03069 ER -