TY - RPRT TI - RewardWeaver: Long-Horizon Interactive Learning for Language Agents via Self-Evolving Reward Adaptation AU - Hengbo Xiao AU - Boyao Zhang AU - Purui Liu AU - Yuxuan Zheng AU - Haoran Yin AU - Haibo Liu AU - Fan Zhang PY - 2026 UR - https://arxiv.org/abs/2610.10120 ID - 2610.10120 ER -