TY - RPRT TI - RLBR: Reinforcement Learning with Biasing Rewards for Contextual Speech Large Language Models AU - Bo Ren AU - Ruchao Fan AU - Yelong Shen AU - Weizhu Chen AU - Jinyu Li PY - 2026 UR - https://arxiv.org/abs/2601.13409 ID - 2601.13409 ER -