TY - RPRT TI - The Missing Piece in Pre-trained Model Evaluation: Reward-Guided Decoding Unlocks Task-Oriented Behavior Without Parameter Updates AU - Shaobo Wang AU - Guo Chen AU - Ziyue Wang AU - Zhengyang Tang AU - Qingyang Liu AU - Xingzhang Ren AU - Dayiheng Liu AU - Linfeng Zhang PY - 2026 UR - https://arxiv.org/abs/2605.28020 ID - 2605.28020 ER -