TY - RPRT TI - Reward-Guided Speculative Decoding for Efficient LLM Reasoning AU - Baohao Liao AU - Yuhui Xu AU - Hanze Dong AU - Junnan Li AU - Christof Monz AU - Silvio Savarese AU - Doyen Sahoo AU - Caiming Xiong PY - 2025 UR - https://arxiv.org/abs/2501.19324 ID - 2501.19324 ER -