TY - RPRT TI - Sampling for Quality: Training-Free Reward-Guided LLM Decoding via Sequential Monte Carlo AU - Jelena Markovic-Voronov AU - Wenhui Zhu AU - Bo Long AU - Zhipeng Wang AU - Suyash Gupta AU - Kayhan Behdin AU - Bee-Chung Chen AU - Deepak Agarwal PY - 2026 UR - https://arxiv.org/abs/2604.16453 ID - 2604.16453 ER -