@misc{indiciaed1db2140ab1d, title = {Gradient-Guided Reward Optimization for Inference-time Alignment}, author = {Hankun Lin and Ruqi Zhang}, year = {2026}, url = {https://arxiv.org/abs/2606.09635}, note = {Source identifier: 2606.09635} }