@misc{indiciae6c8744a4d4dc, title = {Token-Level Inference-Time Alignment for Vision-Language Models}, author = {Kejia Chen and Jiawen Zhang and Jiacong Hu and Kewei Gao and Jian Lou and Zunlei Feng and Mingli Song}, year = {2025}, url = {https://arxiv.org/abs/2510.21794}, note = {Source identifier: 2510.21794} }