@misc{indiciae3efeaab38403, title = {Revisiting Multimodal Positional Encoding in Vision-Language Models}, author = {Jie Huang and Xuejing Liu and Sibo Song and Ruibing Hou and Hong Chang and Junyang Lin and Shuai Bai}, year = {2026}, url = {https://arxiv.org/abs/2510.23095}, note = {Source identifier: 2510.23095} }