@misc{indiciae701198dbccc9, title = {InSight-o3: Empowering Multimodal Foundation Models with Generalized Visual Search}, author = {Kaican Li and Lewei Yao and Jiannan Wu and Tiezheng Yu and Jierun Chen and Haoli Bai and Lu Hou and Lanqing Hong and Wei Zhang and Nevin L. Zhang}, year = {2025}, url = {https://arxiv.org/abs/2512.18745}, note = {Source identifier: 2512.18745} }