@misc{indiciaee4c2e352e5e3, title = {GoViG: Goal-Conditioned Visual Navigation Instruction Generation via Multimodal Reasoning}, author = {Fengyi Wu and Yifei Dong and Yilong Dai and Guangyu Chen and Qifeng Wu and Huiting Huang and Hang Wang and Qi Dai and Alexander G. Hauptmann and Zhi-Qi Cheng}, year = {2026}, url = {https://arxiv.org/abs/2508.09547}, note = {Source identifier: 2508.09547} }