@misc{indiciaeaacc36b49eae, title = {Learning Vision-and-Language Navigation from YouTube Videos}, author = {Kunyang Lin and Peihao Chen and Diwei Huang and Thomas H. Li and Mingkui Tan and Chuang Gan}, year = {2023}, url = {https://arxiv.org/abs/2307.11984}, note = {Source identifier: 2307.11984} }