@misc{indiciaeb08c08dfc895, title = {Why Only Text: Empowering Vision-and-Language Navigation with Multi-modal Prompts}, author = {Haodong Hong and Sen Wang and Zi Huang and Qi Wu and Jiajun Liu}, year = {2024}, url = {https://arxiv.org/abs/2406.02208}, note = {Source identifier: 2406.02208} }