@misc{indiciae74d18e6a96ec, title = {UNeMo: Collaborative Visual-Language Reasoning and Navigation via a Multimodal World Model}, author = {Changxin Huang and Lv Tang and Zhaohuan Zhan and Lisha Yu and Runhao Zeng and Zun Liu and Zhengjie Wang and Jianqiang Li}, year = {2026}, url = {https://arxiv.org/abs/2511.18845}, note = {Source identifier: 2511.18845} }