@misc{indiciaee176dea5109d, title = {WorldBagel: Uncovering the Power of Unified Multimodal Models for Vision-Language-Action-World Modeling}, author = {Zelin Zhao and Min Shi and Bo Yuan and Haotian Xue and Jialuo Li and Lama Moukheiber and Humphrey Shi and Yongxin Chen}, year = {2026}, url = {https://arxiv.org/abs/2607.03461}, note = {Source identifier: 2607.03461} }