TY - RPRT TI - HALO-WA: Hybrid-Attention Latent-Guided Online Reinforcement Learning for World-Action Models AU - Angen Ye AU - Weijie Ke AU - Xiaofeng Wang AU - Xinze Chen AU - Chaojun Ni AU - Guosheng Zhao AU - Boyuan Wang AU - Zheng Zhu AU - Junjie Xie AU - Dapeng Zhang PY - 2026 UR - https://arxiv.org/abs/2607.04265 ID - 2607.04265 ER -