@misc{indiciae17acb4e0c1ea, title = {VLAFlow: A Unified Training Framework for Vision-Language-Action Models via Co-training and Future Latent Alignment}, author = {Guoyang Xia and Fengfa Li and Hongjin Ji and Lei Ren and Fangxiang Feng and Kun Zhan and Yan Xie}, year = {2026}, url = {https://arxiv.org/abs/2607.01586}, note = {Source identifier: 2607.01586} }