@misc{indiciae76ba8ecebfeb, title = {UnityVideo: Unified Multi-Modal Multi-Task Learning for Enhancing World-Aware Video Generation}, author = {Jiehui Huang and Yuechen Zhang and Xu He and Yuan Gao and Zhi Cen and Bin Xia and Yan Zhou and Xin Tao and Pengfei Wan and Jiaya Jia}, year = {2025}, url = {https://arxiv.org/abs/2512.07831}, note = {Source identifier: 2512.07831} }