@misc{indiciae2a6a7b8e350e, title = {UniVidX: A Unified Multimodal Framework for Versatile Video Generation via Diffusion Priors}, author = {Houyuan Chen and Hong Li and Xianghao Kong and Tianrui Zhu and Shaocong Xu and Weiqing Xiao and Yuwei Guo and Chongjie Ye and Lvmin Zhang and Hao Zhao and Anyi Rao}, year = {2026}, doi = {10.1145/3811304}, url = {https://arxiv.org/abs/2605.00658}, note = {Source identifier: 2605.00658} }