@misc{indiciae02f65f571ffa, title = {Phantom: Subject-consistent video generation via cross-modal alignment}, author = {Lijie Liu and Tianxiang Ma and Bingchuan Li and Zhuowei Chen and Jiawei Liu and Gen Li and Siyu Zhou and Qian He and Xinglong Wu}, year = {2025}, url = {https://arxiv.org/abs/2502.11079}, note = {Source identifier: 2502.11079} }