@misc{indiciae8dc4716f56cd, title = {CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance}, author = {Yufan Deng and Xun Guo and Yizhi Wang and Jacob Zhiyuan Fang and Angtian Wang and Shenghai Yuan and Yiding Yang and Bo Liu and Haibin Huang and Chongyang Ma}, year = {2025}, url = {https://arxiv.org/abs/2503.10391}, note = {Source identifier: 2503.10391} }