@misc{indiciae0826c4e578c1, title = {IDOL: Unified Dual-Modal Latent Diffusion for Human-Centric Joint Video-Depth Generation}, author = {Yuanhao Zhai and Kevin Lin and Linjie Li and Chung-Ching Lin and Jianfeng Wang and Zhengyuan Yang and David Doermann and Junsong Yuan and Zicheng Liu and Lijuan Wang}, year = {2024}, url = {https://arxiv.org/abs/2407.10937}, note = {Source identifier: 2407.10937} }