@misc{indiciaefa16aa9fac34, title = {DISPLAY: Directable Human-Object Interaction Video Generation via Sparse Motion Guidance and Multi-Task Auxiliary}, author = {Jiazhi Guan and Quanwei Yang and Luying Huang and Junhao Liang and Borong Liang and Haocheng Feng and Wei He and Kaisiyuan Wang and Hang Zhou and Jingdong Wang}, year = {2026}, url = {https://arxiv.org/abs/2603.09883}, note = {Source identifier: 2603.09883} }