@misc{indiciae93abc1bd90e9, title = {DiffVC: A Non-autoregressive Framework Based on Diffusion Model for Video Captioning}, author = {Junbo Wang and Liangyu Fu and Yuke Li and Yining Zhu and Ya Jing and Xuecheng Wu and Jiangbin Zheng}, year = {2026}, url = {https://arxiv.org/abs/2604.08084}, note = {Source identifier: 2604.08084} }