@misc{indiciae9482f6d3576b, title = {SUV: Future Scene Understanding as Video Generation for End-to-End Driving}, author = {Yibo Yuan and Jiacheng Fu and Jiangtong Zhu and Yi Li and Jianhua Han and Meng Tian and Zhuohan Liu and Zhiwei Xiong and Hang Xu and Jianwu Fang and Jianru Xue}, year = {2026}, url = {https://arxiv.org/abs/2608.03084}, note = {Source identifier: 2608.03084} }