@misc{indiciae0614d92c38ef, title = {TV2TV: A Unified Framework for Interleaved Language and Video Generation}, author = {Xiaochuang Han and Youssef Emad and Melissa Hall and John Nguyen and Karthik Padthe and Liam Robbins and Amir Bar and Delong Chen and Michal Drozdzal and Maha Elbayad and Yushi Hu and Shang-Wen Li and Sreya Dutta Roy and Jakob Verbeek and XuDong Wang and Marjan Ghazvininejad and Luke Zettlemoyer and Emily Dinan}, year = {2025}, url = {https://arxiv.org/abs/2512.05103}, note = {Source identifier: 2512.05103} }