@misc{indiciaecad2d1e3625a, title = {S-VAM: Shortcut Video-Action Model by Self-Distilling Geometric and Semantic Foresight}, author = {Haodong Yan and Zhide Zhong and Jiaguan Zhu and Junjie He and Weilin Yuan and Wenxuan Song and Xin Gong and Yingjie Cai and Guanyi Zhao and Xu Yan and Bingbing Liu and Ying-Cong Chen and Haoang Li}, year = {2026}, url = {https://arxiv.org/abs/2603.16195}, note = {Source identifier: 2603.16195} }