TY - RPRT TI - Vid2Robot: End-to-end Video-conditioned Policy Learning with Cross-Attention Transformers AU - Vidhi Jain AU - Maria Attarian AU - Nikhil J Joshi AU - Ayzaan Wahid AU - Danny Driess AU - Quan Vuong AU - Pannag R Sanketi AU - Pierre Sermanet AU - Stefan Welker AU - Christine Chan AU - Igor Gilitschenski AU - Yonatan Bisk AU - Debidatta Dwibedi PY - 2024 UR - https://arxiv.org/abs/2403.12943 ID - 2403.12943 ER -