@misc{indiciae4905d4df6d72, title = {Vision-Language Models Unlock Task-Centric Latent Actions}, author = {Alexander Nikulin and Ilya Zisman and Albina Klepach and Denis Tarasov and Alexander Derevyagin and Andrei Polubarov and Lyubaykin Nikita and Vladislav Kurenkov}, year = {2026}, url = {https://arxiv.org/abs/2601.22714}, note = {Source identifier: 2601.22714} }