@misc{indiciae4455108ab3f3, title = {Bridging Language, Vision and Action: Multimodal VAEs in Robotic Manipulation Tasks}, author = {Gabriela Sejnova and Michal Vavrecka and Karla Stepanova}, year = {2025}, doi = {10.1109/iros58592.2024.10802160}, url = {https://arxiv.org/abs/2404.01932}, note = {Source identifier: 2404.01932} }