@misc{indiciae5fc4e6da91d2, title = {Learning Efficient and Robust Language-conditioned Manipulation using Textual-Visual Relevancy and Equivariant Language Mapping}, author = {Mingxi Jia and Haojie Huang and Zhewen Zhang and Chenghao Wang and Linfeng Zhao and Dian Wang and Jason Xinyu Liu and Robin Walters and Robert Platt and Stefanie Tellex}, year = {2025}, url = {https://arxiv.org/abs/2406.15677}, note = {Source identifier: 2406.15677} }