@misc{indiciae5aa25bd51c3a, title = {From Pixels to Predicates: Learning Symbolic World Models via Pretrained Vision-Language Models}, author = {Ashay Athalye and Nishanth Kumar and Tom Silver and Yichao Liang and Jiuguang Wang and Tomás Lozano-Pérez and Leslie Pack Kaelbling}, year = {2026}, url = {https://arxiv.org/abs/2501.00296}, note = {Source identifier: 2501.00296} }