@misc{indiciae4ff041ff27f2, title = {From Thousands to Billions: 3D Visual Language Grounding via Render-Supervised Distillation from 2D VLMs}, author = {Ang Cao and Sergio Arnaud and Oleksandr Maksymets and Jianing Yang and Ayush Jain and Sriram Yenamandra and Ada Martin and Vincent-Pierre Berges and Paul McVay and Ruslan Partsey and Aravind Rajeswaran and Franziska Meier and Justin Johnson and Jeong Joon Park and Alexander Sax}, year = {2025}, url = {https://arxiv.org/abs/2502.20389}, note = {Source identifier: 2502.20389} }