@misc{indiciaed18f281796d2, title = {Vision-Language Models as Differentiable Semantic and Spatial Rewards for Text-to-3D Generation}, author = {Weimin Bai and Yubo Li and Weijian Luo and Wenzheng Chen and He Sun}, year = {2025}, url = {https://arxiv.org/abs/2509.15772}, note = {Source identifier: 2509.15772} }