@misc{indiciaea439b91fad36, title = {FM-OV3D: Foundation Model-based Cross-modal Knowledge Blending for Open-Vocabulary 3D Detection}, author = {Dongmei Zhang and Chang Li and Ray Zhang and Shenghao Xie and Wei Xue and Xiaodong Xie and Shanghang Zhang}, year = {2023}, url = {https://arxiv.org/abs/2312.14465}, note = {Source identifier: 2312.14465} }