@misc{indiciae86d22edae268, title = {Integrating Chain-of-Thought for Multimodal Alignment: A Study on 3D Vision-Language Learning}, author = {Yanjun Chen and Yirong Sun and Xinghao Chen and Jian Wang and Xiaoyu Shen and Wenjie Li and Wei Zhang}, year = {2025}, url = {https://arxiv.org/abs/2503.06232}, note = {Source identifier: 2503.06232} }