TY - RPRT TI - GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models AU - Zhangyang Qi AU - Zhixiong Zhang AU - Ye Fang AU - Jiaqi Wang AU - Hengshuang Zhao PY - 2025 UR - https://arxiv.org/abs/2501.01428 ID - 2501.01428 ER -