TY - RPRT TI - Scene-R1: Video-Grounded Large Language Models for 3D Scene Reasoning without 3D Annotations AU - Zhihao Yuan AU - Shuyi Jiang AU - Chun-Mei Feng AU - Yaolun Zhang AU - Shuguang Cui AU - Zhen Li AU - Na Zhao PY - 2025 UR - https://arxiv.org/abs/2506.17545 ID - 2506.17545 ER -