TY - RPRT TI - Multi-modal Large Language Model Enhanced Pseudo 3D Perception Framework for Visual Commonsense Reasoning AU - Jian Zhu AU - Hanli Wang AU - Miaojing Shi PY - 2023 UR - https://arxiv.org/abs/2301.13335 ID - 2301.13335 ER -