@misc{indiciaeef1b5281b495, title = {Video-Only ToM: Enhancing Theory of Mind in Multimodal Large Language Models}, author = {Siqi Liu and Xinyang Li and Bochao Zou and Junbao Zhuo and Huimin Ma and Jiansheng Chen}, year = {2026}, url = {https://arxiv.org/abs/2603.24484}, note = {Source identifier: 2603.24484} }