TY - RPRT TI - ViMoNet: A Multimodal Vision-Language Framework for Human Behavior Understanding from Motion and Video AU - Rajan Das Gupta AU - Lei Wei AU - Md Yeasin Rahat AU - Nafiz Fahad AU - Abir Ahmed AU - Liew Tze Hui PY - 2026 UR - https://arxiv.org/abs/2508.09818 ID - 2508.09818 ER -