TY - RPRT TI - Vision-Language Models for Egocentric Video: From Hand-Object Interaction to Embodied AI AU - Mohammad Zamani AU - Fatemeh Ziaeetabar PY - 2026 UR - https://arxiv.org/abs/2608.18671 ID - 2608.18671 ER -