TY - RPRT TI - Multimodal Alignment with Cross-Attentive GRUs for Fine-Grained Video Understanding AU - Namho Kim AU - Junhwa Kim PY - 2025 UR - https://arxiv.org/abs/2507.03531 ID - 2507.03531 ER -