TY - RPRT TI - Phoneme-Level Visual Speech Recognition via Point-Visual Fusion and Language Model Reconstruction AU - Matthew Kit Khinn Teng AU - Haibo Zhang AU - Takeshi Saitoh PY - 2026 UR - https://arxiv.org/abs/2507.18863 ID - 2507.18863 ER -