TY - RPRT TI - CLAP: Contrastive Latent Action Pretraining for Learning Vision-Language-Action Models from Human Videos AU - Chubin Zhang AU - Jianan Wang AU - Zifeng Gao AU - Yue Su AU - Tianru Dai AU - Cai Zhou AU - Jiwen Lu AU - Yansong Tang PY - 2026 UR - https://arxiv.org/abs/2601.04061 ID - 2601.04061 ER -