@misc{indiciae7ca5d65d7cd8, title = {Percept, Chat, and then Adapt: Multimodal Knowledge Transfer of Foundation Models for Open-World Video Recognition}, author = {Boyu Chen and Siran Chen and Kunchang Li and Qinglin Xu and Yu Qiao and Yali Wang}, year = {2025}, url = {https://arxiv.org/abs/2402.18951}, note = {Source identifier: 2402.18951} }