TY - RPRT TI - VideoLLaMA 3: Frontier Multimodal Foundation Models for Image and Video Understanding AU - Boqiang Zhang AU - Kehan Li AU - Zesen Cheng AU - Zhiqiang Hu AU - Yuqian Yuan AU - Guanzheng Chen AU - Sicong Leng AU - Yuming Jiang AU - Hang Zhang AU - Xin Li AU - Peng Jin AU - Wenqi Zhang AU - Fan Wang AU - Lidong Bing AU - Deli Zhao PY - 2025 UR - https://arxiv.org/abs/2501.13106 ID - 2501.13106 ER -