@misc{indiciaed998f1a4fa6e, title = {Video-Text as Game Players: Hierarchical Banzhaf Interaction for Cross-Modal Representation Learning}, author = {Peng Jin and Jinfa Huang and Pengfei Xiong and Shangxuan Tian and Chang Liu and Xiangyang Ji and Li Yuan and Jie Chen}, year = {2023}, url = {https://arxiv.org/abs/2303.14369}, note = {Source identifier: 2303.14369} }