TY - RPRT TI - Cross modal video representations for weakly supervised active speaker localization AU - Rahul Sharma AU - Krishna Somandepalli AU - Shrikanth Narayanan PY - 2021 DO - 10.1109/tmm.2022.3229975 UR - https://arxiv.org/abs/2003.04358 ID - 2003.04358 ER -