@misc{indiciae0d0d872ab178, title = {Multi-Modal Emotion Recognition by Text, Speech and Video Using Pretrained Transformers}, author = {Minoo Shayaninasab and Bagher Babaali}, year = {2024}, url = {https://arxiv.org/abs/2402.07327}, note = {Source identifier: 2402.07327} }