@misc{indiciae13236ea9e105, title = {MSSTNet: A Multi-Scale Spatio-Temporal CNN-Transformer Network for Dynamic Facial Expression Recognition}, author = {Linhuang Wang and Xin Kang and Fei Ding and Satoshi Nakagawa and Fuji Ren}, year = {2024}, doi = {10.1109/icassp48485.2024.10446699}, url = {https://arxiv.org/abs/2404.08433}, note = {Source identifier: 2404.08433} }