@misc{indiciae8cb129808f8d, title = {Multimodal Self-Attention Network with Temporal Alignment for Audio-Visual Emotion Recognition}, author = {Inyong Koo and yeeun Seong and Minseok Son and Jaehyuk Jang and Changick Kim}, year = {2026}, url = {https://arxiv.org/abs/2603.11095}, note = {Source identifier: 2603.11095} }