@misc{indiciae8fe40086902b, title = {Modelling Visual Semantics via Image Captioning to extract Enhanced Multi-Level Cross-Modal Semantic Incongruity Representation with Attention for Multimodal Sarcasm Detection}, author = {Sajal Aggarwal and Ananya Pandey and Dinesh Kumar Vishwakarma}, year = {2024}, url = {https://arxiv.org/abs/2408.02595}, note = {Source identifier: 2408.02595} }