S³-MSD: Large Vision-Language Model for Explainable and Generalizable Multi-modal Sarcasm Detection.
Zhihong Zhu, Fan Zhang, Yunyan Zhang, Jinghan Sun, Guimin Hu, Hao Wu, Yuyan Chen, Bowen Xing, Xian Wu
Browse the full AAAI paper archive.
Zhihong Zhu, Fan Zhang, Yunyan Zhang, Jinghan Sun, Guimin Hu, Hao Wu, Yuyan Chen, Bowen Xing, Xian Wu
Browse the full AAAI paper archive.